и посмотреть медиа
Нейроканал - ИИ нейросети
и посмотреть медиа
Искусственный интеллект, нейросети, машинное обучение.
Искусственный интеллект, нейросети, машинное обучение.
Общайся с AI девушкой 18+ в Telegram. Живые диалоги, эмоции и реалистичное общение без ограничений.
AI бот для озвучки текста и клонирования голоса в Telegram. Создавай аудио с помощью нейросети быстро и просто.
Генерация картинок, видео и музыки нейросетями прямо в Telegram
AI-бот для генерации фото, видео, звука и других медиа с помощью нейросетей. Подходит для быстрого создания контента и тестирования возможностей ИИ в одном месте.
Канал о развитии ИИ: нейронные сети, машинное обучение, актуальные новости и исследования для энтузиастов и специалистов.
Ant Group выложила LLaDA-Image, открытую модель с диффузионным трансформером на 6 млрд параметров, которая и генерирует картинки, и редактирует их по инструкции одним чекпоинтом. Устройство необычное: и языковой бэкбон, и картиночная часть здесь диффузионные, обучены в одной рамке. Есть базовая версия на 50 шагов и Turbo на 4 шага, обе рисуют текст на английском и китайском. На Qwen-Image-Bench модель первая среди открытых, впереди Z-Image Turbo и HunyuanImage 3.0, но до закрытых не дотягивает: FLUX.2 Max, Seedream 5.0, Qwen-Image 2.0 Pro и Nano Banana 2.0 выше, GPT-Image 2 впереди почти на 12 баллов, график на картинке. Веса лежат на HuggingFace под Apache 2.0, есть FP8-варианты и демо Turbo. Код обучения обещают позже. @neuro_channel
Открыть канал и посмотреть медиаAnt Group выпустила Ling-3.0-flash-VL, зрячую версию своей Ling-3.0-flash: MoE, 5,1 млрд активных из 124, теперь с пониманием картинок и визуальными агентными задачами. Сравнивают с Qwen3.8-27B, Gemini 3.5 Flash-Lite и Step-3.7-Flash, таблица на картинке. Впереди по подсчёту объектов, распознаванию документов в OmniDocBench, агентным задачам с картинками (ClawEval-MM с заметным отрывом, WebVoyager) и на собственном тесте по чтению медицинских заключений, в MMMU-Pro вровень с Gemini. Отстаёт от Qwen3.8-27B в математике по картинкам, Humanity's Last Exam, чтении графиков и вёрстке по скриншоту, а в WorldVQA сильно уступает Step-3.7-Flash. Весов и страницы модели пока нет: ни на HuggingFace, ни на ModelScope. У текстовой Ling-3.0-flash лицензия MIT. @neuro_channel
Открыть канал и посмотреть медиаЛокальная GLM-5.3-Flash стала быстрее в 1,6–3,3 раза: Unsloth дописали свой pull request в llama.cpp, ускорили декодирование и добавили поддержку MTP, предсказания нескольких токенов за шаг. Ничего докачивать не нужно, кванты те же, что и неделю назад: в Unsloth Desktop достаточно обновиться, в llama.cpp собрать их ветку по гайду. Прирост растёт с длиной контекста, графики на картинке. На коротких промптах ускорение до 1,6 раза, на 64 тысячах токенов ещё без MTP скорость выросла больше чем вдвое. С MTP лучший вариант два черновых токена, при трёх и пяти скорость снова падает. Требования не изменились: 1-битный квант в 100 ГБ памяти, 3-битный в 128 ГБ, как у Mac Studio или DGX Spark. @neuro_channel
Открыть канал и посмотреть медиаДля тех кто ещё сидит на Claude: лимиты только что сбросили для всех Max-планов. Говорят, впереди выходные, приятного мол вам кодинга. Нам бы лучше сброс Codex, новая Astra сама себя не протестирует! 👾 @neuro_channel
Открыть канал и посмотреть медиаGPT-6 Astra доступна в Codex, можно тестировать! @neuro_channel
Открыть канал и посмотреть медиа«Оффлайн» в статусе аськи держался часами, хотя человек был онлайн и активно всех троллил. SpaceWeb и Типичный программист вспомнили и это, и многое другое в анкете к 25-летию компании: школьные вопросы про спорт, друзей и обои на рабочем столе, а вокруг — кнопочные телефоны, скайп, биткоин и вся история веба с 2001 по 2026 год. Между делом покажем, как менялась и сама компания. В конце — небольшой взгляд в будущее, промокод на услуги SpaceWeb и результат: какой ты носитель информации. Реклама. ООО «СпейсВэб», ИНН 7813376370, erid: 2W5zFJSwBzH
Открыть канал и посмотреть медиаНи дня покоя, сегодня выложили новую стелс-модель Omen Alpha: чья она, не говорят, доступна только подписчикам OpenCode Go за 10 долларов в месяц, и на неё дают отдельный лимит в 100 долларов вместо обычных 60. По спецификации контекст 500 тысяч токенов, вывод до 128 тысяч, понимает картинки, есть режим рассуждений, данные не хранятся. В описании модели «oH man anothEr aLPha ModEl» заглавные буквы складываются в HELP ME. Главная версия про автора: Zhipu. На странице данных OpenCode модель лежала по пути с именем zhipu, после чего в репозитории OpenCode появился коммит, который принудительно показывает провайдера Omen Alpha как unknown в статистике. Против этой версии то, что GLM-5.3-Flash вышла всего неделю назад, а Omen отвечает быстрее, чем обычно умеют модели GLM: тестеры на V2EX намерили от 60 до 130 токенов в секунду и по стилю цепочки рассуждений ставят на MiMo от Xiaomi. Правда, MiMo-V2.5-Pro-UltraSpeed не понимает картинки, а Omen понимает и при этом принимает промпт на 850 тысяч токенов, хотя после 256 тысяч сильно замедляется. Схема уже отработана: в августе такой же безымянный Ox Alpha две недели крутился в OpenCode и на OpenRouter бесплатно, набрал 62 триллиона токенов и оказался GLM-5.3-Flash. Omen Alpha на OpenRouter нет, это первый стелс-запуск за платной подпиской. @neuro_channel
Открыть канал и посмотреть медиаZ․ai снова раздаёт бесплатные токены GLM-5.3-Flash в ZCode, на этот раз по 300 миллионов на человека, объявили в аккаунте ZCode. Weekend Build откроется в субботу в 4 утра по Москве и продлится до 18:00 воскресенья. Раздача по принципу «кто первый», прошлые паки разобрали быстро, поэтому пишу заранее. Забрать можно только внутри ZCode: карточка появляется в левом нижнем углу приложения, если её нет, перезапустить. Тратить токены тоже можно только там. Параллельно до 20 сентября идёт ночной Global Build: каждую ночь с 18:00 до 4 утра по Москве подписчики Coding Plan работают на Flash бесплатно, а новым пользователям при регистрации дают разовые 100 миллионов токенов, бонусы суммируются. @neuro_channel
Открыть канал и посмотреть медиаMicrosoft AI выпустила MAI-Transcribe-2, модель распознавания речи, и заявляет её самой быстрой, точной и дешёвой на рынке. Модель понимает 60 языков, сама определяет язык, разделяет говорящих, ставит таймкоды на каждое слово и переключается между языками внутри одной записи. Есть режимы verbatim, со всеми «э-э» и оговорками, и clean, где мусор вычищен, плюс подсказка терминов, чтобы модель не коверкала названия и аббревиатуры. На мультиязычном бенчмарке FLEURS модель первая со средним WER 5,2% (доля неверно распознанных слов). У Artificial Analysis она вторая по точности с WER 2,0% и обрабатывает аудио в 410 раз быстрее реального времени: по их замерам в 10 раз быстрее GPT-Transcribe от OpenAI, в 7 раз быстрее Scribe v2 от ElevenLabs и в 5 раз быстрее Gemini 3.5 Transcribe. Цена 0,10 доллара за час аудио до конца года, дальше обещают поднять. Для сравнения, GPT-Transcribe стоит 0,27 доллара за час. Модель уже доступна на OpenRouter под именем microsoft/mai-transcribe-2, а также в Microsoft Foundry и MAI Playground. @neuro_channel
Открыть канал и посмотреть медиаТолько зарегистрированные пользователи могут делиться своим мнением.
Станьте первым, кто поделится своим впечатлением об этом ресурсе!
Сканер для подсчета калорий, белков, жиров и углеводов по фото еды в Telegram.
Бот меняет стиль фотографии на студию Ghibli. Загружайте фото и получайте аниме-версии мгновенно в Telegram.