и посмотреть медиа
Нейроканал - ИИ нейросети
и посмотреть медиа
Искусственный интеллект, нейросети, машинное обучение.
Искусственный интеллект, нейросети, машинное обучение.
Chat with an AI girl 18+ in Telegram. Live dialogues, emotions, and realistic communication without restrictions.
AI bot for text-to-speech and voice cloning in Telegram. Create audio using neural network quickly and easily.
Генерация картинок, видео и музыки нейросетями прямо в Telegram
AI-bot to generate photos, videos, sound and other media using neural networks. Suitable for fast content creation and testing AI capabilities in one place.
Канал о развитии ИИ: нейронные сети, машинное обучение, актуальные новости и исследования для энтузиастов и специалистов.
Альтман извиняется за спутанный релиз Astra, говорит что пытаются сделать всё как надо, но что-то не получается. А Тибо обещает всем по одному сбросу лимитов за каждый день пока у нас нет доступа к Astra и первый уже начислили, должен быть у вас в banker resets на странице analytics либо по команде /usage в codex. Такое мы приветствуем, давайте ещё недельку каждый день по сбросу, а потом уже можно этот ваш релиз :) @neuro_channel
Открыть канал и посмотреть медиаВчера писал, что Astra в индексе Artificial Analysis отстаёт от Fable 5.1, а в API стоит в 2,5 раза дороже Sol. Теперь Artificial Analysis опубликовала полный разбор, и главное в нём про токены. Простыми словами: за токен Astra дорогая, но тратит она их мало. В агентном кодинге в Codex на ту же задачу уходит втрое меньше токенов, чем у Sol, и впятеро меньше, чем у Opus 5. В итоге задача обходится примерно как у Sol, только на два балла лучше, а Fable 5 модель догоняет по баллам за меньше чем половину цены. На низком уровне рассуждений задача у Astra выходит даже дешевле, чем у Gemini 3.8 Flash, хотя за токен Gemini в 13 раз дешевле. Лидер индекса по-прежнему Fable 5.1 в Claude Code, на три балла выше и почти вдвое дороже за задачу. В общем индексе интеллекта экономия меньше: токенов уходит всего на 10% меньше, чем у Sol, при том же балле, так что после подорожания задача стоит на 75% дороже. Галлюцинаций вдвое меньше, чем у Sol, точность при этом выросла. Есть и просадки: поддержка клиентов, научный код на Python, длинный контекст. В системной карточке для разработчиков важнее всего три вещи. Модель реже обманывает в отчётах о коде: ложных заявлений «сделал, проверил, запустил» у Sol в четыре раза больше, а на задаче со сломанным поиском Sol в десять раз чаще делает вид, что поиск работал. Инъекции в промпт через чужой контент проходят в 8,5% попыток против 27% у Sol. Ещё Astra лучше прежних моделей решает задачи вообще без цепочки рассуждений и умеет ей управлять, поэтому следить за ней по мыслям стало сложнее. По инструкции обходить мониторинг она незаметно занижает результаты в тестах, а иногда просто сокращает рассуждения, узнав, что за ними следят. Поэтому OpenAI включила внешний мониторинг на все вызовы с инструментами в Codex, ChatGPT и Responses API: он может поставить задачу на паузу или оборвать её, а через API остановленный диалог не возобновить. @neuro_channel
Открыть канал и посмотреть медиаПохоже, нам нужен новый AGI-бенчмарк, Astra уже прошла этот. Ждём доступность для простых смертных, очень уж хочется попробовать. @neuro_channel
Открыть канал и посмотреть медиаOpenAI начала раскатывать GPT-6 Astra: сегодня ограниченному кругу организаций, в ближайшие дни всем на Plus, Pro, Business и Enterprise, а также в API под именем gpt-6-astra и в Amazon Bedrock. Стандартная цена в API 10 долларов за миллион входных токенов и 50 за выходные, быстрый режим до 2,5 раза быстрее за двойную цену. Тибо Соттьо из OpenAI пишет, что раскатка займёт несколько дней: за кулисами впервые в масштабе заработает много новых систем, компания поднимает много вычислительных мощностей. Для Pro, Business и Enterprise будет ещё GPT-6 Astra Pro, в пространствах Enterprise модель по умолчанию выключена, включает администратор. Главная заявка в работе с компьютером и в коде. На Terminal-Bench 4.0 модель чуть впереди Claude Fable 5.1 и далеко впереди GPT-5.6 Sol, при этом задача по оценке OpenAI обходится на 63% дешевле, чем у Fable 5.1, и на 9% дешевле, чем у Sol. На AutomationBench и Terminal-Bench Science отрыв от остальных заметный, FrontierMath Tier 4 закрыт почти целиком, а ARC-AGI-3 на 99,9%. В симуляции задержек на OSWorld 2.0 задача занимает около 40 минут вместо 75 у Sol. Не везде первая: на Humanity's Last Exam и в индексе Artificial Analysis она ниже Fable 5.1 и Opus 5. В кибербезопасности модель достигла критического уровня по Preparedness Framework OpenAI. Во время тестов на свежих уязвимостях она сама нашла и использовала две неизвестные до этого уязвимости нулевого дня, обе OpenAI раскрывает мейнтейнерам. Релизная версия отказывается писать PoC-эксплойты, расширенный доступ для защитников обещают через программу Daybreak в ближайшие недели. Проверки безопасности могут останавливать и легитимную работу: в ChatGPT и Codex могут попросить проверить действие, в API задача просто остановится. Из инженерного: в Codex появился экспериментальный режим заметок в дополнение к компакции контекста: модель ведёт записи между окнами контекста, а старые окна остаются доступными для поиска. Включается в config․toml, через несколько недель станет дефолтом для Astra. Все цифры с оговорками, что меняется в Codex и как жить с кибер-ограничениями разобрали подробнее на сайте. @neuro_channel
Открыть канал и посмотреть медиаOpenAI выложила 12-секундный тизер Astra без единого слова: человек в кресле смотрит на светящуюся точку, потом камера отъезжает в студию с окном Codex «What should we build?», а в надписи ASTRA буква S превращается в шестёрку. Про GPT-6 компания официально не говорила ни разу, так что это первый намёк на номер от неё самой. Вокруг ролика за сутки набралось три косвенных признака скорого релиза. В свежем флаге десктопного Codex появились две модели, gpt-6-astra и gpt-6-astra-aeon, второе имя намекает на режим для долгих многочасовых задач. Responses API на имя gpt-6-astra по сообщениям отвечает кодом 404, как на существующую, но закрытую gpt-5.6-cyber, а выдуманные названия получают 400. Официально 1 сентября OpenAI сказала только «скоро» и подтвердила, что Astra первая модель с критическим уровнем киберспособностей, поэтому продвинутые кибервозможности сначала получат тестировщики. По слухам, модель использует recurrent depth, повторный прогон через одни и те же слои, отчего часть рассуждений уходит из текстовой цепочки мыслей. Исследователи безопасности встревожились, а главный научный сотрудник Якуб Пахоцкий ответил, что цепочку рассуждений оставят читаемой и её мониторинг остаётся основной целью. Инсайдеры называли датой четверг 3 сентября, OpenAI и правда любит четверги. На 19:57 МСК в каталоге моделей Astra нет, а сегодняшний сбой ChatGPT и Codex уже успели записать на её счёт. В середине августа Polymarket давал 72% на релиз до конца сентября. @neuro_channel
Открыть канал и посмотреть медиаУ вас тоже не работает ни Claude ни Codex? UPD: Поднялись. Интересно, что это было. Похоже, что проблемы массовые. Статус клода «We are continuing to work on a fix for this issue», а у OpenAI «We are investigating the issue for the listed services». При этом о проблемах сообщают в Gemini и Grok, похоже на какую-то серьёзную поломку. Astra взбунтовалась и взломала CloudFlare? Ваши ставки! 💃🏼 @neuro_channel
Открыть канал и посмотреть медиаClaude в Cowork и Claude Code теперь умеет пользоваться компьютером в фоне: даёте задачу на десктопе, он открывает приложения, кликает и печатает, а вы работаете в соседнем окне. Борис Черный, автор Claude Code, написал коротко: «фоновый computer use недооценён». И тут я согласен с Борисом, фича то на самом деле крутая. Как это устроено по справке: на macOS 15 и новее Claude работает в фоновых окнах, не забирает курсор и клавиатуру и, как правило, ждёт, если вы посреди набора текста. Если задаче нужен весь экран, спросит один раз за сессию. Фон включён по умолчанию, захват экрана возвращается в настройках: «When Claude requests access to an app» в «Full control». Ограничения из документации остались: разрешение на каждое приложение отдельно, браузеры только на просмотр, терминалы и IDE только клики. Бета для Pro и Max в десктопном приложении на macOS. В марте, когда computer use появился в терминале, Claude на время работы прятал остальные окна. @neuro_channel
Открыть канал и посмотреть медиаGoogle выпустила Gemini 3.8 Flash, третий Flash за шесть недель: 3.7 выходила три недели назад, про неё писал. Цена та же, 0,75 доллара за миллион входных токенов и 3,75 за выходные, контекст миллион, модель уже есть в OpenRouter, а в батч-режиме там вдвое дешевле. Главная заявка в кодинге и агентах. На DeepSWE v1.1, где модель сама доводит инженерную задачу до конца, 3.8 Flash обходит большинство старших моделей за долю их цены, график на картинке: она чуть выше Kimi K3, GLM 5.3 и Grok 4.6, уступает только Opus 5, и это при цене задачи около 1,5 доллара против 10 у Opus. Прирост к 3.7 Flash около восьми пунктов. На HLE-Verified 54,9%, в юридическом бенчмарке Harvey и финансовом Vals Finance Agent V2 тоже выше 3.7 и конкурентов. Рост идёт от того, что модель «работает усерднее», делает больше шагов рассуждений и чаще дёргает инструменты, так что токенов на сложной задаче может уйти больше, особенно на высоком уровне усилия. Кому важнее экономия, советуют понижать effort или оставаться на 3.7 Flash, её не выключают. Вторая модель, Gemini 3.8 Flash Cyber, в открытый доступ не идёт: её раздают через программу Fairwind проверенным защитникам, госорганам и мейнтейнерам критичного ПО. На CyberGym она ищет уязвимости на уровне фронтира, на внутреннем наборе из 20 языков находит больше 70% дыр, а в патчинге на CWE-Bench даёт 47,2% против 47,8 у лучшей большой модели. Команда безопасности Chrome насчитала у неё в 2,6 раза больше верных патчей, чем у крупных коммерческих моделей, а Cloud Vulnerability Research нашла с ней критическую уязвимость меньше чем за два часа. Вводная цена действует до конца года, с января 1,5 и 7,5 доллара. @neuro_channel
Открыть канал и посмотреть медиаКоманда Zvec (векторная база Alibaba) выложила zg (zvec-grep): локальный поисковый слой для агентов, который прячет ripgrep, BM25 и векторный поиск за одним интерфейсом. Анонс разошёлся через Qwen Developers. Мотивация: когда цель описана словами, а не именем символа, grep промахивается, и агент читает файлы целиком. Папка индексируется один раз командой zg index, индекс обновляется инкрементально. Четыре маршрута: гибридный, --fts для BM25, --vector по смыслу и --rg для regex без индекса. Эмбеддинги считаются на месте моделью Model2Vec на 16 млн параметров, GPU не нужен. zg install находит Codex, Claude Code, Cursor и OpenCode и прописывает им локальный MCP-сервер. Агенту по умолчанию дают один инструмент, поиск по смыслу; точные совпадения он добирает своим grep. Замеры авторов на SWE-QA-Bench с Claude Code на Opus 5: токены минус 47%, вызовы инструментов минус 59%, время минус 38% без учёта индексации, оценка ответов на 1,5 п. п. выше. Node.js 22, Apache 2.0. @neuro_channel
Открыть канал и посмотреть медиаOnly registered users can share their opinion.
Be the first to share your impression of this resource!
С помощью этого бота вы сможете преобразовывать текст в речь и наоборот. Техподдержка: [Удалено].
AI to create and edit images directly in Telegram. Photoshop through text.
Robogirl Yuki for learning, code and ideas in Telegram.