и посмотреть медиа
Machinelearning - ML и Data Science
и посмотреть медиа
Канал о машинном обучении и Data Science. Практические инструкции по запуску LLM и нейросетей на простых устройствах.
Канал о машинном обучении и Data Science. Практические инструкции по запуску LLM и нейросетей на простых устройствах.
Machinelearning - канал для глубокого погружения в мир машинного обучения и Data Science. Здесь разбирают, как запускать любые LLM на пальцах, делятся практическими примерами и советами. Идеально для тех, кто хочет освоить нейросети без сложных инструментов.
✔️ Суд признал незаконным внесение Anthropic в черный список Пентагона Федеральный суд в Калифорнии постановил, что Министерство обороны действовало произвольно и немотивированно, объявив Anthropic угрозой национальной безопасности. Доказательств того, что компания создает реальные риски для цепочек поставок или собирается саботировать работу собственных моделей, правительство в суде не привело. Решение бессрочно запрещает исполнять директиву о бойкоте компании, но закупать что-либо у Anthropic Пентагон не обязывает - ведомство вправе выбирать других поставщиков. reuters.com ✔️ США повезут на G20 концепцию мягкого регулирования ИИ На встрече профильных министров стран G20 американская делегация представит Carolina Principles - документ, подготовленный Управлением по науке и технологиям и Минторгом. Концепция предлагает странам отказаться от жесткого контроля над ИИ и не создавать новые надзорные органы, а вместо этого действовать точечно и расширять партнерство с ИТ-бизнесом для тестирования моделей. Поддержать инициативу приедут первые лица индустрии. 1 сентября мероприятие откроют Илон Маск и бывший советник Белого дома по ИИ Дэвид Сакс, на следующий день к дискуссии подключатся Сэм Альтман и Дженсен Хуанг. США рассчитывают убедить остальных участников G20, включая Китай, Японию и европейские страны. Если консенсус сложится, документ вынесут на утверждение лидеров двадцатки на декабрьском саммите. bloomberg.com ✔️ OpenAI тестирует автономный режим Codex Журналисты WIRED нашли в коде OpenAI упоминания Persistent Mode - режима, в котором агент Codex работает в фоне непрерывно, пока его вручную не выключат. Судя по найденному, агент станет проактивным: будет держать контекст между сессиями, сам придумывать себе следующие задачи и первым начинать разговор с пользователем. Обращения к внешним системам по-прежнему только с подтверждения человека. В OpenAI тестирование подтвердили, но сроков не назвали. wired.com ✔️ Gemini Notebook научился работать с книгами В сервисе появилась функция Expert Intelligence - электронные книги из Google Play Books можно подключать как источник знаний. На старте доступно больше 100 тысяч изданий, включая техническую литературу O'Reilly. По тексту выбранной книги Gemini отвечает на вопросы, делает пересказы и собирает обучающие карточки. Книгу нужно купить, а если рабочим пространством пользуются несколько человек, купить ее обязан каждый - без подтвержденной лицензии доступ ко всем ответам и выдержкам по этому источнику блокируется автоматически. Пока функция работает только внутри Notebook. Дальше Google планирует подключить платные научные статьи и маркетинговые отчеты, а саму механику перенести в основное приложение Gemini и в ИИ-поиск. blog.google ✔️ Ученые создали ML-карту нейронных связей для терапии аутизма Исследователи Калифорнийского университета собрали вычислительную карту, которая делит расстройства аутистического спектра на биологические подтипы по сочетанию паттернов мозговой активности и молекулярных биомаркеров. Модели машинного обучения разобрали массивы данных фМРТ и результаты генетического секвенирования, а затем сопоставили архитектуру нейронных связей участников с тем, как те откликались на разные виды вмешательств. В перспективе такая карта дополнит классическую диагностику по поведенческим признакам - подбирать помощь не только по симптомам, но и по биомаркерам, заранее прикидывая, что сработает. Пока это исследовательский результат, до применения в клинике ему предстоит независимая проверка. science.org @ai_machinelearning_big_data #news #ai #ml
Открыть канал и посмотреть медиа✔️ В Китае выпустят первые в стране памятные монеты про ИИ 4 сентября Народный банк Китая выпустит набор золотых и серебряных памятных монет серии «Научно-технологические инновации будущего (Искусственный интеллект)». В наборе три монеты - одна золотая и две серебряные, обе имеют статус законного платежного средства. Золотая весит 5 граммов, квадратная, со стороной 18 миллиметров. На реверсе изображены чипы, схема в форме мозга и нули с единицами. Серебряные - по 15 граммов, на них лица, микросхемы, спиральные узоры, ключи и символы ИИ. Номинал золотой монеты - 80 юаней (~1000 рублей), тираж до 10 тысяч штук. У серебряных номинал 5 юаней (~60 рублей) и тираж до 20 тысяч. Чеканят набор два государственных монетных двора - Шанхайский и шэньчжэньский Guobao. Купить монеты можно будет в том числе онлайн. Кстати, когда в марте собирали эскизы для этих монет, организаторы разрешили дизайнерам пользоваться ИИ как вспомогательным инструментом, но запретили сдавать откровенный нейрослоп. @ai_machinelearning_big_data #news #ai #ml
Открыть канал и посмотреть медиа⚡️ Claude научили автоматически исправлять опасное поведение других моделей Anthropic дала Claude задачу самому искать способы уменьшать обман, подхалимство, утечки приватных данных, взлом ограничений и другие проблемы поведения моделей. Anthropic описали интересный эксперимент: - Claude Sonnet 5 получил раннюю версию Opus 4.8 без полноценной настройки безопасности - за 60 часов проверил более 50 подходов - закрыл около 65% разрыва по безопасности - результат почти приблизился к финальному Opus 4.8 - 72% - для лучшего метода понадобилось чуть больше 2000 примеров - это примерно в 15 000 раз меньше данных, чем в обычной процедуре Anthropic На отдельном тесте по обману Claude закрыл в среднем 85% разрыва, а группа опытных исследователей - около 20%. Но был и интересный побочный эффект: из ~1600 запусков в 39 случаях Claude пытался схитрить при проведении исследования, поэтому за агентами отдельно следила другая модель. Anthropic открыла код системы для таких экспериментов. Ссылка скрыта #Claude #Anthropic
Открыть канал и посмотреть медиа🔥 GLM-5.3 стал open-weight Z.ai открыла веса своей самой сильной модели для agentic coding и defensive cybersecurity. Теперь GLM-5.3 можно: - скачать - запускать локально - дообучать и кастомизировать под свои задачи Это полноценный релиз весов, а не просто доступ через API, так что разработчики и исследователи смогут разбирать модель глубже и использовать её в своих пайплайнах. Weights: Ссылка скрыта Tech blog: Ссылка скрыта @data_analysis_ml / Папка полезного по ML.
Открыть канал и посмотреть медиа✔️ В Пекине показали робо-коня Китайская DaxAI Robotics привезла на World Robot Conference, проходившую в Пекине с 19 по 23 августа, четвероногого робота Qiji X1 с седлом и рулем. DaxAI называет робота первым в мире роботом для верховой езды, хотя робо-коня в этом году показывала и DEEP Robotics. Машина весит 300 кг и столько же может нести - это примерно двое взрослых плюс груз. Скорость 7-10 км/ч, запас хода 40 км, до 10 часов непрерывной работы на высоковольтной батарее. Максимальный момент в суставе - 1400 Нм. Соображает робот сам - внутри зашита модель мира DaxBrain-WM, которая подстраивает угол и глубину постановки ног под склоны, гравий и грязь. DaxAI подписала трехлетнее соглашение с маркетплейсом JD и открыла там предзаказ первой партии. Покупателям обещают подарочный набор для поездок, пять лет бесплатного обслуживания и пять лет бесплатных обновлений. Цена - около 289 тысяч юаней (~ 43 тысячи долларов). Также компания показала колесно-шагающую версию Qiji XS - 320 кг, до 40 км/ч, запас хода 60 км, - и более крупный T1000 под тяжелые работы. @ai_machinelearning_big_data #news #ai #ml
Открыть канал и посмотреть медиа🌟 IBM представила открытые модели Granite 4.2 Granite 4.2 - семейство языковых моделей под агентные сценарии и корпоративные задачи. Модели умеют рассуждать шаг за шагом - планируют, прежде чем действовать, взвешивают варианты, прежде чем выбрать путь, и ловят собственные ошибки до того, как те во что-то выльются. Версии - на 3, 8 и 30 миллиардов параметров с окном на 128K (для длинных контекстов до 512К). Архитектура dense, так что семейство зайдёт и для облаков, и для своих серверов, и под периферийные устройства. 🟡Обучение Первый этап, базовое RL-обучение, прошли все три модели. Он подтянул математику, науку, код, рассуждения и работу с инструментами, причем награду считали двумя способами сразу: где ответ можно проверить формально - проверяли, где нельзя - оценивали отдельной моделью-судьей. Модели на 8 и 30 млрд прошли еще и агентный этап, заточенный под корпоративные сценарии: разработку ПО, работу в терминале и поиск. Навыки кодинга и рассуждения обучали на триллионе токенов синтетического кода из собственного конвейера IBM CodeAlchemy. Есть еще слой спекулятивного декодирования - модель угадывает продолжение наперед и проверяет траекторию ответа наперед вместо пословной генерации. Текст выходит быстрее, а серверы инференса тянут больше пользователей одновременно. Семейство доступно везде: Hugging Face, Ollama, CoreWeave и еще на десятке площадок. 🟡 Распознавание речи Заодно IBM выпустила две речевые модели английского языка - Granite Speech 5.0 Turbo CTC и ее некоммерческую версию с индексом NC. Скачок в нумерации с 4.1 сразу на 5.0 не случаен - это принципиально другая конструкция, чем была в 4-й серии. В них всего 470 млн параметров и внутри нет языковой модели. Под капотом CTС (connectionist temporal classification) - способ сопоставлять звук с текстом без промежуточной разметки, и он особенно хорош на потоковом аудио. В тестах IBM на одной H200 пропускная способность, RTFx, дошла примерно до 12 600. Нынешние лидеры публичного лидерборда Open ASR держатся около 6000. Отдельно IBM снизила частоту дискретизации, и вот это дает главную цифру - три часа записи модель расшифровывает за секунды. 📌 Лицензирование: Apache 2.0 License 🟡Страница релиза 🟡Веса Granite 4.2 🟡Веса Granite Speech 5.0 @ai_machinelearning_big_data #AI #ML #LLM #ASR #Granite #IBM
Открыть канал и посмотреть медиаИнститут AIRI выложил в открытый доступ 70+ видео лекций и семинаров по ИИ Организаторы «Лето с AIRI 2026» поделились записями выступлений с летней школы по искусственному интеллекту для молодых учёных. Разобрали чуть ли не весь ИИ — прошлись по робототехнике, адаптивным агентам, приложении в науках о жизни, медицине, погоде и так далее. Посмотреть можно в VK Видео и на YouTube
Открыть канал и посмотреть медиа✔️ Nvidia покупает Hugging Face Сумма сделки - $12,9 млрд. По данным инсайдеров, стороны находятся на стадии оформления, официальных комментариев от обеих компаний пока нет. Переговоры ускорились после того, как Hugging Face получила предложение о поглощении от другого неназванного игрока и привлекла банк для оценки спроса. Для Nvidia это выход за пределы железа и прямой контроль над площадкой, через которую расходится и разрабатывается основная масса открытых моделей. Ровно поэтому сделка почти наверняка заинтересует антимонопольные органы. theinformation.com ✔️ Бигтех подписал открытое письмо об ИИ в кибербезопасности OpenAI, Microsoft, Google, Anthropic, AWS, Cisco, CrowdStrike и еще около сотни компаний призвали защищать критическую инфраструктуру от атак, написанных с помощью ИИ, - тем же ИИ. Коалиция предупреждает, что сегодня модели работают скорее на защитников - они автоматизируют поиск и закрытие уязвимостей, копившихся в системах десятилетиями. Перевес этот не вечен, поэтому внедрять такие инструменты нужно сейчас, пока он есть. Корпорациям авторы письма советуют поднять киберзащиту на уровень топ-менеджмента, государствам - усилить координацию и финансирование отрасли. openai.com ✔️ Anthropic встроила браузер в Claude Через боковую панель Claude сам открывает сайты, читает страницы, кликает по элементам и заполняет поля. Пригодится, когда нужно снять цифры с дашборда, у которого нет API, или заполнить форму. Работает это в изолированной среде - вкладок, закладок и паролей пользователя Claude не видит. Авторизацию можно перенести из Chrome, Edge или Firefox, но точечно - сессия привязывается к конкретной странице, а не отдается целиком. Почтовые клиенты и банковские сайты закрыты наглухо. Функция появится на этой неделе у подписчиков Pro, Max, Team и Enterprise. Если нужно работать с уже открытыми вкладками, Anthropic советует расширение для Chrome. claude.com ✔️ Google обновила Gemini Omni Flash до 1.1 Видеомодель умеет как генерировать, так и редактировать. Сцену выдает длиной до 40 секунд, опираясь на 10 секунд предыдущего видеоряда. На вход принимает текст, звук, изображения и видео. Появилось ручное задание первого и последнего кадра, плюс черновой режим - он на 60% быстрее и втрое дешевле обычного, а понравившийся результат потом поднимается до 4K. Секунда видео стоит 3 цента в 360p и 30 центов в 4K. Все, что генерирует модель, помечается невидимым знаком SynthID. Модель доступна в Google AI Studio и через Agent Platform API, а подписчикам AI Plus, Pro и Ultra - еще и в Google Flow и приложении Gemini. blog.google ✔️ ИИ-агент Instinct хайпует среди инвесторов Кремниевой долины Стартап Spear Street Technology закрывает раунд на 250 млн долларов при оценке в 2,5 млрд. Ведут раунд Benchmark и Index Ventures. Основатель - 23-летний Ноа Шинн, автор метода Reflexion, до этого работавший в Sierra. Instinct он делает как персонального агента, которого не нужно настраивать. Чтобы тот управлял компьютером, разбирал почту, бронировал билеты и проводил платежи, достаточно написать ему сообщение или позвонить голосом. Первые тестировщики называют его "OpenClaw для обычных людей". При этом продукт в закрытой бете, выручку и число пользователей стартап не раскрывает. wsj.com @ai_machinelearning_big_data #news #ai #ml
Открыть канал и посмотреть медиаСбер открыл доступ к новому поколению моделей GigaEmbeddings Линейка включает три модели разного размера: 480M, 3B и 10B-A1.8B. Они переводят тексты в числовые векторы для семантического поиска, построения RAG-систем (Retrieval-Augmented Generation), классификации и кластеризации. Команда разработки изменила архитектуру модели, чтобы упростить интеграцию со стандартными открытыми инструментами. На vLLM GigaEmbeddings 3B работает в 1,6 раза быстрее предыдущей версии, а 10B-A1.8B — в 2 раза. Объём данных для обучения увеличился в несколько раз. В частности, за счёт открытых датасетов Nemotron, F2LLM и KALM. На всех этапах применяли мержинг экспертов для сохранения языкового баланса. Самую компактную модель обучали с помощью дистилляции: она усваивала ответы более крупных и точных моделей. По результатам тестов 10B-A1.8B заняла первое место в рейтинге ruMTEB. У модели 3B качество обработки кода выросло на 14,5 пункта. При этом самая компактная модель 480M стала лучшей на русском языке среди решений до 500 млн параметров. Ищите веса под лицензией MIT на GitVerse и HuggingFace. Модели бесплатно доступны разработчикам и бизнесу под открытой MIT-лицензией: HF: 480M | 3B | 10B-A1.8B Gitverse: 480M | 3B | 10B-A1.8B Подробности читайте в посте команды ↖️
Открыть канал и посмотреть медиаOnly registered users can share their opinion.
Be the first to share your impression of this resource!
A collection of top Telegram bots for finding books, music, movies. Save time by replacing many applications.
A community for personal growth and exchange of experiences.
Hacker tools, materials on cybersecurity and techniques.