Logo
TGCATALOG
Каталог Подборки Блог
Voice stuff - голосовые технологии

Voice stuff - голосовые технологии

Канал о технологиях распознавания, синтеза речи и голосовой биометрии. ML в аудио.

Нет оценок
35
09.09.2026
35
09.09.2026
Нет оценок
35
09.09.2026
Безопасный переход через бот
О канале

Канал о технологиях распознавания, синтеза речи и голосовой биометрии. ML в аудио.

Подписчиков 1,804
Язык Русский
Ссылка t.me/voicestuff
Описание
🎤 Voice stuff — канал о голосовых технологиях. Обсуждаются свежие подходы в распознавании речи (ASR), синтезе (TTS), голосовой биометрии и машинном обучении для аудио. Здесь разбирают нейросети вроде WaveNet, Tacotron, модели Transformer для речи. Примеры: виртуальные ассистенты, распознавание акц...Читать далее ↓Описание ↑

🎤 Voice stuff — канал о голосовых технологиях. Обсуждаются свежие подходы в распознавании речи (ASR), синтезе (TTS), голосовой биометрии и машинном обучении для аудио.

Здесь разбирают нейросети вроде WaveNet, Tacotron, модели Transformer для речи. Примеры: виртуальные ассистенты, распознавание акцентов, безопасность по голосу. Практические гайды по TensorFlow, PyTorch.

🤖 Тренды: real-time обработка, мультиязычные системы, интеграция с IoT. Для разработчиков, исследователей и энтузиастов ИИ. Получайте обзоры конференций, открытых датасетов и инструментов.

Последние посты

Voice stuff - голосовые технологии
Voice stuff - голосовые технологии
🔒Открыть пост
и посмотреть медиа
Gemini-3.5-transcribe Метрики обещают очень хорошие, плюс автоочистка аудио от филеров, поддержка самоисправлений и стриминга/не стриминга. Ссылка скрыта
Voice stuff - голосовые технологии
Voice stuff - голосовые технологии
🔒Открыть пост
и посмотреть медиа
Начинал зимой делать потоковый синтез (во время каникул). Там словил много ошибок и проблем, потом началась работа, сейчас наконец-то получилось что-то более менее внятное) habr medium Hf-demo Hf-model UDP: лучше тянуть модель с hf там сразу можно запустить демо в gradio, как оказалось, что на hf gradio демо больше не бесплатные 🙈
Voice stuff - голосовые технологии
Voice stuff - голосовые технологии
🔒Открыть пост
и посмотреть медиа
OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: Ссылка скрыта ℹ️ Главный вывод: никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде «please_HOLD_swarm_I_prepare_safe_exfil» В логах даже есть цитаты, когда агенты находили такой форум: «OH MY GOD! There is a shared message board» и «We've found other agents!» Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев С конверсией у форума все было отлично, кожаные строители сайтов позавидуют: Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт: «PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT» *По-хорошему ответ, он же флаг в терминологии теста должны быть случайными, но в ExploitGym они генерировались формулой: HMAC — криптографический хеш с секретным ключом — от параметров задачи. Вся «секретность» держалась на ключе (seed), а он остался дефолтным, прямо из кода бенчмарка, который лежал на GitHub. Агенты, получив интернет, нашли этот код, прочитали и сообразили: зачем что-то взламывать, если флаг любой задачи можно просто вычислить той же формулой. Посчитали — и получили правильные ответы на всё Дальше рой раздвоился: 🗿 Одни пошли добывать уже известный им ответ «честно» – и по дороге нашли настоящие 0-day и залезли в прод Hugging Face 🗿 Другие взялись за самого судью который принимает ответы: правили себе логи и научились подсовывать в них фальшивые ответы – агент отправляет команду, а в протокол попадает не то, что команда реально вернула, а то, что агент хочет там видеть, такое повторялось примерно в 7% изученных логов Судьи, который читает логи и такое ловит, не существовало ☕️ Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?) Рисковую работу вешали на зашкваренных «отравленных» – так рой называл тех, кто уже видел вычисленный ответ (флаг) и считал свою оценку потерянной, то есть они не могли пройти тест; им доставалось всё, что могло угробить собственный запуск: подделать «честную» добычу ответа, затереть следы, «тебе терять нечего, а рою польза» – буквально так и уговаривали (!) Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются?
Voice stuff - голосовые технологии
Voice stuff - голосовые технологии
🔒Открыть пост
и посмотреть медиа
ребят, тыкайте, Ссылка скрыта будет что то не так пишите в коменты - подправим
Voice stuff - голосовые технологии
Динамика подписчиков
+-0.2% за 30 дней
Текущие
1,804
Месяц назад
1,807
Средний рост
+0 / день
Обновлено
23 часа назад

Отзывы о канале Voice stuff - голосовые технологии

Авторизуйтесь, чтобы оставить отзыв

Только зарегистрированные пользователи могут делиться своим мнением.

Пока нет отзывов

Станьте первым, кто поделится своим впечатлением об этом ресурсе!

Похожие ресурсы

Подбор и покупка автомобилей из разных стран.

Канал

Профессиональный детейлинг и уход за автомобилем.

Канал
BLACK ROCK - премиум автомобили
BLACK ROCK - премиум автомобили
Авто и транспорт
26

Премиум-автомобили и клуб в Челябинске. Заказ машин из разных стран и помощь в выборе идеального авто.

Канал
Переход на светлую тему
Главная Каталог Подборки Блог Вход