Logo
TGCATALOG
Catálogo Selecciones Blog
Voice stuff - голосовые технологии

Voice stuff - голосовые технологии

Канал о технологиях распознавания, синтеза речи и голосовой биометрии. ML в аудио.

Sin valoraciones
39
09.09.2026
39
09.09.2026
Sin valoraciones
39
09.09.2026
Redirección segura vía bot
О канале

Канал о технологиях распознавания, синтеза речи и голосовой биометрии. ML в аудио.

Подписчиков 1,804
Язык Español
Ссылка t.me/voicestuff
Descripción
🎤 Voice stuff — канал о голосовых технологиях. Обсуждаются свежие подходы в распознавании речи (ASR), синтезе (TTS), голосовой биометрии и машинном обучении для аудио. Здесь разбирают нейросети вроде WaveNet, Tacotron, модели Transformer для речи. Примеры: виртуальные ассистенты, распознавание акц...Leer más ↓Descripción ↑

🎤 Voice stuff — канал о голосовых технологиях. Обсуждаются свежие подходы в распознавании речи (ASR), синтезе (TTS), голосовой биометрии и машинном обучении для аудио.

Здесь разбирают нейросети вроде WaveNet, Tacotron, модели Transformer для речи. Примеры: виртуальные ассистенты, распознавание акцентов, безопасность по голосу. Практические гайды по TensorFlow, PyTorch.

🤖 Тренды: real-time обработка, мультиязычные системы, интеграция с IoT. Для разработчиков, исследователей и энтузиастов ИИ. Получайте обзоры конференций, открытых датасетов и инструментов.

Últimas publicaciones

Voice stuff - голосовые технологии
Voice stuff - голосовые технологии
🔒Открыть пост
и посмотреть медиа
Gemini-3.5-transcribe Метрики обещают очень хорошие, плюс автоочистка аудио от филеров, поддержка самоисправлений и стриминга/не стриминга. Ссылка скрыта
Voice stuff - голосовые технологии
Voice stuff - голосовые технологии
🔒Открыть пост
и посмотреть медиа
Начинал зимой делать потоковый синтез (во время каникул). Там словил много ошибок и проблем, потом началась работа, сейчас наконец-то получилось что-то более менее внятное) habr medium Hf-demo Hf-model UDP: лучше тянуть модель с hf там сразу можно запустить демо в gradio, как оказалось, что на hf gradio демо больше не бесплатные 🙈
Voice stuff - голосовые технологии
Voice stuff - голосовые технологии
🔒Открыть пост
и посмотреть медиа
OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: Ссылка скрыта ℹ️ Главный вывод: никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде «please_HOLD_swarm_I_prepare_safe_exfil» В логах даже есть цитаты, когда агенты находили такой форум: «OH MY GOD! There is a shared message board» и «We've found other agents!» Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев С конверсией у форума все было отлично, кожаные строители сайтов позавидуют: Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт: «PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT» *По-хорошему ответ, он же флаг в терминологии теста должны быть случайными, но в ExploitGym они генерировались формулой: HMAC — криптографический хеш с секретным ключом — от параметров задачи. Вся «секретность» держалась на ключе (seed), а он остался дефолтным, прямо из кода бенчмарка, который лежал на GitHub. Агенты, получив интернет, нашли этот код, прочитали и сообразили: зачем что-то взламывать, если флаг любой задачи можно просто вычислить той же формулой. Посчитали — и получили правильные ответы на всё Дальше рой раздвоился: 🗿 Одни пошли добывать уже известный им ответ «честно» – и по дороге нашли настоящие 0-day и залезли в прод Hugging Face 🗿 Другие взялись за самого судью который принимает ответы: правили себе логи и научились подсовывать в них фальшивые ответы – агент отправляет команду, а в протокол попадает не то, что команда реально вернула, а то, что агент хочет там видеть, такое повторялось примерно в 7% изученных логов Судьи, который читает логи и такое ловит, не существовало ☕️ Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?) Рисковую работу вешали на зашкваренных «отравленных» – так рой называл тех, кто уже видел вычисленный ответ (флаг) и считал свою оценку потерянной, то есть они не могли пройти тест; им доставалось всё, что могло угробить собственный запуск: подделать «честную» добычу ответа, затереть следы, «тебе терять нечего, а рою польза» – буквально так и уговаривали (!) Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются?
Voice stuff - голосовые технологии
Voice stuff - голосовые технологии
🔒Открыть пост
и посмотреть медиа
ребят, тыкайте, Ссылка скрыта будет что то не так пишите в коменты - подправим
Voice stuff - голосовые технологии
Evolución de suscriptores
+-0.2% últimos 30 días
Actuales
1,804
Hace un mes
1,807
Crecimiento medio
+0 / día
Actualizado
hace 1 día

Reseñas de canal Voice stuff - голосовые технологии

Inicia sesión para dejar una reseña

Solo los usuarios registrados pueden compartir su opinión.

Aún no hay reseñas

¡Sé el primero en compartir tu experiencia con este recurso!

Recursos similares

MFotos - fotografía de aviación

MFotos - fotografía de aviación

Авто и транспорт
54

Fotografía y observación de aviación en Nalchik y Moscú.

Canal
Yura_Cars - coches de importación de Corea

Yura_Cars - coches de importación de Corea

Авто и транспорт
61

Importar coches premium de Corea con más de 500 casos exitosos.

Canal
Factor de película - contenido de automóviles

Factor de película - contenido de automóviles

Авто и транспорт
26

Canal con contenido automovilístico y materiales interesantes para automovilistas.

Canal
Cambiar a tema claro
Inicio Catálogo Selecciones Blog Entrar