Loading...
Voice AI Dev Meetup #1: голосовые технологии в продакшене
Conference

Voice AI Dev Meetup #1: голосовые технологии в продакшене

About

Погрузитесь в мир голосовых технологий на первом Voice AI Dev Meetup! Мы соберёмся, чтобы обсудить самые актуальные вызовы и инновации в работе с речью и голосовыми интерфейсами, от распознавания до создания естественных диалогов.

О событии

Bitmanager.ai приглашает разработчиков и инженеров, увлеченных речевыми технологиями, на открытую встречу. Вас ждут глубокие доклады о распознавании и синтезе речи, тонкостях обработки перебиваний и создании интеллектуальных голосовых агентов, способных вести по-настоящему живой диалог.

Программа

  • Евгения Заворина / Voice Engineering Lead @ Bitmanager.ai

    • «Перебей меня, если сможешь: подводные камни перебиваний в голосовом агенте»
    • Разберём, как голосовой агент понимает, что его перебили, и как это влияет на естественность диалога. Поговорим о детекции голосовой активности, различии типов речевых сигналов и балансе между скоростью реакции и точностью классификации.
  • Кирилл Бородин / Voice Engineer @ Bitmanager.ai (Interspeech’26 Author)

    • «Твой ход: как мы учили модель понимать смену хода в диалоге»
    • Представим BitTurn — наше решение на базе GigaAM-CTC для точного и быстрого определения конца реплики в живом диалоге. Обсудим оптимизацию инференса, неоднозначные backchannel-сигналы и подготовку данных из реальных разговоров.
  • Максим Маслов / Senior Voice Engineer @ VK R&D (Senior Research Scientist @ lab260)

    • «Как мы построили крупнейшую в России открытую полноцикловую экосистему речевого антиспуфинга»
    • Узнайте о создании универсального детектора голосовых дипфейков. Будут представлены архитектуры AASIST3, Res2TCNGuard, семейство Spectra, русскоязычный бенчмарк RuASD, мультиязычный набор LRLspoof, бенчмарк синтетической дизартрической речи и открытая Speech Anti-Spoofing Arena.
  • Денис Петров / Voice ML Research Engineer @ MWS AI

    • «ESpeech: открытый русский TTS на трёх 4090, от датасета до синтеза с клонированием голоса»
    • Расскажем о разработке ESpeech — открытого русского TTS, где русский язык является приоритетным. Обсудим пайплайн обработки данных, наш аудиокодек ECodec, обучение моделей и эксперименты. Представим RUAccent-bench — бенчмарк качества ударений в TTS-системах.

Место проведения

Москва

Никитский бульвар, 7Б, «Светлый лофт»

Open in Maps
Представлено

Hosted by