{"id":14293,"url":"\/distributions\/14293\/click?bit=1&hash=05c87a3ce0b7c4063dd46190317b7d4a16bc23b8ced3bfac605d44f253650a0f","hash":"05c87a3ce0b7c4063dd46190317b7d4a16bc23b8ced3bfac605d44f253650a0f","title":"\u0421\u043e\u0437\u0434\u0430\u0442\u044c \u043d\u043e\u0432\u044b\u0439 \u0441\u0435\u0440\u0432\u0438\u0441 \u043d\u0435 \u043f\u043e\u0442\u0440\u0430\u0442\u0438\u0432 \u043d\u0438 \u043a\u043e\u043f\u0435\u0439\u043a\u0438","buttonText":"","imageUuid":""}

Бесплатное распознавание речи для всех желающих

Бесплатное распознавание речи для всех желающих

После относительно недавнего релиза мы сделали наше распознавание речи бесплатным для всех индивидуальных пользователей на страничке по адресу — https://audio-v-text.silero.ai/.

Да, вы не ослышались. Это не шутка, не очередная кампания по продаже "шпионских" гаджетов, не альтруизм и не обман:

  • Да, сервис сделан для простых людей, и там есть разумные ограничения на объем, перепродавать не получится (а если у кого-то получится, то нам придется или закрутить все сильнее, или закрыть сервис).
  • Да, мы предприняли разумные меры, чтобы сделать все безопасным как для нас, так и для пользователей.
  • Да, этот сервис будет бесплатным.
  • Да, мы полностью независимы и никак не аффилированы с теми самыми компаниями (если вы понимаете, о чем я).

Как Пользоваться

Инструкция простая до банальности:

  • зайти на страничку,
  • опционально попробовать демку с микрофоном,
  • залить свой файл в формочку,
  • получить распозанный файл на email.

По идее должно работать во всех основных браузерах. Рекомендуется заходить с ноутбука или десктопа, но и со смартфона в принципе тоже должно работать.

Не лишним будет упомянуть: правильно указывая, из какого домена (какого типа) ваше аудио, вы поможете повысить качество распознавания вашего аудио.

Идея Сервиса

Если сейчас обычному физическому лицу нужно что-то транскрибировать, то на рынке есть опции:

  • Есть решения, требующие регистрации, оплаты, создания личного кабинета.
  • Есть ограниченное количество корпоративных решений, которые, по очевидным причинам, тоже не закрывают этот случай.
  • Есть большое количество ML репозиториев, устаревших решений или поделок народных "умельцев". Но "обычный" пользователь вряд ли может ими воспользоваться.

Резюмируя: нет качественных решений для "маленьких"/одноразовых случаев использования (без геморроя и высокого порога входа). Мы решили это исправить. Будем признательны за вашу конструктивную обратную связь.

Текущие Ограничения

У сервиса в текущем виде есть ряд ограничений, часть которых решается технологически, а часть только процессуально:

  • Хотя мы можем разделять заранее известное количество говорящих, это не вошло в MVP сервиса.
  • Многоканальное аудио в MVP не разделяется и обрабатывается после усреднения каналов.
  • Наличие большого количества жаргона, англицизмов или очень редкой уникальной лексики негативно влияет на распознавание. Конечно это решается, но скорее уже в рамках отдельного проекта или с помощью ручной пост-обработки.
  • Чем лучше качество исходного аудио, тем лучше качество транскрибации.
  • На данный момент пунктуация и заглавные буквы автоматически в сервисе не проставляются, хотя мы в это умеем.
  • Для некоторых случаев, даже при хорошем качестве аудио и с учетом автоматической простановки знаков препинания, нужна пост-обработка людьми. Мы пока не предлагаем такой сервис.

Безопасность и Использование Данных

Мы используем лучшие из доступных нам инструментов. Мы шифруем трафик и данные. Мы блокируем ботов и пресекаем нецелевое использование.

Для любителей разоблачений и теорий заговора: основной целью сервиса является улучшение качества распознавания в конкретных доменах с использованием данных пользователей. По этой причине просим всех пользователей прочитать оферту и убедиться, что все посылаемые данные не содержат чувствительной или запрещенной информации. Мы не будем публиковать или делиться этими данными с третьими сторонами, но, естественно, подходите к своим и чужим данным ответственно и используйте сервис на свой страх и риск.

0
87 комментариев
Написать комментарий...
Angel Vivaldi

Незрелость автора и его неумение принимать критику летя с шашкой на гало с минусами смешит. Уважаемый разработчик, с таким подходом вы никогда не сделаете нормальный сервис, потому что сервис это в первую очередь общение с клиентами и принятие критики, одному не нравится тут, другому в ином месте (:

Ответить
Развернуть ветку
Роман Рабочий

Ну он по крайней мере что то делает, и его продукт довольно серьезная штука.
Написать статью здесь и работать с комментариями, это не просто.
Пробовали?
С первого раза все круто получилось?

Ответить
Развернуть ветку
Alexander Veysov
Автор

Я совсем недавно стал пробовать Пикабу и VC как альтернативные площадки для популяризации нашей работы и мягко говоря удивился уровню токсичности. Но так сказать средней, а не медианной (это очень важно).

Если на Хабре, несмотря на его известную токсичность, профессиональные тролли сразу попадают в пермабан (например за мат), то тут я уже видел пару таких персонажей. Сотни - тысячи комментов, все на статьях абсолютно разной тематики, все кого-то пытаются унизить, иногда опускаясь до оскорблений в духе ad hominem и прямого мата. И при этом положительная карма (!).

Понятно, что это некий симбиоз ценностей "редакции", выраженный в том, как работает продукт и публики, которую он привлек. Больше хейта => больше трафика.

Я всегда старался не "читать советских газет", но следующие факты меня повергли в шок при беглом просмотре популярных статей:

- За мат, прямые и непрямые оскорбления юзеры и переход на личности не получают инстант бан (тот же Хабр бессмысленно жесток, но там есть подобие неких неписанных правил, и только в определенных хабах они совсем неадекватные);

- Модерация сайта отсутствует или не работает (или спит). Ну или как вариант не справляется или такое в порядке вещей;

- Сайт способствует хейту показывая кто на что поставил какие оценки в реальном времени;

- Даже под этой статьей появился персонаж с интересной историей - тонна залайканных хейтерских комментов и тонна слитых. В целом карма очень позитивная. Юмор состоит в том, что в ответ на то, что я поставил дислайки его самым неадекватным комментариям, он стал минусовать вообще все мои комментарии на сайте и параллельно выставлять себя жертвой;

Откровенно говоря, я думал, что Хабр токсичен, но сейчас я понимаю, что это цветочки.

Ответить
Развернуть ветку
Александр Трофимов

Токсичный тут ты. Ты первым перешёл на личности, сказав, что пользоваться вк - себя не уважать. А потом ещё и не аргументировал свою точку зрения, когда я спросил че за фигня. Ты просто убежал плакать.
Реально жаль, что ты не получил инстант бан за это оскорбление. Ещё и лицемеришь тут, мол ты один д'артаньян.
И даже не пробуй о своей бесполезной, неудобной и заранее устаревшей приложухе говорить в реале. А то получишь аргументированный контраргумент, начнёшь оскорблять, а тебе по роже надают (и правильно сделают)...

Ответить
Развернуть ветку
84 комментария
Раскрывать всегда