Расшифровка встреч теперь спрашивает, какой моделью работать, и перестала загружать тишину между фразами.
Сначала про тишину — это чистая выгода и решать ничего не нужно. Запись уходила на расшифровку вместе с паузами: на измеренной встрече это 36 % всего отправленного. Теперь пауз в загрузке нет. Два следствия. Расшифровка быстрее. И модель, которой скармливают тишину, склонна выдумывать текст, чтобы её заполнить, — вместе с паузами исчез целый класс выдуманных строк. У нас это были шаблоны русских ютуб-субтитров: «Продолжение следует…», приписанное человеку, который этого не говорил.
Теперь выбор. Две модели, во вкладке «Записи», пункт «Модель расшифровки»:
- Стандартная — дешевле, изредка выдумывает строку.
- Точная — дороже, заметно меньше ошибок.
Что «меньше ошибок» дало на тестовой записи: она не выдумала ничего, правильно написала технические термины и дала каждой реплике свою отметку времени там, где дешёвая складывала шесть предложений под одну.
Стандартная доступна всем и остаётся выбором по умолчанию. Точная требует платного плана.
И ещё одно: русская речь, пересыпанная английскими терминами, теперь выходит лучше в обеих моделях — «фитчерс флэкс» записывается как «feature flags», а не так, как это услышал распознаватель.