Перетащите запись встречи или лекции – или нажмите, чтобы выбратьMP3 · WAV · M4A · OGG · MP4 · до 30 минут
Пример результата – так выглядит готовая расшифровка
01:10РусскийСпикеры: 3
00:00Спикер 1

Давайте по статусу релиза. Что осталось закрыть до пятницы?

00:06Спикер 2

По бэкенду готово, остаётся прогон тестов и миграция. Думаю, к четвергу закроем.

00:14Спикер 3

На фронте доделываю экран отчётов, к среде отдам на ревью. Дизайн уже согласован.

00:23Спикер 1

Хорошо. Тогда фиксируем: миграция – на тебе, отчёты – на тебе, ревью беру я.

00:31Спикер 2

Ещё нужно обновить документацию по API, иначе интеграторы не поймут новые поля.

00:40Спикер 1

Принято, добавляю задачу. Встречаемся в четверг, смотрим финальную сборку перед выкаткой.

AI-саммари

Планёрка команды: обсуждают релиз, договариваются о сроках по двум задачам и фиксируют ответственных.

Саммари и конспект из видео и аудио нейросетью

Загрузите запись лекции, встречи, подкаста или видео - нейросеть Palatine расшифрует её и сделает готовое саммари: краткое содержание, тезисы, протокол с решениями и список задач. Не просто текст, а результат, который можно сразу использовать.

  • Транскрибация + суммаризация
  • Точность 92,9%
  • Тезисы и action items
  • Тайм-коды и спикеры
  • AI-чат по записи
  • 152-ФЗ · данные в РФ
Живое демо: говорите – речь распознаётся в текст, основу для саммари
Нажмите поле, разрешите микрофон и говорите по-русски – текст появится здесь в реальном времени
живое демо · потоковая транскрибация в реальном времени

Загрузите запись - нейросеть Palatine Speech сделает саммари и конспект из видео и аудио. На входе лекция, встреча, подкаст или видео. На выходе готовый результат поверх транскрипта: обработанный конспект, без голой расшифровки. Работаем мы именно с вашей загруженной записью - звук берём из вашего файла, не из готового текста или презентации. Внутри две модели в одной цепочке: ASR распознаёт речь, дальше модель суммаризации сворачивает транскрипт в структурированный конспект.

Что выдаёт нейросеть: саммари, тезисы, протокол, задачи

Сервис выдаёт краткое содержание, тезисы, протокол с решениями и action items - готовый результат, который вы сразу пускаете в дело.

Краткое содержание и тезисы

Краткое содержание - это запись, ужатая до 3-5 предложений: о чём вообще шла речь на лекции или встрече, без воды. Тут же, рядом, ключевые тезисы - списком, разбитые на подзаголовки по темам. А под капотом всё это собирает модель суммаризации: она сворачивает транскрипт в структурированный конспект на чистом тексте, и часовая запись превращается в понятный видео конспект вместо стены слов.

Протокол с решениями и action items

Для встреч у сервиса есть протокол с решениями - видно, кто что предложил и что в итоге приняли. Спикеров по тайм-кодам размечает диаризация, поэтому протокол помнит, кто именно что сказал. Рядом лежат action items: список конкретных дел с исполнителями, готовый to-do прямо из разговора. И вот так резюме встречи становится рабочим документом, который вы рассылаете участникам.

AI-чат по записи

AI-чат по записи отвечает на вопросы по содержимому и даёт ссылку на тайм-код в транскрипте. Спросите «что решили по бюджету?» или «перечисли возражения клиента» - ответ придёт с указанием места в записи, и пролистывать её целиком вам не нужно.

Как сделать конспект из видео или аудио

Чтобы сделать конспект, вам не нужно копировать текст между сервисами - всё происходит в одном окне.

Загрузка файла записи

Загрузите файл (MP4, MOV, MP3, WAV, M4A, OGG) - звук мы извлечём автоматически. Так вы получаете и пересказ видео, и краткое содержание видео с ютуба: загрузили запись, забрали тезисы. Это конспект из видео, собранный нейросетью без ручной расшифровки.

Три шага: запись → распознавание → саммари

Чтобы получить готовый конспект, пройдите три шага:

  1. Запись - загрузите файл лекции или встречи.
  2. Распознавание - ASR-движок расшифровывает речь и размечает спикеров по тайм-кодам.
  3. Саммари - модель сворачивает транскрипт в краткое содержание, тезисы, протокол и action items.

Транскрибация и суммаризация в одном сервисе

Цепочка объединяет транскрибацию и суммаризацию в одном сервисе: вы не переносите текст из одного инструмента в другой.

Две модели в одной цепочке

Сначала ASR-движок Palatine Speech распознаёт речь, затем модель суммаризации сворачивает транскрипт в конспект - это генератор конспектов на двух моделях. Из полуторачасовой лекции выходит конспект на одну страницу, и копировать между сервисами вам не приходится. Нужна только расшифровка? Тогда отдельно доступна транскрибация аудио или видео в текст.

Точность распознавания = качество саммари

Точность распознавания напрямую задаёт качество саммари. ASR-движок Palatine Speech распознаёт русскую речь с точностью WAcc 92,9% (WER 7,10%) по бенчмарку на семи датасетах - точнее Whisper-large-v3 с его 7,44%. На чистом транскрипте нейросеть строит конспект без ошибок распознавания, так что тезисы и решения не искажаются. Онлайн-суммаризаторы видео из выдачи берут готовые субтитры чужого ролика, а мы распознаём именно ваш файл - со своей диаризацией и протоколом.

Комментарий CEO
Саммари у нас не пересказ «по мотивам», а выжимка поверх точной расшифровки: сначала ASR распознаёт вашу запись с точностью 92,9%, и только на чистом транскрипте собирается конспект. Поэтому каждый тезис и каждый action item привязаны к конкретному спикеру и тайм-коду – их можно проверить в записи, а не принимать на веру.
Валерий ГречинCEO Palatine Speech

Кому подходит: лекции, встречи, подкасты, интервью

Саммари из видео и аудио закрывает разные сценарии - от учёбы до деловых созвонов.

Студенты и преподаватели (конспект лекции)

Студенты получают конспект лекции нейросетью вместо ручной писанины. Загрузили запись пары на 1,5 часа - забрали конспект на одну страницу с тезисами и тайм-кодами. Готовый конспект экономит вам время: переслушивать всю запись не нужно.

Команды (протокол встречи)

Команды загружают созвон в Zoom или Telemost и получают протокол встречи со спикерами, решениями и action items. Это саммари встречи, которое вы сразу рассылаете участникам. Для звонков с решениями у нас есть отдельная страница - протоколы звонков.

Контент и журналисты

Контент-мейкеры загружают ролик и получают пересказ ютуб видео с тезисами для постов и описаний. Журналисты собирают саммари длинных интервью и пресс-конференций: главные цитаты и факты, без прослушивания записи целиком.

Форматы, языки и длинные записи

Сервис принимает видео и аудио, работает с записями на несколько часов.

Видео/аудио на входе, выгрузка DOCX/TXT/MD

Сервис принимает MP4, MOV, MP3, WAV, M4A, OGG - звук извлекаем автоматически. Транскрипт и саммари вы выгружаете в DOCX, TXT и Markdown, для видео есть субтитры SRT/VTT. Любой результат копируется в один клик.

~100 языков и записи на 1,5-3 часа

Суммаризация работает на ~100 языках, включая русский и языки СНГ. Язык записи мы определяем автоматически, и конспект формируется на языке записи. Лекцию или встречу на 1,5-3 часа сервис обрабатывает за минуты - скорость около ~1-2% длительности файла.

Безопасность: данные в России

Записи лекций и встреч мы обрабатываем в России - без передачи третьим лицам.

152-ФЗ и 4 ЦОД Tier III

Записи мы обрабатываем по 152-ФЗ в 4 ЦОД уровня Tier III в РФ. Передача идёт по TLS, а оплата проходит картами МИР и через СБП, без VPN.

Не обучаем модели на ваших записях

Мы не обучаем модели на ваших записях. Загруженные файлы идут только на то, чтобы сделать вам саммари и конспект, и третьим лицам мы их не отдаём. Короткую запись или войс быстрее расшифровать в Telegram-боте - а длинные лекции и встречи с саммари вы обрабатываете через аплоадер на странице.

Саммари, конспект и резюме встречи: в чём разница

Саммари путают с конспектом, конспект с протоколом, а резюме встречи со стенограммой, хотя из одной и той же записи выходят четыре разных документа. Саммари это самый короткий из них: сжатый пересказ в несколько предложений о том, о чём вообще была лекция или встреча, без цитат и деталей. Его читают за полминуты, чтобы решить, нужно ли вообще разбираться с записью дальше или тема мимо.

Конспект от саммари отличается структурой. Он держит тезисы, подзаголовки по темам и тайм-коды, по которым легко вернуться к нужной минуте. Протокол встречи, он же резюме встречи, устроен строже и фиксирует, кто что предложил, какие решения приняли и какие задачи повесили на конкретных спикеров. Дословная стенограмма не сжимает ничего и передаёт речь слово в слово, так что из полуторачасового звонка набегает несколько десятков страниц. Palatine собирает из одной загруженной записи и краткое содержание, и тезисы, и протокол с решениями, и список action items; про то, чем протокол отличается от дословной стенограммы, есть отдельный разбор.

ФорматЧто на выходеКогда брать
Саммаринесколько предложений о сути записи, без деталейнужно за полминуты понять, стоит ли слушать целиком
Конспекттезисы и подзаголовки по темам с тайм-кодамиготовишься к экзамену или пересматриваешь запись по кускам
Протокол встречи (резюме встречи)решения, поручения и задачи с привязкой к спикерампосле созвона надо раздать, кто за что отвечает
Стенограммаречь слово в слово, десятки страниц с полутора часовважна каждая формулировка: суд, интервью, экспертиза

Как сделать конспект видео из YouTube, VK или Rutube

Конспект видео с ютуба, из VK или Rutube собирается в два действия, потому что ссылку на чужой ролик сервис на вход не берёт. Приём идёт только файлом или напрямую с микрофона, поля «вставьте ссылку» для YouTube, VK, Rutube или Яндекса тут нет. Порядок простой: сначала скачиваете ролик из плеера площадки, затем загружаете получившийся файл в аплоадер, и уже по нему нейросеть распознаёт речь и собирает конспект с тезисами и тайм-кодами.

Распознаётся именно ваша загруженная запись со своей диаризацией по спикерам, а не субтитры, которые площадка прикрутила к ролику: их мы не забираем и на них не опираемся. Звук из видео извлекается автоматически, отдельно вытаскивать аудиодорожку не нужно, на вход идут MP4, MOV, MP3, WAV, M4A и OGG. Пересказ ролика с рутуба или ютуба получается тем же путём, что и конспект записи собственного вебинара, разницы в обработке между чужим и своим файлом нет.

Конспект по файлу и что реально бесплатно

Конспект по файлу означает ровно то, что написано: выжимка строится по загруженной записи, а не по вставленной ссылке или набранному тексту. Файл это точный вход сервиса, будь то запись пары на 1,5 часа, экспортированный созвон или аудиозапись подкаста в текст из mp3. Полуторачасовая лекция после загрузки сворачивается в конспект на одну страницу с тезисами и тайм-кодами за считанные минуты, потому что распознавание идёт со скоростью около 1–2% от длительности записи.

Бесплатно и быстро расшифровать короткую запись можно в Telegram-боте @VoicePalatineBot: он берёт до 100 расшифровок в день и нормально справляется с войсами и короткими роликами. Длинные лекции и часовые встречи бот целиком не суммирует, для них сделан веб-сервис с аплоадером, где для теста выдают минуты по запросу, без обещаний безлимитного бесплатного пакета. Дальше работает pay-as-you-go от 0,29 ₽/мин, оплаченный баланс не сгорает и не привязан к календарному месяцу.

Чем конспект из записи отличается от конспекта текста в ChatGPT

Конспект текста в ChatGPT и других текстовых конспектерах начинается с того, что текст уже набран: на вход такие сервисы принимают готовые символы, а не аудио- или видеозапись. Чтобы получить в них выжимку часового созвона, запись сперва нужно где-то расшифровать в текст, а потом вставить его в окно, и это отдельный шаг с отдельным инструментом. Гпт-конспект по статье или переписке они соберут, а вот саму дорожку с речью не услышат.

Palatine принимает саму запись и делает оба шага в одной цепочке из двух моделей: сначала распознавание речи, потом суммаризация распознанного. Качество выжимки здесь упирается в качество распознавания, а оно держится на WAcc 92,9% (WER 7,10%), поэтому ошибки расшифровки не перетекают в тезисы и решения. Произвольный набранный текст на вход мы при этом не берём, инструмент заточен под запись, а не под замену текстового редактора.

Что нейросеть вытаскивает из речи в видео

Анализ видео нейросетью здесь означает разбор того, что в видео сказано, а не того, что в кадре показано. Сервис работает с речевой дорожкой и превращает произнесённое в структуру: краткое содержание, тезисы по темам, протокол с решениями и список action items. Описание видео нейросетью строится по словам спикеров, а диаризация размечает их по тайм-кодам, чтобы в разборе было видно, кто именно что сказал.

Визуальный ряд остаётся за границей: распознавания объектов и сцен в кадре, текста со слайдов и эмоций по лицам сервис не делает. Если весь смысл ролика в том, что показано без слов, например немой график или таблица на экране без комментария диктора, разобрать его по речи не выйдет, потому что разбирать нечего. Там, где спикер проговаривает содержание вслух, из полуторачасовой записи собирается конспект на страницу с тезисами и тайм-кодами.

Что нейросеть выдаёт из записи: саммари, тезисы, задачи

Не сырой транскрипт, а готовый результат поверх него – краткое содержание, тезисы, протокол с решениями, action items и AI-чат по содержимому.

Краткое содержание

Пересказ записи в 3-5 предложений: о чём была лекция или встреча, без воды.

Тезисы и структура

Главные мысли списком, с подзаголовками по темам и тайм-кодами, чтобы вернуться к нужному месту записи.

Протокол с решениями

Кто что предложил и какие решения приняты; для встреч – деловой протокол со спикерами.

Action items (задачи)

Список конкретных дел с исполнителями: готовый to-do прямо из разговора.

AI-чат по записи

Задайте вопрос содержимому и получите ответ со ссылкой на тайм-код в транскрипте.

Форматы вывода

Саммари, тезисы, протокол и задачи копируются в один клик или выгружаются в DOCX, TXT и Markdown.

Саммари нейросетью против ручного конспекта и зарубежных сервисов

Palatine SpeechРучной конспектЗарубежные сервисы
Краткое содержание и тезисыавто из транскриптавручнуюда
Протокол с решениями и action itemsвручнуючастично
Привязка к спикерам и тайм-кодамвручнуючастично
AI-чат по содержимому записинетчастично
Точность распознавания (русский)92,9% (WER 7,10%)-ниже на русском
Записи 1,5-3 часа целикомтрудоёмколимиты/подписка
Данные в РФ / 152-ФЗда, 4 ЦОД Tier IIIданет
Стоимость часа записи17,4 ₽1-2 ч ручной работыв валюте
Оплата из РФ без VPNМИР/СБП-требует карты/VPN

Краткое содержание и тезисы

Palatine Speech
авто из транскрипта
Ручной конспект
вручную
Зарубежные сервисы
да

Протокол с решениями и action items

Palatine Speech
Ручной конспект
вручную
Зарубежные сервисы
частично

Привязка к спикерам и тайм-кодам

Palatine Speech
Ручной конспект
вручную
Зарубежные сервисы
частично

AI-чат по содержимому записи

Palatine Speech
Ручной конспект
нет
Зарубежные сервисы
частично

Точность распознавания (русский)

Palatine Speech
92,9% (WER 7,10%)
Ручной конспект
-
Зарубежные сервисы
ниже на русском

Записи 1,5-3 часа целиком

Palatine Speech
Ручной конспект
трудоёмко
Зарубежные сервисы
лимиты/подписка

Данные в РФ / 152-ФЗ

Palatine Speech
да, 4 ЦОД Tier III
Ручной конспект
да
Зарубежные сервисы
нет

Стоимость часа записи

Palatine Speech
17,4 ₽
Ручной конспект
1-2 ч ручной работы
Зарубежные сервисы
в валюте

Оплата из РФ без VPN

Palatine Speech
МИР/СБП
Ручной конспект
-
Зарубежные сервисы
требует карты/VPN

Ответы на вопросы

Чем саммари отличается от обычной расшифровки?

Расшифровка – это полный текст записи слово в слово. Саммари – готовый результат поверх него: краткое содержание, тезисы, протокол с решениями и список задач. Palatine делает и то, и другое в одном сервисе.

Как сделать конспект лекции из видео или аудио?

Загрузите файл лекции, нейросеть распознает речь и соберёт конспект с тезисами и тайм-кодами. Полуторачасовая лекция превращается в конспект на одну страницу за минуты.

Делает ли нейросеть протокол встречи с решениями?

Да. Для совещаний формируется протокол со спикерами, принятыми решениями и action items – кто что предложил и что решили. Удобно рассылать участникам после созвона.

Что такое AI-чат по записи?

Это функция, в которой вы задаёте вопросы содержимому записи («что решили по срокам?», «перечисли возражения») и получаете ответ со ссылкой на тайм-код в транскрипте.

Какие форматы видео и аудио поддерживаются?

MP4, MOV, MP3, WAV, M4A, OGG – звук извлекается автоматически. Транскрипт и саммари выгружаются в DOCX, TXT и Markdown, для видео есть субтитры SRT/VTT.

Насколько точны конспект и тезисы?

Качество саммари зависит от распознавания: точность на русском – 92,9% (WER 7,10%). Нейросеть строит конспект на чистом транскрипте, поэтому ошибки распознавания не попадают в тезисы и решения.

Сколько стоит саммари из записи и есть ли бесплатно?

Новым пользователям 1000 минут выделяем по запросу. Дальше – от 0,29 ₽ за минуту по pay-as-you-go: транскрибация и суммаризация в одном процессе, баланс не сгорает.

Можно ли сделать конспект из видео с YouTube или по ссылке?

Скачайте ролик с YouTube и загрузите файл – сервис извлечёт звук, распознает речь и сделает пересказ с тезисами и тайм-кодами. Напрямую по ссылке мы пока не забираем видео, поэтому сначала сохраните его себе.

На каких языках работает суммаризация?

Поддерживается ~100 языков, включая русский и языки СНГ; язык записи определяется автоматически, конспект формируется на языке записи.

Безопасно ли загружать записи лекций и встреч?

Данные обрабатываются в РФ по 152-ФЗ в 4 ЦОД Tier III, передаются по TLS, на них не обучаются модели. Записи не передаются третьим лицам.

Чем саммари отличается от конспекта, протокола и стенограммы?

Саммари это сжатый пересказ записи в несколько предложений. Конспект добавляет структуру: тезисы и подзаголовки по темам с тайм-кодами. Протокол встречи, он же резюме встречи, фиксирует решения и задачи со спикерами, а дословная стенограмма передаёт речь слово в слово без сжатия. Palatine собирает всё это из одной загруженной записи.

Как сделать конспект видео из VK или Rutube?

Сервис принимает файл или запись с микрофона, приёма по ссылке нет. Скачайте ролик из VK или Rutube и загрузите файл в аплоадер, дальше нейросеть распознает речь и соберёт конспект с тезисами и тайм-кодами. Так же обрабатываются видео с YouTube и Яндекса.

Можно ли сделать конспект по презентации?

Если это запись выступления или вебинара с презентацией, то да: мы распознаём речь докладчика и собираем из неё конспект. Сам файл презентации в PPTX или отдельные слайды сервис не читает, текст со слайдов не извлекается, работаем только с озвученной речью.

Чем сервис отличается от ChatGPT для конспектов?

ChatGPT и другие текстовые конспектеры берут на вход уже набранный текст. Чтобы получить в них конспект аудио или видео, запись сначала надо где-то расшифровать вручную. Palatine принимает саму запись и делает оба шага, распознавание речи и саммари, в одной цепочке.

Какая нейросеть лучше для студентов?

Для учёбы удобнее сервис, который берёт запись пары целиком и отдаёт готовый конспект с тезисами и тайм-кодами, а не только пересказ короткого текста. Полуторачасовая лекция сворачивается в конспект на одну страницу за минуты, так реально [разобрать целый курс лекций](/transkribatsiya-lektsiy-i-konspekt/) за сессию.

Есть ли способ сделать конспект бесплатно?

Быстро и бесплатно расшифровать короткую запись можно в Telegram-боте @VoicePalatineBot: до 100 расшифровок в день. Суммаризацию длинных лекций и встреч собирает веб-сервис через аплоадер, где для теста доступны минуты по запросу, дальше pay-as-you-go от 0,29 ₽/мин. Условия собраны на странице про то, [сколько можно расшифровать бесплатно](/transkribatsiya-besplatno/).