LLM API и интеграция
Протокол совещания нейросетью из расшифровки
Час совещания в расшифровке — это примерно 9 000 слов, то есть около 23 000 входных токенов. Три разных документа из одной расшифровки — протокол, список решений с ответственными и короткая сводка для тех, кто не был, — обходятся примерно в 51 000 токенов за встречу; на недорогих позициях каталога это копейки, на верхних — единицы рублей. Сразу главная оговорка, без которой дальше читать бессмысленно: распознавания речи у нас нет. Аудиофайл отправлять некуда. Эта статья про вторую половину задачи — что делать с уже готовой текстовой расшифровкой и почему без разметки говорящих модель уверенно припишет чужую реплику не тому человеку.
Ниже: чем три документа из одной расшифровки отличаются друг от друга, как формулировать запрос на каждый, где именно ломается атрибуция реплик, полный расчёт часовой встречи в токенах и в рублях, что уходит наружу вместе со стенограммой и с чего начинать, если протоколы у вас пишет живой человек и делает это уже давно.
Что должно быть на входе
Граница проходит здесь, и лучше её обозначить до всего остального. В нашем каталоге есть текст, изображения и переранжирование. Распознавания речи нет, синтеза речи нет, видео нет. Файл с записью встречи отправить некуда — не потому что дорого, а потому что такой позиции в каталоге не существует.
Значит, расшифровку вы получаете своим способом: встроенной стенограммой в системе видеосвязи, отдельным сервисом транскрибации, помощником, который набирает текст руками. Модель включается там, где текст уже есть.
Это не формальность. Качество протокола определяется расшифровкой сильнее, чем выбором модели. Стенограмма, где половина терминов распознана на слух неверно, даёт протокол с теми же ошибками — модель не знает, что «Эс-Ди-Эр» должно было быть названием вашего внутреннего сервиса, и перепишет как услышала система. Прежде чем сравнивать модели, посмотрите на сырой текст: если в нём неузнаваемы фамилии и продукты, работать надо с транскрибацией, а не с промптом.
Три документа, а не один
Из одной расшифровки обычно нужны три разные вещи, и их постоянно пытаются получить одним запросом.
Протокол. Полная запись обсуждения по темам: что обсуждали, какие позиции звучали, чем закончилось. Адресат — участники и архив. Длина сопоставима с одной-двумя страницами.
Решения и поручения. Короткий структурированный список: формулировка, ответственный, срок. Адресат — тот, кто будет спрашивать о выполнении. Здесь цена ошибки самая высокая: неверный ответственный в списке поручений хуже, чем корявая фраза в протоколе.
Сводка для отсутствовавших. Пять-семь предложений о том, что изменилось и что теперь требуется от читателя. Адресат — человек, который на встрече не был и читать протокол не станет.
У этих трёх документов разные жанры, разная допустимая длина и разная цена ошибки. Просить их одним запросом можно, и мы ниже посчитаем, насколько это дешевле, — но качество списка поручений в такой схеме падает заметно.
Из расшифровки в протокол
Рабочий порядок — два прохода вместо одного.
Сначала разбивка по темам. Попросите список обсуждённых тем с указанием, где каждая начинается и заканчивается, — по маркерам в тексте, а не по таймкодам. На выходе получится пять-восемь блоков. Этот список стоит просмотреть глазами: он занимает полминуты и сразу показывает, поняла ли модель структуру встречи.
Потом протокол по каждой теме отдельно. По блоку за запрос: суть вопроса, прозвучавшие позиции, итог. Так точнее, чем одним проходом по всей стенограмме, — на длинном входе модель начинает пересказывать начало подробно, а конец конспективно. Про то, сколько контекста действительно помогает, а сколько мешает, — отдельный разбор.
Что стоит запретить в промпте прямо: оценки («продуктивная дискуссия»), выводы, которых не было, и сглаживание разногласий. Протокол, где спор превратился в «стороны обсудили вопрос», бесполезен — именно разногласие обычно и есть содержание встречи.
Полезное требование — якорь. Для каждого пункта протокола просите короткую дословную цитату из расшифровки. Это и проверяемость, и дисциплина: с требованием цитаты модель реже сочиняет.
Решения и поручения отдельным проходом
Это тот случай, когда свободный текст противопоказан. Нужен строгий формат с фиксированными полями: формулировка поручения, ответственный, срок, цитата-основание.
Ключевой приём — явное значение «не назван». Если на встрече срок не прозвучал, в поле срока должно стоять «не назван», а не пустота и не догадка. Пустое обязательное поле провоцирует модель его заполнить: механика этого разобрана в материале про строгий формат ответа.
Вторая половина приёма — правило источника. Ответственным может быть назван только тот, кто либо сам взял задачу вслух, либо был назван вслух другим участником. «По смыслу это задача маркетинга» — не основание. Без такого правила модель достраивает распределение ролей по правдоподобию, и получается аккуратный список, в котором часть строк придумана.
Третья — короткий проход валидации своим кодом: все ли ответственные есть в списке участников встречи, встречается ли цитата-основание в расшифровке дословно. Это десяток строк, и он ловит целый класс ошибок до того, как список уйдёт людям.
Сводка для тех, кто не был
Отдельный жанр, и просить его надо иначе. Не «сократи протокол» — иначе выйдет тот же протокол, только с пропусками.
Формулировка, которая работает: что изменилось после этой встречи по сравнению с тем, как было до неё, и что теперь требуется от читателя. Ограничение по длине жёсткое — не больше двухсот слов. Общие приёмы сжатия текста и типичные потери при этом разобраны в статье про пересказ.
Сводку удобно собирать не из расшифровки, а из уже готового протокола и списка решений: вход в несколько раз короче, а риск нового домысливания ниже, потому что исходник уже проверен человеком.
Кто что сказал — слабое место
Здесь честно и без смягчений: если в расшифровке нет разметки говорящих, модель путает, кто что сказал.
Речь не о редком сбое. В сплошном тексте без обозначения реплик информации о говорящих физически нет, и модель распределяет фразы по правдоподобию: возражение отдаёт тому, кто выглядит скептиком, обязательство — тому, кто чаще упоминается. Выглядит это убедительно, признаков неуверенности в ответе нет. Механизм тот же, что и в обычных выдумках модели: правдоподобное заполняет пробел там, где данных не было.
Практическое следствие простое. Если разметки нет, протокол по темам сделать можно, а именной список поручений — нельзя. Не «можно с оговоркой», а нельзя: проверить его будет не с чем, а выглядеть он будет как готовый документ.
Что делать с разметкой говорящих
Три варианта по убыванию удобства.
Диаризация от системы. Большинство систем видеосвязи помечают реплики по участникам конференции. Если пометки есть в исходном тексте — не удаляйте их при подготовке, даже если они выглядят мусором. Это самое ценное, что есть в файле.
Роли вместо имён. Когда система различает говорящих, но не знает, кто есть кто, пометьте блоки один раз руками: «Говорящий 1 — руководитель проекта». Дальше модель работает с ролями, а сопоставление сделали вы.
Имён нет совсем. Тогда работайте с тем, что есть: темы, аргументы, итоги. Поручения в такой схеме выписываются безлично — «решено подготовить смету к пятнице», — а ответственных расставляет человек, который на встрече был.
И общее правило для всех трёх: ответственный в итоговом документе должен быть проверяем по цитате. Если цитаты нет, строка идёт на ручную проверку.
Сколько стоит час совещания
Считаем в объёмах, а не в готовых рублях: ставка у нас одна на вход и на выход, поэтому цена получается умножением ставки на объём в миллионах токенов.
Час разговора в расшифровке — около 9 000 слов. Для русского текста это примерно 23 000 токенов; ориентиры пересчёта и типичные промахи — в разборе как считать токены.
| Что считаем | Вход, токенов | Выход, токенов | Всего | Цена, ₽ |
|---|---|---|---|---|
| Протокол по темам | 23 000 | 1 500 | 24 500 | ставка × 0,0245 |
| Решения и поручения | 23 000 | 600 | 23 600 | ставка × 0,0236 |
| Сводка для отсутствовавших | 2 500 | 300 | 2 800 | ставка × 0,0028 |
| Итого за одну встречу | 48 500 | 2 400 | 50 900 | ставка × 0,0509 |
Сводка дешевле остальных строк потому, что собирается из готового протокола, а не из расшифровки. Если делать все три документа от исходного текста, объём вырастает примерно до 71 500 токенов за встречу — разница в трети счёта.
Ставки за миллион токенов на 12 сентября 2026 года у нескольких подходящих позиций:
| Позиция | Ставка, ₽ за 1 млн |
|---|---|
gpt-oss-20b | 0 |
deepseek-v4-flash | 1 |
qwen-3-6-flash | 3 |
gemini-3-flash | 6 |
sonnet-5 | 30 |
Порядок величин получается такой: одна встреча на нижних строках списка — доли копейки, на верхней — единицы рублей. Команда с четырьмя часовыми встречами в неделю расходует около миллиона токенов в месяц. Перевод объёмов в деньги для других ставок — в материале про цену миллиона токенов в рублях.
Пять текстовых позиций каталога тарифицируются по нулевой ставке и открываются после первого платного пополнения — что именно там доступно. Для протокола по темам этого обычно достаточно; на списке поручений разница между позициями заметнее, потому что там важна дисциплина формата.
Что уходит наружу
Расшифровка внутреннего совещания — это, как правило, самый откровенный текст в компании. Цифры, фамилии, оценки людей и подрядчиков, планы, которые ещё не объявлены.
Решите заранее, какие встречи обрабатываются. Не «все», а перечень: планёрки по проектам — да, разговоры о людях и деньгах — нет.
Вычищайте лишнее до отправки, а не после. Убрать из стенограммы пятиминутный разговор о зарплатах дешевле, чем потом объяснять, зачем он уехал наружу.
Прочитайте, что хранится из запросов, до первой загрузки. У нас это llms.txt; общая картина по обработке данных — в отдельной статье.
Отдельно про рассылку готового протокола: автоматическая отправка итогового документа участникам без промежуточного просмотра — плохая идея ровно из-за атрибуции. Механика почтовых сценариев разобрана в материале про нейросеть для почты, но конкретно здесь человек в цепочке нужен.
Как запускать на своей команде
Пять шагов, каждый занимает меньше дня.
- Возьмите одну серию регулярных встреч — еженедельную планёрку, а не разовое стратегическое совещание. Однотипность здесь важнее значимости.
- Найдите пять расшифровок, по которым уже есть протокол, написанный человеком. Это готовая выборка для сравнения.
- Прогоните протокол и список поручений, сверьте с человеческим вариантом. Считайте отдельно две вещи: что модель пропустила и что придумала.
- Проверьте атрибуцию вручную по всем пяти. Если разметки говорящих не было, доля неверных ответственных покажет, насколько она вам нужна.
- Решите, где остаётся человек. Обычно это финальный просмотр списка поручений перед рассылкой — минута против получаса на ручное составление.
Третий шаг важнее остальных: пропуск и выдумка — разные дефекты с разной ценой, и общая «точность» их смешивает.
Чего мы не утверждаем
У нас нет распознавания речи. Ни сейчас, ни в виде обещания. Аудио в текст переводите своим средством.
Мы не сравнивали модели на задаче протоколирования. Своих замеров по этому сценарию мы не делали, и рекомендацию конкретной позиции дать не можем — сравнивайте на своих расшифровках по описанной методике.
Проверки выше снижают долю ошибок в атрибуции, но не обнуляют её. Требование цитаты и правило источника ловят большую часть, не всё.
Что нужно, чтобы попробовать
Ключ заводится за минуту на keydealer.ru/login — почта и пароль, без документов и без зарубежной карты. Оплата российской картой в рублях, один ключ на весь каталог: на 12 сентября 2026 года это 53 позиции в шестнадцати семействах.
Платные текстовые модели доступны сразу на приветственном бонусе. Пять расшифровок прогнать и сравнить с человеческими протоколами можно без пополнения: объём в задаче маленький, а вывод по качеству получается уже на этой выборке. Отдельный ключ под сценарий даст видимый расход по строке бюджета.
Что держать в голове
Распознавания речи у нас нет — модель начинает работать с готового текста. Это делит задачу пополам, и первая половина решается не здесь.
Главное ограничение второй половины — атрибуция. Без разметки говорящих модель не знает, кто что сказал, и восполняет пробел правдоподобной догадкой, не сообщая об этом. Отсюда рабочее правило: темы и итоги — можно, именные поручения без цитаты-основания — нет.
Начинать стоит с одной серии однотипных встреч и с пяти расшифровок, по которым уже есть человеческий протокол. Выборка маленькая, стоит копейки, а ответ на вопрос «работает или нет» даёт сразу — и переносится на остальные встречи без переделки промптов.
Как мы проверяем факты и что храним из запросов — на странице о проекте и в llms.txt. Попробовать на своих расшифровках: keydealer.ru/login.
Частые вопросы
Может ли нейросеть сделать протокол совещания?
Из готовой текстовой расшифровки — да. Аудио она не слушает, распознавание речи в наш каталог не входит, расшифровку делает ваше средство конференц-связи или отдельный сервис.
Сколько токенов в расшифровке часовой встречи?
Час разговора — это примерно 9 000 слов русского текста, то есть порядка 23 000 входных токенов. Три документа выходят в 51 000 токенов, если сводка собирается из готового протокола, и в 71 500, если каждый делается от исходного текста.
Почему модель путает, кто что сказал?
Потому что в расшифровке без разметки говорящих этой информации просто нет. Модель распределяет реплики по правдоподобию и делает это уверенно, без признаков сомнения.
Как получить список поручений с ответственными?
Отдельным проходом со строгим форматом, где у каждого поручения есть поле ответственного и явное значение «не назван». Пустое поле модель склонна заполнить догадкой.
Стоит ли делать протокол и сводку одним запросом?
Дешевле одним, точнее — разными. Один проход экономит две трети входных токенов, но смешивает жанры и роняет качество списка поручений.
Что уходит наружу вместе с расшифровкой?
Полный текст внутреннего разговора с именами и цифрами. Решение, какие встречи вообще обрабатываются, принимается до первой загрузки, а не после.