Блог KeyDealer
Пишем про LLM API, цены моделей в рублях, агентов, релизы и то, что происходит в мире ИИ. Каждая цифра подтверждена первоисточником, ссылка — в статье.
LLM API и интеграция
Что такое контекстное окно и что в него входит
Окно — это не поле ввода. В него разом укладываются системный промпт, вся история диалога, вложенный файл, описания инструментов и место под ответ.
Релизы и изменения моделей
Grok 4.7 в каталоге: Responses проверен, а не открыт
Каталог вырос до 57 позиций. У новой позиции редкий набор: протокол Responses подтверждён пробой, работа с изображениями тоже. Что это меняет.
LLM API и интеграция
Как объяснить клиенту, что отвечал бот
Где раскрытие обязательно по смыслу, как сказать про бота без извинений, что отвечать на вопрос «ты человек?» и как передать диалог человеку без пересказа.
LLM API и интеграция
Как понять, что задача не для нейросети
Пять признаков задачи, которую не стоит отдавать модели, и разбор задач, которые выглядят подходящими: точный подсчёт, сортировка по числам, сверка сумм.
LLM API и интеграция
Как разбить документ на части для нейросети
Три способа деления — по структуре, по смыслу и по фиксированному размеру с перекрытием. Что ломается на границах и как проверить, что ответы не испортились.
ИИ-агенты и автоматизация
Спор про MCP: за что ругают протокол и что считать
Публикация против MCP собрала три сотни комментариев. Разбираем обе стороны и показываем, как посчитать, во сколько протокол обходится вам.
LLM API и интеграция
Нейросеть для детского центра: разговор с родителем
Вопросы до записи, напоминания об оплате, тексты для родительских чатов и обратная связь по заметкам педагога. О конкретном ребёнке модель не пишет.
LLM API и интеграция
Нейросеть для таксопарка: водители и обращения
Разбор жалоб пассажиров на поля, черновики ответов, памятки водителям и разметка причин оттока. Тариф, назначение заказа и штрафы остаются за парком.
LLM API и интеграция
Нейросеть для управляющей компании: заявки жильцов
Разбор заявок на адрес и тип проблемы, маршрутизация по службам, черновики ответов и объявления в подъезд. Сроки по нормативу и перерасчёт модель не называет.
LLM API и интеграция
Почему модель тупеет на больших документах
На коротком тексте ответы точные, на длинном — поверхностные. Разбираем наблюдаемые эффекты и даём способ проверить их на своих данных за один вечер.
LLM API и интеграция
Сколько стоит поддержка бота в год после запуска
Запуск — это первый счёт, а не единственный. Разбираем шесть статей расхода, которые появляются после внедрения, и что из них растёт само.
LLM API и интеграция
Сколько времени живёт промпт и когда его менять
Промпт устаревает не от времени, а от пяти изменений вокруг него. Признаки, что пора пересобирать, дисциплина версий и почему не правят на живом трафике.
Релизы и изменения моделей
Гарантия обработки в США у xAI стоит +10% к цене
21 сентября xAI открыла US-endpoint с гарантией обработки в США и выпустила Grok 4.7. Что покрывает гарантия и почему токены дороже на 10%.
Мир ИИ
Яндекс открыл веса AliceAI-Foundation: 80B с нуля
21 сентября Яндекс выложил под Apache 2.0 модель на 80 млрд параметров, обученную без чужих весов. Что это даёт разработчику и чего не даёт.
Мир ИИ
Чат-бот выдумал груз: разбор по сообщению CNN
Аналитик разобрал манифест судна через чат-бота, модель назвала то, чего там не было. Что из этого следует для проверки документов у себя.
LLM API и интеграция
Codex CLI на своём endpoint: настройка за пять минут
Как подключить Codex CLI к OpenAI-совместимому шлюзу через config.toml. Разбираем поля, выбор протокола и три ошибки, на которых спотыкаются.
Релизы и изменения моделей
GPT-5.5 отключают 14 октября — но не в API
14 октября 2026 GPT-5.5 уходит из ChatGPT, Work и Codex. В OpenAI API модель остаётся. Кого заденет и что править заранее.
Релизы и изменения моделей
JetBrains смешала две Qwen: на 71 % меньше токенов
Слияние весов Qwen3.8 и Qwen3.6 в равных долях дало модель, которая решает больше задач и пишет втрое короче. И проверка, что экономия настоящая.
LLM API и интеграция
Как перевести пилот в промышленную эксплуатацию
Пилот и прод отличаются не моделью, а обвязкой: повторы, лимиты, отдельный ключ и бюджет, журнал, дежурство и откат. Что ломается на переходе.
LLM API и интеграция
Как принять работу подрядчика по внедрению ИИ
Что зафиксировать в договоре до начала, как проверять на своих данных, какие вопросы задавать про расход и по каким признакам видно обёртку.
LLM API и интеграция
Какие метрики отслеживать после запуска нейросети
Пять метрик, которые показывают, работает ли сценарий: передачи человеку, повторные обращения, расход на задачу, доля правок и время до ответа.
LLM API и интеграция
Нейросеть для автодилера: входящий поток и заявки
Разбор обращений с классифайдов на поля, ответы на типовые вопросы об условиях, черновики ответов на отзывы. Наличие, цену и trade-in модель не называет.
LLM API и интеграция
Нейросеть для франшизы: регламенты и отчёты точек
Управляющей компании: тиражирование регламентов на десятки точек, разбор отчётов франчайзи, ответы партнёрам, разметка нарушений. Санкции решает человек.
LLM API и интеграция
Нейросеть для оптовой торговли: заявки от розницы
Сопоставление чужих наименований со своими артикулами, разбор заявок из почты, черновики КП по прайсу. Остатки, цену клиента и срок отгрузки модель не назовёт.
Мир ИИ
Эксплойт за 72 часа: как Claude вскрыл форум OpenAI
Hacktron раскрыла цепочку: Opus 5 написал рабочий эксплойт к libheif за три часа, и трое исследователей дошли до внутренних репозиториев OpenAI.
Релизы и изменения моделей
DeepSeek V4 Pro в каталоге: 2 ₽ и без часов пик
Флагман DeepSeek приехал по фиксированной рублёвой ставке круглосуточно. Что проверено, что нет и чем это отличается от тарифа вендора по часам.
LLM API и интеграция
Как объяснить руководству, зачем нейросеть
Конструкция разговора: часы на конкретной операции вместо экономии на зарплате, показ на своих документах, цена пилота цифрой и цена отказа от него.
LLM API и интеграция
Как подготовить данные для нейросети
Четыре требования к входу: текст вместо скана, один факт в одном месте, актуальная редакция, данные отдельно от оформления. Что делать со сканами и таблицами.
LLM API и интеграция
Нейросеть для аптеки: что можно и что запрещено
Наличие и цены из учётной системы, режим работы, заказ и бронь, разбор сообщений, карточки товара. Подбор препарата и дозировку модель не делает совсем.
LLM API и интеграция
Нейросеть для НКО: гранты, отчёты и письма донорам
Заявки под требования фонда, отчёты по проектам, письма донорам, тексты о программах и перевод. Показатели и цифры формулирует организация, а не модель.
LLM API и интеграция
Нейросеть для отеля: ответы гостям на пяти языках
Вопросы гостя до брони и во время проживания на языке обращения, ответы на отзывы, разметка жалоб по сменам. Бронь подтверждает система отеля, не бот.
Мир ИИ
Astra for Law: вендор пошёл в отраслевые продукты
OpenAI собрала модель, юридический поисковый индекс и инструкции в отдельный продукт. Заявленная точность 54 % — и это лучший результат замера.
LLM API и интеграция
Сколько людей нужно для внедрения нейросети
Четыре роли, а не четыре должности: постановка задачи, обвязка, проверка качества, расход. На пилоте это обычно два человека на неполной занятости.
ИИ-агенты и автоматизация
Сводка сжатия контекста — это недоверенный ввод
OpenAI зафиксировала: модель дописала себе инструкции в сводку сжатия и продолжила работу. Как устроить обработку сводки у себя, чтобы это не сработало.
LLM API и интеграция
Что делать, если нейросеть ошиблась
Порядок действий, когда ошибку увидел клиент: остановить поток, оценить масштаб по журналу, ответить, найти причину, починить и проверить на выборке.
ИИ-агенты и автоматизация
HarnessTax: обвязка агента может стоить вдвое дороже
Беркли прогнал 21 пару «модель плюс обвязка». Успех почти не меняется, счёт отличается вдвое, а стартовый контекст — в десять раз.
LLM API и интеграция
Как внедрить нейросеть без разработчика
Что реально делается без кода: формула в таблице, конструктор сценариев, ручной прогон пачками. Где проходит потолок и какой минимум нужен после него.
LLM API и интеграция
Какие задачи отдать нейросети первыми
Критерий отбора первой задачи: результат проверяется за секунды, ошибка не доходит до клиента, объём измерим. И задачи, которые первыми быть не должны.
Релизы и изменения моделей
Каталог вырос до 55: приехали Gemini 2.5 Flash и Lite
Две позиции за сутки, обе по 8 ₽ за миллион. Зачем брать прошлое поколение по цене текущего и что у них проверено, а что нет.
LLM API и интеграция
Кто отвечает за ответ нейросети
Перед клиентом отвечает компания, которая поставила бота. Как распределить ответственность процессом, а не поиском виноватого, и что записать в регламент.
LLM API и интеграция
Нейросеть для аренды авто: документы и переписка
Черновики договоров и актов приёма-передачи, описания повреждений в структуру, переписка о продлении и возврате. Оценку ущерба и депозит модель не решает.
LLM API и интеграция
Нейросеть для типографии: приёмка заказа
Разбор заявки на поля, перевод требований в спецификацию, объяснение отказа препресса, черновики КП по прайсу. Пригодность макета к печати проверяет препресс.
LLM API и интеграция
Нейросеть для ветклиники: запись и напоминания
Запись, расписание, напоминания о вакцинации по графику из карточки животного, цены и подготовка по памяткам. Диагноз по описанию владельца модель не ставит.
Мир ИИ
OpenAI раскрыла шесть сбоев: агент обходит запрет
16 сентября OpenAI опубликовала регламент раскрытия и шесть отчётов: агенты искали чужие ключи, грузили файлы наружу и прятали ошибки.
Релизы и изменения моделей
Z.ai: инференс GLM на 100 тысячах своих ускорителей
Вендор GLM описал, как за две недели поднял продакшен-инференс на китайском железе и утроил пропускную способность. Главное в тексте — не железо.
Релизы и изменения моделей
Gemini 3.8 Flash: что делать, если вы на 3.6 или 3.7
Google выпустила 3.8 Flash как Stable, а 3.7 и 3.6 переименовала в previous-generation. Разбираем лестницу версий, что значат ярлыки и когда переезжать.
Релизы и изменения моделей
Gemini 3.8 Live: сколько стоит минута голосового агента
Google выпустила 3.8 Live и Live Extended Thinking 15 сентября. Минута живого разговора по прайсу Google — 1,94 ₽. В каталоге KeyDealer этих моделей нет.
LLM API и интеграция
Intelligence per Watt: 88,7 % запросов простые
Стэнфорд измерил, сколько запросов закрывают маленькие модели: 88,7 % одноходовых чатовых и рассуждающих. Что из этого следует для выбора позиции и счёта.
ИИ-агенты и автоматизация
Как ограничить темы чат-бота на сайте
Одной фразы в промпте мало. Список разрешённых тем, отдельная проверка вопроса до ответа, готовый перевод на человека и приёмочный набор посторонних вопросов.
LLM API и интеграция
Нейросеть для автошколы: что ей можно доверить
Ответы абитуриенту и курсанту, тренировочные вопросы по материалам школы. Требования ГИБДД модель по памяти не называет — только из загруженного документа.
LLM API и интеграция
Нейросеть для фитнес-клуба: удержание и отток
Продление абонементов, возврат переставших ходить, разметка причин оттока и вопросы до покупки. Программу тренировок и питания модель не составляет.
LLM API и интеграция
Нейросеть для медицинской клиники: где граница
Запись, расписание, подготовка к процедурам по памяткам, внутренние документы. Диагноз, анализы и симптомы модель не обсуждает — это запрет, а не осторожность.
LLM API и интеграция
Нейросеть для сельского хозяйства: бумаги, а не поле
Путевые листы, заявки на ГСМ, договоры с элеватором, ветеринарные документы и субсидии. Нормы внесения препаратов и дозировки модель не называет.
LLM API и интеграция
Нейросеть для страховой: сверка полиса и заявления
Разбор заявлений на выплату и построчная сверка требования клиента с правилами страхования со ссылкой на пункт. Решение по выплате модель не принимает.
Мир ИИ
Project Lily: люди читают переписки с ChatGPT
404 Media: OpenAI наняла сотни подрядчиков читать реальные диалоги пользователей. Что это значит для рабочих данных и как разделить контуры.
LLM API и интеграция
API или готовое решение: что выбрать
Честное сравнение по шести критериям: срок запуска, цена на масштабе, данные, зависимость от поставщика, гибкость и ответственность за результат.
LLM API и интеграция
Как обновлять промпты при смене модели
Промпт перестал работать после переезда — это норма. Что ломается первым, как проверить перенос выборкой за час и почему модель и промпт не меняют одновременно.
Мир ИИ
Кодекс Microsoft AI: что в нём для разработчика
Microsoft AI опубликовала кодекс поведения моделей MAI. Разбираем цепочку команд, запреты и правила вызова инструментов — и что из этого забрать себе.
LLM API и интеграция
Нейросеть для автосервиса: где она правда экономит
Разбор заявок в свободной форме, объяснение наряд-заказа, ответы на претензии и сведение прайсов поставщиков. Диагноз и подбор детали остаются за мастером.
LLM API и интеграция
Нейросеть для производства: где она реально работает
Что языковая модель делает на производстве: сменные отчёты, техдокументация, разбор рекламаций, переводы инструкций. И четыре задачи, где её применять нельзя.
LLM API и интеграция
Нейросеть для ресторана и кафе: где она работает
Описания блюд для меню и агрегаторов, ответы на отзывы, тексты акций и разбор обратной связи по сменам. Состав, аллергены и калорийность — только из техкарт.
LLM API и интеграция
Нейросеть для салона красоты: что можно и что нельзя
Вопросы до записи, ответы на отзывы, тексты к фото и напоминания. Подбор процедуры и всё, что касается кожи и здоровья, модель не делает — это работа мастера.
LLM API и интеграция
Нейросеть для турагентства: подборки и переписка
Подборки из своей базы, черновики программ поездок, ответы про документы со ссылкой на источник, переписка с клиентом. Визы и цены — только из источника.
LLM API и интеграция
Нейросеть для закупок: сравнение КП и спецификаций
Как языковая модель разбирает коммерческие предложения, сводит позиции в одну таблицу и сверяет спецификацию с техзаданием. И где ей доверять нельзя.
Мир ИИ
NVIDIA Inception: что даёт и кому откажут
Разбор NVIDIA Inception по первоисточнику: членство бесплатное и без доли в компании, но скидка на GPU — это возврат от поставщика, а не продажа.
LLM API и интеграция
Сколько примеров давать нейросети в промте
Один пример часто хуже нуля, после пяти прирост почти исчезает. Разбираем норму под классификацию, формат и стиль, цену примеров и когда их выносить в поиск.
LLM API и интеграция
Чек-лист перед внедрением модели
Восемь пунктов, которые проверяют до первого боевого запроса: идентификатор, протоколы, лимиты, запасная позиция, кэш, отлов ошибок, ключ и журнал.
LLM API и интеграция
Как посчитать окупаемость нейросети
Метод расчёта через стоимость одного полезного действия до и после, с таблицей себестоимости, честной строкой на проверку человеком и разбором рисков.
LLM API и интеграция
Как сократить расходы на API нейросети
Шесть приёмов по убыванию эффекта, таблица с ожидаемым снижением счёта по каждому, порядок внедрения и типичные ошибки, которые съедают экономию.
LLM API и интеграция
Коммерческая тайна и нейросети: что можно отправлять
Чем режим коммерческой тайны отличается от персональных данных, что происходит с текстом после отправки и какие сведения вырезать до запроса к модели.
LLM API и интеграция
Нейросеть для логистики: что она закрывает на складе
Разбор заявок и накладных в свободной форме, сведение отчётов перевозчиков, черновики претензий. Расчёт в рублях и почему маршруты считает не модель.
LLM API и интеграция
Нейросеть для онлайн-школы: что она правда закрывает
Проверка домашних, ответы ученикам, материалы и переупаковка курса. Расчёт на поток в тысячу учеников и список того, что доверять нельзя.
LLM API и интеграция
Нейросеть для строительной компании: что она закрывает
Разбор смет и спецификаций, поиск расхождений между версиями, письма подрядчикам и отчёты заказчику. Почему проектировщика и сметчика она не заменяет.
ИИ-агенты и автоматизация
Обвязка решает: NVIDIA срезала токены агента вдвое
SoL-Pi сохраняет 94% качества при 45–49% меньше токенов. Что это значит для счёта и почему одна и та же модель стоит по-разному.
ИИ-агенты и автоматизация
Почему ИИ-агент не работает
Семь типичных причин отказа агента, диагностика по шагам от журнала одного прогона и разбор рисков, которые превращают сбой в инцидент.
Релизы и изменения моделей
Qwen в каталоге KeyDealer: четыре модели по 3 ₽
12 сентября в каталоге появились четыре модели Qwen по 3 ₽ за миллион токенов. Разбираем контекст, проверенные возможности и что уже работает.
Релизы и изменения моделей
Sakana Fugu Max и Ultra v2: оркестрация вместо модели
Sakana выпустила две модели, которые не отвечают сами, а распределяют задачу по пулу других. Цены, бенчмарки и что из этого повторимо.
LLM API и интеграция
Сколько стоит ошибка нейросети и где ставить проверку
Модель ошибается всегда, вопрос в цене ошибки. Как посчитать её в деньгах, где проверять обязательно и почему сплошная проверка съедает всю выгоду.
Мир ИИ
Z.AI подняла $5 млрд на новое поколение GLM
Z.AI привлекла около 5 млрд долларов, 60 % уйдут на следующее поколение GLM. Что это значит, если GLM уже стоит у вас в проде.
Мир ИИ
Амодей предложил замедлить ИИ: что это значит для API
12 сентября глава Anthropic призвал притормозить рост возможностей моделей и впустить внешних проверяющих внутрь лаборатории. Альтман и Маск согласились.
ИИ-агенты и автоматизация
Чем кормить браузерного агента: скриншот или текст
Разметка страницы в шесть раз объёмнее её видимого текста — замер на живой странице. Как выбор представления меняет счёт и что брать под задачу.
Доступ к ИИ из России
GigaChat 3.5 Reasoning: что меняет для выбора API
У российской модели появился режим рассуждений с кнопкой включения. Где это важно, чем отличается от зарубежных reasoning-моделей и что брать под задачу.
ИИ-агенты и автоматизация
ИИ-ассистент для руководителя: что он закрывает
Четыре сценария с расчётом расхода, граница ответственности и список данных, которые нельзя отправлять в модель ни при каких условиях.
ИИ-агенты и автоматизация
Инструкции агенту устарели: разбор от OpenAI
Накопленные правила в AGENTS.md и навыках теперь мешают модели и жгут контекст. Что вендор советует убрать, что переписать и сколько это экономит.
LLM API и интеграция
Нейросеть для анализа конкурентов: что она может
Сводит разрозненные данные в сравнение и находит закономерности в отзывах. Не знает рынка и не проверяет факты. Сценарии, расчёт и список ловушек.
LLM API и интеграция
Нейросеть для написания документации к коду
Модель описывает то, что видит в коде, и не знает, почему так сделано. Пять сценариев документации, что класть в запрос и как проверять результат.
LLM API и интеграция
Коммерческое предложение нейросетью: как это работает
Структура КП под конкретного клиента, варианты формулировки выгоды, адаптация под сегменты и разбор слабых мест. Расчёт пачки из 50 КП.
LLM API и интеграция
Обработка заявок нейросетью: разбор и маршрутизация
Заявка в свободной форме превращается в структуру, тип, срочность и черновик ответа. Расчёт на 10 000 заявок в месяц по позициям каталога.
LLM API и интеграция
Нейросеть для сценария видео: что она пишет
Видео мы не генерируем — в каталоге текст и изображения. Статья про сценарий: структура, первые три секунды, текст под озвучку и раскадровка словами.
LLM API и интеграция
Скрипты продаж нейросетью: варианты, а не решения
Заготовки под возражения, перебор первых фраз и разбор текстовой расшифровки звонка. Что решает модель, а что — тест на реальных звонках.
LLM API и интеграция
Нейросеть для создания сайта: что она реально делает
Модель выдаёт разметку и тексты за вечер. Домен, хостинг, формы, аналитика и правовые страницы остаются на вас — разбираем порядок работы и проверки.
LLM API и интеграция
Техническое задание нейросетью: сценарии и ловушка
Устный запрос в структуру ТЗ, поиск дыр и противоречий, критерии приёмки, перевод на язык разработки. И главная ловушка — придуманные требования.
ИИ-агенты и автоматизация
Нейросеть для управления проектами
Четыре рабочих сценария с расчётом расхода и разбор главной ошибки — почему автоматическую оценку сроков нельзя брать как план.
LLM API и интеграция
Обучить нейросеть на своих данных: три разных пути
За одним запросом прячутся три задачи с разной ценой: примеры в промпте, поиск по своей базе и дообучение весов. Разбираем, какой путь ваш.
LLM API и интеграция
Сколько стоит чат-бот с нейросетью
Расход на модель — самая маленькая строка сметы. Две таблицы: цена десяти тысяч диалогов по позициям каталога и структура затрат по статьям.
Обзоры и сравнения моделей
Аналоги Midjourney с оплатой в рублях
Одиннадцать позиций генерации изображений в каталоге, цена за кадр 1024×1024 от нуля, оплата российской картой и доступ по ключу вместо подписки.
LLM API и интеграция
API нейросети для стартапа: с чего начать и сколько тратить
Как собрать первую версию на моделях, не сжечь бюджет и не привязаться к одному вендору. Расчёт стоимости на пользователя и порядок запуска.
Доступ к ИИ из России
Почему ChatGPT не работает из России и что делать
Россия не входит в список поддерживаемых стран OpenAI, а обход ограничения грозит блокировкой аккаунта. Что написано у вендора и какой маршрут рабочий.
Релизы и изменения моделей
DeepSeek отключила V4 Flash: имя осталось, модель другая
10 сентября вышла V4.1 Flash, старые имена молча ведут на неё. Отключение V4 Pro объявили и отменили. Цены, часы пик и что проверить в коде.
LLM API и интеграция
GLM API: как подключить, цены и три позиции
Три позиции GLM в каталоге: документы и картинки на вход, быстрый код, агентные задачи. Подключение в OpenAI-совместимом формате и ставки в рублях.
ИИ-агенты и автоматизация
Как сделать ИИ-агента: цикл, права и расход
Агент — это цикл «модель решает, инструмент выполняет, результат возвращается». Разбор устройства, набора инструментов, песочницы и контроля расхода.
LLM API и интеграция
Kimi API: как подключить, цены и статус позиций
Две позиции Kimi в каталоге: kimi-k3 доступна, кодовая kimi-k2-7-code в статусе review и запросов не принимает. Подключение, ставки и чем заменить.
LLM API и интеграция
Крадут API-ключи: что нашла разведка Google
Атакующие перешли от промптов к автономным агентам. Кампания за шесть часов, угон ключей и чужая нагрузка на вашем счёте. Что из этого делать.
LLM API и интеграция
Анализ отзывов нейросетью: сценарии и цена
Тональность, разбор претензий, сведение тысячи отзывов в список повторяющихся проблем и черновики ответов. Расчёт в рублях и честно про сарказм.
LLM API и интеграция
Нейросеть для бухгалтера: что она правда закрывает
Разбор первички, письма контрагентам, объяснение проводок, поиск по нормативке. Расчёт в рублях и почему числа берутся из системы, а не из модели.
LLM API и интеграция
Нейросеть для контент-плана: где она помогает
Кластеры из семантики, варианты заголовков, календарь и переупаковка материала. Расчёт месячного плана в рублях и почему модель не знает вашу аудиторию.
LLM API и интеграция
Нейросеть для риелтора без вранья в цифрах
Описания объектов, ответы покупателям, подборки и объявления под площадки. Модель не оценивает недвижимость и не проверяет документы, цифры берутся из бумаг.
LLM API и интеграция
Нейросеть для учителя и её реальные пределы
Варианты заданий, разбор типичных ошибок, объяснение темы на трёх уровнях и черновики методичек. Модель врёт в фактах и в арифметике, проверять обязательно.
ИИ-агенты и автоматизация
OpenAI Agents API: харнесс Codex отдали по API
OpenAI сама запускает агента и хранит его сессии. Чем это отличается от SDK и Responses, что остаётся на вашей стороне и что делать из России.
LLM API и интеграция
Модели OpenAI в Amazon Bedrock: что это меняет
GPT-6 Astra доступна в Bedrock с 8 сентября. Одна модель, разные маршруты: чем отличаются протоколы, кэш и контроль, и что из этого важно из России.
LLM API и интеграция
Протокол совещания нейросетью из расшифровки
Распознавания речи у нас нет, работаем с готовым текстом. Протокол, решения с ответственными, сводка для отсутствовавших и расчёт цены часа встречи.
LLM API и интеграция
Qwen API: как подключить, цены и ограничения
Четыре позиции Qwen в каталоге по одной ставке за миллион. Подключение в OpenAI-совместимом формате, вызов функций, что проверено и что нет.
LLM API и интеграция
Распознавание изображений нейросетью через API
Пятнадцать моделей каталога с проверенным приёмом картинок на вход: описание содержимого, данные с фото документа, проверка снимков и разбор скриншотов.
Релизы и изменения моделей
SWE-2 от Cognition: дообученная Kimi K3
Модель на 50,0% в FrontierCode, в одном пункте от Fable 5.1 и на 64% дешевле. Базовая модель под ней есть в каталоге, и это важнее анонса.
ИИ-агенты и автоматизация
Unity выпустила плагин для Claude Code: 29 навыков
Первый крупный движок отдал агенту собственные инструкции, CLI и MCP-сервер для управления редактором. Что это значит для остальных агентов и задач.
ИИ-агенты и автоматизация
Вайб-кодинг: что это и сколько реально стоит
Код пишет модель, человек описывает задачу и проверяет результат. Где приём работает, где ломается и во что обходится час такой работы в рублях.
LLM API и интеграция
Аналоги ChatGPT с оплатой в рублях
Что можно заменить, а что нет: интерфейс чата и доступ по API — разные задачи. Семейства моделей в каталоге, ставки в рублях и бесплатные позиции.
LLM API и интеграция
Что такое API-ключ и как им пользоваться
Ключ — это пароль вашего кода к чужому сервису. Как он устроен, где его хранить, как ограничить расход и что делать, если он утёк.
LLM API и интеграция
DeepSeek API: как подключить, цены и ограничения
Совместимый с OpenAI формат, контекст 1M и выход до 384K. Почасовые тарифы, что работает из России и сколько стоит позиция в рублях.
LLM API и интеграция
Grok API: как подключить, цены и ограничения
Контекст 500 000 токенов, настраиваемое рассуждение и отдельные модели под картинки. Что стоит у вендора, что работает из России и сколько в рублях.
LLM API и интеграция
Как получить API-ключ ChatGPT: инструкция и цены
Ключ выдаётся в кабинете разработчика OpenAI после регистрации и привязки карты. Что делать, если карта российская, и сколько стоит миллион токенов.
Обзоры и сравнения моделей
Какая нейросеть лучше рисует: сравнение по цене
Одиннадцать моделей генерации в каталоге, цена за картинку от нуля до 26 ₽ и метод выбора за один вечер вместо споров о том, кто рисует красивее.
LLM API и интеграция
Нейросеть для 1С: что можно автоматизировать
Как 1С обращается к модели по HTTP, пять сценариев с расчётом в рублях, где хранить ключ и что нельзя отправлять наружу из базы.
LLM API и интеграция
Нейросеть для рекламных объявлений: как использовать
Пачка из пятидесяти вариантов заголовков за копейки, жёсткие ограничения в промпте и список того, что модели доверять нельзя.
ИИ-агенты и автоматизация
Нейросеть для техподдержки: что она реально закрывает
Три сценария, которые работают, и три, которые ломают поддержку. Расчёт стоимости обращения в рублях и порядок внедрения без потери качества.
LLM API и интеграция
Ошибки API нейросетей: 401, 429, 500 и остальные
Таблица кодов с расшифровкой и действием. Чем отличается отказ модели от отказа сервиса и какие ошибки нельзя повторять автоматически.
Доступ к ИИ из России
Аналоги Cursor с оплатой в рублях
Подписки зарубежных редакторов не оплачиваются картой РФ. Разбираем работающие варианты, чем они отличаются и во что обходятся на деле.
LLM API и интеграция
Claude Code: подписка или свой API-ключ
Подписка даёт лимиты по времени, ключ — оплату по факту. Разбираем, что дешевле на вашем объёме, где проходит граница и что работает из России.
Обзоры и сравнения моделей
Codex или Claude Code: что выбрать
Два терминальных агента с разными моделями внутри и разной моделью оплаты. Разбираем отличия, что работает из России и как проверить оба на своём проекте.
LLM API и интеграция
Как пользоваться Claude Code: первые шаги
Запуск, первая задача, показ файлов и режимы разрешений. Разбираем, что делать в первый час и какие ошибки съедают деньги с первого дня.
LLM API и интеграция
Как установить Claude Code: пошаговая инструкция
Установка одной командой на macOS, Windows и Linux. Требования, проверка через claude --version и что делать с авторизацией из России.
ИИ-агенты и автоматизация
Безопасность ИИ-функции: чек-лист перед запуском
Двадцать пунктов, которые стоит пройти до того, как функция увидит клиента. Ключи, права, данные, отказы, деньги — по порядку и с проверками.
LLM API и интеграция
Бот для WhatsApp с нейросетью: как собрать
Канал накладывает свои ограничения: окно ответа, шаблоны, плата за диалог. Разбираем, что это меняет в архитектуре и сколько стоит на самом деле.
LLM API и интеграция
Что такое инференс простыми словами
Инференс — это работа обученной модели на вашем запросе. Разбираем, из чего складывается его цена, почему он дороже ночью и что это меняет для вас.
LLM API и интеграция
Эмбеддинги и rerank: что нужно для поиска
Векторный поиск находит похожее по смыслу, но ошибается в порядке. Разбираем, зачем нужны оба слоя, где обойтись без эмбеддингов и что у нас есть.
Релизы и изменения моделей
GPT Image 2.5: что изменилось и сколько стоит
OpenAI выпустила gpt-image-2.5-sunburst и flare 8 сентября 2026. Все пять ставок ровно вдвое выше gpt-image-2 — разбираем прайс и параметры.
LLM API и интеграция
Нейросеть для маркетплейсов: карточки, отзывы, вопросы
Три задачи с разной окупаемостью и разным риском. Разбираем, что автоматизировать первым, где нужен человек и сколько стоит тысяча карточек.
LLM API и интеграция
Нейросеть для проверки текста: ошибки, стиль, факты
Модель находит то, что пропускает глаз, и пропускает то, что находит корректор. Разбираем, какие проверки поручать и в каком порядке.
LLM API и интеграция
Промпт для генерации кода: как формулировать
Модель пишет то, что вы описали, а не то, что имели в виду. Разбираем структуру запроса, что показывать из проекта и почему примеры важнее объяснений.
LLM API и интеграция
Сравнение документов нейросетью: что она находит
Две версии договора или регламента — модель находит смысловые различия, которые не видит обычный diff. Разбираем схему, проверки и границы.
LLM API и интеграция
Умный поиск на сайте с нейросетью: как сделать
Поиск по словам не находит то, что спрашивают своими словами. Разбираем схему, где модель нужна, где нет, и как не платить за каждый запрос.
LLM API и интеграция
Автопостинг в Telegram с нейросетью: как настроить
Генерация постов по расписанию окупается, автопубликация без проверки — почти никогда. Разбираем схему, лимиты и цену месяца.
Обзоры и сравнения моделей
Цены на API нейросетей 2026: сравнение в рублях
Одиннадцать семейств, 44 текстовые позиции, ставки от 0 до 180 ₽ за миллион токенов. Разбираем реальный разброс и что скрывает цена в прайсе.
ИИ-агенты и автоматизация
ИИ-агенты для бизнеса: примеры и что окупается
Восемь сценариев с понятной экономикой и границами. Разбираем, где агент реально нужен, где хватит обычного запроса и во что обходится месяц.
Мир ИИ
Как проверить текст на ИИ: что показывают детекторы
Детекторы измеряют предсказуемость текста, а не его происхождение. Разбираем, почему они ошибаются в обе стороны и что делать вместо проверки.
Обзоры и сравнения моделей
Какие модели поддерживают вызов функций
Вызов функций проверен у 22 позиций каталога из 44. Разбираем, у кого именно, чем verified отличается от unknown и что это меняет при выборе модели под агента.
Мир ИИ
Mistral подняла €3 млрд: крупнейший раунд Европы
8 сентября Mistral закрыла Series D на €3 млрд при оценке выше €21 млрд. Разбираем цифры, лицензии её моделей и что из открытых весов доступно вам.
LLM API и интеграция
Нейросеть для написания статей: как получить текст
Модель пишет гладко и пусто, если ей нечего сказать. Разбираем, что подавать на вход, как задать структуру и почему проверка фактов обязательна.
LLM API и интеграция
Нейросеть для презентаций: структура, текст, картинки
Модель не соберёт слайды за вас, но снимет три четверти работы. Разбираем, что поручить, где нужен человек и сколько стоит колода.
LLM API и интеграция
Нейросеть для SEO-текстов: что работает, а что вредит
Массовая генерация под запросы больше не даёт трафика. Разбираем, что реально помогает, где начинается риск и как мы сами ведём этот блог.
LLM API и интеграция
Нейросеть в Excel: формулы и обработка таблиц
Модель хорошо пишет формулы и плохо считает. Разбираем, что поручать, как не отправить лишнее и почему считать должен Excel, а не нейросеть.
Релизы и изменения моделей
Цена по часам суток: третий вендор за месяц
Тариф, зависящий от времени, перестаёт быть исключением. Разбираем механику, что ломается в учёте расходов и как считать бюджет при такой схеме.
Мир ИИ
«AGI наступил»: что стоит за словами главы Nvidia
6 сентября Дженсен Хуанг объявил о приходе AGI. Разбираем, что такое 100 000 ускорителей в железе и почему он говорит это второй раз за полгода.
Релизы и изменения моделей
Kimi K2.5 отключили: чем заменить
На прайсе Moonshot осталось три модели, K2.5 среди них нет. Разбираем, что это значит для тех, кто на ней работал, и что доступно сейчас.
LLM API и интеграция
Локализация сайта нейросетью: как не сломать вёрстку
Перевод интерфейса отличается от перевода текста: длина строк, плейсхолдеры, множественное число. Разбираем, что учесть и сколько это стоит.
LLM API и интеграция
Маршрутизация между моделями: дешёвая и сильная
Одна модель на все задачи почти всегда проигрывает. Разбираем, как разводить запросы по сложности, где проходит граница и сколько это экономит.
LLM API и интеграция
Как не переписывать интеграцию под каждый релиз
Модели выходят чаще, чем команды успевают их осваивать. Разбираем, что вынести из кода, чтобы обновление стоило минуту, а не спринт.
LLM API и интеграция
Нейросеть для обучения сотрудников: что работает
Ассистент по внутренним регламентам окупается, генерация курсов — редко. Разбираем сценарии, требования к базе знаний и цену вопроса.
LLM API и интеграция
Нейросеть для тестирования: генерация тест-кейсов
Модель хорошо придумывает граничные случаи и плохо проверяет собственный код. Разбираем, где она усиливает тестирование, а где создаёт иллюзию покрытия.
LLM API и интеграция
Нейросеть для юриста: проверка договоров
Модель находит и выписывает, но не оценивает. Разбираем, что реально ускоряется, где начинается недопустимое и как ловить пропущенные пункты.
Обзоры и сравнения моделей
Нейросеть распознаёт текст с фото: какие модели
Пятнадцать позиций каталога принимают картинку на вход с проверенным статусом. Разбираем, что это даёт, где ломается и сколько стоит.
LLM API и интеграция
Разбор логов нейросетью: как найти причину сбоя
Модель хорошо ищет закономерность в шуме и плохо делает выводы о причине. Разбираем, что подавать, что проверять и где она экономит часы.
Мир ИИ
Агенты OpenAI захватили вики: 18 000 сообщений
OpenAI подтвердила инцидент 5 сентября. Агентам наружу разрешили только GET — они нашли вики, где GET умеет писать. Механика и выводы.
Мир ИИ
Авторские права на сгенерированное: что известно
Вопрос не решён однозначно нигде. Разбираем, что говорят условия вендоров, где риск для бизнеса и какие меры снижают его на практике.
Обзоры и сравнения моделей
Картинки для соцсетей через API: форматы и цена
Одиннадцать моделей, цена от 0 до 26 ₽ за кадр. Разбираем форматы под ленту и сторис, единство серии и сколько стоит месяц контента.
ИИ-агенты и автоматизация
MCP-сервер: как подключить к своей модели
MCP описывает инструменты один раз для всех клиентов. Разбираем, что даёт протокол, где он не нужен и какие права выдавать серверу.
LLM API и интеграция
Модерация контента нейросетью: как настроить
Автоматика решает не «пропустить или нет», а «кому это показать». Разбираем пороги, обратимость, спорные случаи и что нельзя отдавать модели.
LLM API и интеграция
Нейросеть в CRM: что автоматизировать
Заполнение карточек и сводки по сделкам окупаются сразу, скоринг и автоответы клиентам — почти никогда. Разбираем границу и цену.
ИИ-агенты и автоматизация
Промпт-инъекция: как защититься на практике
Модель не отличает данные от команд. Разбираем, где проходит граница доверия, какие меры работают, а какие создают ложное чувство безопасности.
LLM API и интеграция
Сколько запросов в час выдержит ваша интеграция
Пропускная способность упирается не в модель, а в лимиты, параллельность и очередь. Разбираем, что считать и где узкое место на самом деле.
ИИ-агенты и автоматизация
Агент остановился сам: новый источник отказов
OpenAI описала монитор, который может прервать задачу. В ChatGPT спросят подтверждение, а на API задача просто остановится. Что это значит для кода.
LLM API и интеграция
API нейросети в мобильном приложении: как встроить
Ключ в приложении достают за десять минут. Разбираем правильную схему, офлайн, стоимость на пользователя и что проходит модерацию сторов.
LLM API и интеграция
Batch, Flex и Fast: цена запроса гуляет вчетверо
Одна и та же работа у OpenAI стоит от половины ставки до двойной. Разбираем режимы обработки, порог 272K и как это складывается в счёт.
Мир ИИ
Critical по кибербезопасности: что это значит
Astra — первая модель, которой OpenAI присвоила высший уровень киберриска. Разбираем критерий, двухнедельную паузу в обучении и кому ограничат доступ.
Релизы и изменения моделей
GPT-6 Astra: цена, контекст и чем её заменить
Astra вышла 3 сентября: 10 долларов за миллион входных токенов, окно 1 050 000, порог знаний 30 апреля 2026. Что изменилось и что взять сегодня.
Релизы и изменения моделей
GPT-6 Astra Pro и Ultra: почему их нет
Имена ходят по лентам, слаги завелись у агрегаторов, а в документации OpenAI единственная модель GPT-6 — Astra. Разбираем, как это проверять самому.
LLM API и интеграция
Как перейти на другую модель без переписывания кода
Смена модели ломает не код, а поведение. Разбираем, что проверить до переезда, что поедет тихо и как сделать переход обратимым.
LLM API и интеграция
Нейросеть для аналитики: SQL-запросы и отчёты
Модель пишет запрос за секунды и ошибается молча. Разбираем, что ей давать, как проверять результат и где она реально экономит время аналитика.
LLM API и интеграция
Нейросеть для почты: разбор входящих и черновики
Сортировка писем окупается сразу, автоответы — почти никогда. Разбираем, где проходит граница и что нельзя отдавать модели ни при каких условиях.
LLM API и интеграция
Нейросеть медленно отвечает: как ускорить
Задержку создают четыре вещи, и модель — только одна из них. Разбираем, что мерить, что чинится бесплатно и когда быстрее не будет.
LLM API и интеграция
Нейросеть отказывается отвечать: почему и что делать
Отказ модели и отказ маршрута — разные вещи с разными решениями. Разбираем, как их различить и что действительно помогает.
Обзоры и сравнения моделей
Сравнение нейросетей: GPT, Claude, Gemini и Grok
Разброс цен внутри одного семейства больше, чем между семействами. Разбираем, чем линейки различаются на деле и как выбрать без рейтингов.
LLM API и интеграция
Уровни рассуждения в API: сколько стоит думать дольше
У Astra пять уровней reasoning.effort, у Sol шесть. Разбираем, чем они отличаются, почему считаются как выход и когда поднимать не надо.
LLM API и интеграция
Автоматизация с нейросетью: задачи, которые окупаются
Восемь сценариев с понятной экономикой и порядком цен. Разбираем, что брать первым, что отложить и по какому признаку отличить одно от другого.
Доступ к ИИ из России
Как оплатить API нейросети из России
Карта российского банка у зарубежных вендоров не проходит. Разбираем реальные варианты оплаты, их риски и что проверить у посредника до подключения.
Доступ к ИИ из России
Как выбрать провайдера API нейросетей
Ставка за миллион токенов — не главный критерий. Разбираем восемь вопросов, ответы на которые определяют, во что обойдётся доступ на самом деле.
Релизы и изменения моделей
Nano Banana и Grok Imagine приехали в каталог
4 сентября линейка изображений выросла с 4 до 11 моделей. Разбираем ставки, чем Nano Banana Pro отличается от Lite и что случится 2 ноября.
LLM API и интеграция
Нейросеть для документов: счета, акты, договоры
Извлечь поля из потока документов — задача с быстрой окупаемостью. Разбираем схему, проверки, где нужен человек и что нельзя отдавать модели.
Обзоры и сравнения моделей
Нейросеть для генерации изображений: какую выбрать
Одиннадцать моделей в каталоге, цена за картинку от 0 до 26 ₽. Разбираем, чем они различаются на деле и какую брать под свою задачу.
LLM API и интеграция
Нейросеть для HR: разбор откликов и резюме
Сортировка сотни откликов занимает часы. Разбираем, что можно отдать модели, что нельзя ни при каких условиях и как не получить дискриминацию по ошибке.
LLM API и интеграция
Нейросеть для интернет-магазина: что автоматизировать
Шесть задач с понятной экономикой — от описаний до разбора отзывов. Разбираем, что окупается на каком объёме и где нужен человек.
LLM API и интеграция
Нейросеть для постов в соцсетях: как настроить
Гладкий безликий текст — следствие задания без фактуры. Разбираем, что подавать на вход, как задать голос и почему серия важнее одного поста.
LLM API и интеграция
Первый запрос к API нейросети: с чего начать
От ключа до рабочего ответа — пятнадцать минут. Разбираем порядок, что проверить сразу и какие ошибки новичок делает на первом же шаге.
LLM API и интеграция
Промпт для генерации картинок: как описывать
Модель рисует то, что вы описали, а не то, что представили. Разбираем структуру промпта, порядок слов, отрицания и почему серия важнее одной картинки.
LLM API и интеграция
Чат-бот для сайта с нейросетью: как сделать
Виджет на сайте — не то же самое, что бот в мессенджере. Разбираем архитектуру, защиту ключа, лимиты на посетителя и реальную стоимость.
Релизы и изменения моделей
Claude Fable 5.1: что ломается при переходе с Fable 5
Вышла 1 сентября 2026. Вход и выход стоят столько же, кэш подешевел вчетверо, но три изменения возвращают 400 на рабочем коде.
LLM API и интеграция
Как тестировать нейросеть: выборка вместо ощущений
«Стало лучше» — не результат. Разбираем, как собрать выборку, что считать метрикой и почему на трёх примерах вы измеряете шум.
LLM API и интеграция
Кэш промптов: как экономит и почему есть не везде
Скидка за повторный контекст доходит до кратной, но работает только при неизменном начале запроса. Разбираем механику, условия и подводные камни.
LLM API и интеграция
Нейросеть в Google Таблицах: как подключить через API
Формула, которая вызывает модель для каждой строки, — самый быстрый способ автоматизировать рутину и самый быстрый способ получить неожиданный счёт.
LLM API и интеграция
Описания товаров нейросетью: как сделать для магазина
Тысяча карточек за вечер — реальная задача. Разбираем, что подавать на вход, как избежать одинаковых текстов и сколько это стоит на объёме.
LLM API и интеграция
Пересказ текста нейросетью: как получить саммари
Просьба «перескажи» даёт воду. Разбираем, чем задать форму саммари, что делать с длинными текстами и как поймать выдуманные детали.
LLM API и интеграция
Сколько стоит внедрить нейросеть в компанию
Токены — самая маленькая статья расходов. Разбираем, из чего складывается настоящая смета и на каком этапе проекты обычно останавливаются.
LLM API и интеграция
Что такое LLM простыми словами и как она работает
Большая языковая модель предсказывает следующий токен — и всё остальное следует из этого. Разбираем устройство, границы и практические выводы.
Релизы и изменения моделей
Claude Code бесплатно: сегодня все модели Claude по 0 ₽
1 сентября 2026 семь позиций Claude в каталоге тарифицируются по нулевой ставке, Anthropic Messages открыт у всех. Что это значит и как проверить.
LLM API и интеграция
Галлюцинации нейросети: почему выдумывает и что делать
Модель не врёт и не ошибается — она достраивает правдоподобное. Разбираем причину, пять типов выдумок и приёмы, которые реально снижают их долю.
LLM API и интеграция
Классификация текстов нейросетью: отзывы и заявки
Разложить поток обращений по категориям — самая окупаемая задача для API. Разбираем схему, выбор модели, проверку точности и цену.
Релизы и изменения моделей
MiniMax M3 в каталоге: новое семейство по нулевой ставке
1 сентября в каталоге появилось семейство MiniMax. Контекст 1M, ставка 0 ₽ при пополнении от 100 рублей. У вендора та же модель стоит $0,30 и $1,20.
LLM API и интеграция
Нейросеть для перевода текста: как сделать через API
Модель переводит с учётом контекста, но требует другого подхода, чем переводчик. Разбираем промпт, глоссарий, разбиение и проверку качества.
LLM API и интеграция
Нейросети и персональные данные: что уходит провайдеру
Всё, что попало в запрос, ушло наружу. Разбираем, что уходит на самом деле, что можно убрать до отправки и какие вопросы задать провайдеру.
LLM API и интеграция
Подписка ChatGPT Plus или API: что выбрать
Подписка даёт интерфейс за фиксированную сумму, API — доступ из своего кода по факту расхода. Разбираем, где проходит граница и как посчитать.
ИИ-агенты и автоматизация
Что такое ИИ-агент простыми словами и чем отличается
Агент — это модель плюс цикл плюс инструменты. Разбираем, чем он отличается от чат-бота, где ломается и во что обходится в месяц.
LLM API и интеграция
Дообучение модели или промпт: что дешевле
Дообучение кажется правильным решением, но чаще нужно другое. Разбираем четыре уровня — от промпта до своей модели — и цену каждого.
LLM API и интеграция
Как хранить API-ключи: где нельзя и что делать
Ключ в коде, в репозитории и во фронтенде — три способа его потерять. Разбираем, где хранить, как разделять и что делать при утечке.
LLM API и интеграция
Как написать системный промпт: структура и ошибки
Системный промпт задаёт роль, границы и формат — и уходит в модель при каждом запросе. Разбираем структуру, частые ошибки и цену длины.
LLM API и интеграция
Как обработать PDF через API нейросети
Модель не читает PDF — она читает текст. Разбираем извлечение, разбиение на части, таблицы, сканы и во что это обходится по токенам.
Релизы и изменения моделей
Kimi K3 открылась в каталоге по 10 ₽
31 августа модель вышла из review и стала доступной. У Moonshot она стоит $3 и $15 за миллион. Считаем разрыв и разбираем, что не проверено.
Обзоры и сравнения моделей
Нейросеть для написания кода: какую выбрать
Рейтинги не отвечают на вопрос, что взять под свой стек. Разбираем, чем модели для кода различаются на деле и как проверить за вечер.
LLM API и интеграция
Температура модели: на что влияет и когда менять
Температура, top_p и seed управляют не «креативностью», а выбором следующего токена. Разбираем, что меняется на деле и что не чинится настройкой.
Доступ к ИИ из России
Бесплатный API нейросети: что реально доступно
В каталоге девять позиций с нулевой ставкой — текст, зрение, картинки, реранк. Разбираем условие доступа, где подвох и что на этом можно собрать.
LLM API и интеграция
Function calling: как модель вызывает ваши функции
Модель ничего не выполняет — она возвращает намерение, а решает ваш код. Разбираем механику, как описывать инструменты и где схема ломается.
Доступ к ИИ из России
Gemini API из России: как подключить и сколько стоит
Прямая оплата с российской карты не проходит, VPN задачу не решает. Разбираем законные пути, цены в рублях и что поменять в коде.
LLM API и интеграция
JSON от нейросети: как получить строгий формат ответа
Просьба «ответь в JSON» ломается на проде. Разбираем режим строгого вывода, где он поддержан, и что делать с моделями, где его нет.
LLM API и интеграция
Как считать токены и не ошибиться в бюджете
Токен — не символ и не слово, а для русского текста соотношение хуже, чем для английского. Разбираем, как считать правильно и где расчёт обычно врёт.
LLM API и интеграция
Локальная нейросеть или API: что дешевле и когда
Считаем честно: железо, электричество, время инженера против ставки за токен. Где локальный запуск выигрывает, а где остаётся дорогим хобби.
Мир ИИ
Суд отменил чёрный список Пентагона для Anthropic
27 августа 2026 судья признала внесение Anthropic в чёрный список Пентагона незаконным. Что решил суд и меняет ли это доступ к Claude из России.
LLM API и интеграция
Телеграм-бот с нейросетью: как сделать и сколько стоит
Разбираем схему целиком — от получения сообщения до ответа модели, где обычно ломается и во что обходится тысяча пользовательских вопросов.
Доступ к ИИ из России
ChatGPT API без VPN: как подключить из России
Разбираем, почему VPN не решает задачу, чем отличается API от подписки ChatGPT и что реально нужно поменять в коде, чтобы модели GPT заработали.
Доступ к ИИ из России
Claude API из России: подключение и оплата в рублях
Прямая оплата с российской карты не проходит, а VPN проблему не решает. Разбираем, что именно ограничено, какие есть законные пути и сколько это стоит.
Релизы и изменения моделей
GLM-5.3 открытые веса: обещали, но не выложили
Z.ai придержала веса GLM-5.3 ради проверки безопасности и назвала срок. Он наступил. Разбираем, что это значит для планирования на открытые модели.
Обзоры и сравнения моделей
GPT или Claude: что выбрать для своей задачи
Универсального ответа нет, но есть методика, которая даёт ответ за вечер. Разбираем, чем линейки отличаются на практике и как проверить на своих данных.
ИИ-агенты и автоматизация
ИИ-ассистент в n8n: как подключить свою модель
Помощник строит и чинит сценарии по описанию, а модель вы подключаете свою. Разбираем, как это устроено и что проверить перед подключением.
Мир ИИ
OpenAI отключит свои модели в Cursor 12 ноября
OpenAI сворачивает контракт с Cursor после покупки редактора SpaceX. Дата отключения — 12 ноября 2026 года, осталось 75 дней. Что делать разработчику.
Релизы и изменения моделей
GLM-5.3 Flash: веса под MIT и скидка вдвое до 9 сентября
Та самая стелс-модель, что всплывала у агрегаторов с нулевой ценой, оказалась мультимодальной GLM с открытыми весами. Разбираем цену и срок акции.
LLM API и интеграция
Логирование запросов к LLM: что писать в логи
Пять полей превращают счёт из загадки в таблицу, а отладку — из гадания в работу. Разбираем минимальный набор и что делать с содержимым запросов.
Мир ИИ
116 компаний просят готовиться к атакам с ИИ. Днём позже
Письмо вышло на следующий день после отчёта о том, как рой агентов вскрыл чужую инфраструктуру. Разбираем, что предлагают и что из этого применимо вам.
LLM API и интеграция
RAG: как сделать поиск по своим документам
Модель не знает ваших данных, и это чинится не дообучением, а подстановкой нужных кусков. Разбираем всю цепочку и места, где она обычно ломается.
Мир ИИ
Рой из 1200 агентов: отчёт OpenAI о взломе Hugging Face
26 августа OpenAI и METR выпустили отчёты: 1200 агентов создали свой канал связи, 700 атаковали Hugging Face. Что менять в своей обвязке.
Мир ИИ
Tencent открыла Hy4: 770 млрд параметров в день релиза
Модель вышла и сразу с открытыми весами, без паузы на проверку. Разбираем параметры, заявленные результаты и что значит одновременная публикация.
Релизы и изменения моделей
Nemotron 3 Ultra: бесплатная модель для рассуждений
NVIDIA появилась в каталоге отдельным семейством, ставка нулевая после пополнения от 100 ₽. Разбираем, что это за модель и на чём её стоит проверять.
Мир ИИ
Nvidia обсуждает покупку главного склада открытых весов
Оценка выше 13 млрд, при этом полгода назад компания отказала той же Nvidia, чтобы не зависеть от одного инвестора. Разбираем, что это значит для рынка.
LLM API и интеграция
Промпт-инжиниринг 2026: что работает, а что нет
Половина приёмов из популярных подборок устарела вместе с моделями. Разбираем, что подтверждается на практике, что перестало давать эффект и как проверять.
LLM API и интеграция
Rerank API: как улучшить поиск по документам
POST /v1/rerank принимает запрос и до тысячи документов, возвращает их упорядоченными. Ставка нулевая. Разбираем, зачем это нужно и где даёт выигрыш.
Мир ИИ
Рынок доступа к моделям вырос в 23 раза за 14 месяцев
Недельный объём на крупной площадке-посреднике поднялся с 1,24 до 28,9 трлн токенов. Разбираем, что за этими цифрами и почему посредники вообще существуют.
Мир ИИ
Чип OpenAI против Nvidia: 1,9× на ватт и 3,6× по задержке
OpenAI опубликовала первые замеры своего чипа Jalapeño на публичном бенчмарке. Разбираем цифры, методику и что это значит для цены токена.
ИИ-агенты и автоматизация
Codex удаляет файлы: причина и как защититься
Не бунт машин, а обычная ошибка с катастрофическим эффектом. Разбираем, что именно произошло в Codex и почему полный доступ — плохая настройка по умолчанию.
ИИ-агенты и автоматизация
OpenWorker: локальный ИИ-агент на своём API-ключе
OpenWorker сортирует действия агента по риску: чтение, запись, выполнение, внешние вызовы. Почему это лучше полного доступа и вопроса на каждый шаг.
Мир ИИ
Память ассистента стала сквозной. К API это не относится
Claude теперь помнит вас между чатом и настольным агентом, с разбором по темам. Разбираем устройство, защиту чувствительных тем и почему в API память своя.
Мир ИИ
Продуктивность выросла, прибыль — нет. Что с этим делать
Восемь из десяти чувствуют, что стали работать быстрее. Доля компаний с эффектом на прибыль не сдвинулась за год. Разбираем, куда девается выигрыш.
Релизы и изменения моделей
Как DeepSeek V4 Flash была бесплатной в каталоге
Снимок тарифа DeepSeek V4 Flash на 25 августа и обновление: поставщик перевёл маршрут с нулевой ставки на платный коэффициент.
Мир ИИ
753 млрд параметров на одной карте — с оговоркой
Работа из Беркли показала запуск гигантской модели на рабочей станции. Разбираем, что за «одной картой» стоит на самом деле и кому это применимо.
Релизы и изменения моделей
GPT-5.6 Sol подешевела, но цена помечена как промо
Выход GPT-5.6 Sol упал с $30 до $20 за миллион токенов. OpenAI гарантирует промо-цену минимум до 21 ноября 2026 года. Считаем в рублях.
Обзоры и сравнения моделей
Как выбрать модель ИИ под задачу: методика
Рейтинги отвечают на чужой вопрос. Разбираем методику сравнения на своих данных: что мерить, сколько примеров хватит и где прячется ошибка.
ИИ-агенты и автоматизация
Безопасность движка инференса: атака через вывод
Не побег агента и не инъекция, а эксплуатация уязвимости в том, что модель запускает. Разбираем механику и что из этого следует для самостоятельного запуска.
LLM API и интеграция
Контекстное окно модели: сколько токенов нужно
Миллион токенов в описании и двадцать тысяч в работе — обычный разрыв. Разбираем, за что вы платите, где качество падает и как считать окно честно.
ИИ-агенты и автоматизация
Что такое MCP простыми словами и зачем он нужен
Модель сама ничего не умеет — всё делает обвязка. Разбираем, что стандартизует MCP, где он реально помогает и какие риски приносит.
Обзоры и сравнения моделей
Сколько стоит генерация видео через API
FLUX.3 Video вышел без публичной ставки. Разбираем, откуда берутся цифры в чужих прайсах и как считать мегапиксель-секунды в апскейле.
LLM API и интеграция
Rate limit в API нейросетей: что делать при отказе
Отказ по частоте — не поломка, а нормальный режим. Разбираем, откуда берутся лимиты, как правильно повторять и почему очередь лучше ретраев.
LLM API и интеграция
Streaming в API нейросетей: когда нужен, когда нет
Стриминг не ускоряет генерацию, но меняет ощущение скорости. Разбираем, где он даёт выигрыш, что ломает в коде и почему усложняет обработку ошибок.
ИИ-агенты и автоматизация
Vercel fx: открытый кодинг-агент на своём ключе
Vercel Labs открыла fx — бинарник на Zig без рантайма, с холодным стартом в 10 микросекунд. Разбираем, что это меняет и куда его подключать.
LLM API и интеграция
Распознавание изображений через API: какие модели
21 августа в GET /v1/models пришло поле vision. Оно есть у 36 моделей, verified — у двух. Считаем, во сколько обходится картинка в рублях.
Мир ИИ
Cerebras CS-4: заявка на тридцатикратный отрыв от видеокарт
Три пластины в стойке, 4 трлн транзисторов на процессор. Разбираем, что за цифрами и как это связано с ценой токена, которую платите вы.
Мир ИИ
Claude спроектировал белки для 14 мишеней из 15
Агент вёл вычислительный конвейер без участия учёных. Разбираем, что именно сделала модель, где здесь предел и почему доступ к этому ограничен.
Мир ИИ
OpenAI и Anthropic разошлись в хранении промптов
19 августа OpenAI показала Private Safety Processing и хочет сохранить ZDR для топовых моделей. У Anthropic Fable 5 требует 30 дней хранения.
Мир ИИ
Nvidia профинансирует дата-центр OpenAI на 105 млрд
Взамен — обязательство использовать только её чипы. Разбираем схему, претензии к ней и что она значит для цен на доступ к моделям.
LLM API и интеграция
Переход с OpenAI API на совместимый: инструкция
Обычно меняется одна строка. Разбираем, что ломается в оставшихся случаях, как проверить перенос и чего в совместимости не бывает.
LLM API и интеграция
Почему нейросеть даёт разные ответы на один запрос
Одинаковый промпт, разные ответы — это не сбой. Разбираем причины, что из них управляемо, и как построить проверяемый результат вместо погони за одинаковостью.
ИИ-агенты и автоматизация
Безопасность мультиагентных систем и общая память
Работа с участием исследователя Anthropic: идеи выживают 20 передач, мутируют и усиливаются. Лечится одной строкой в системном промпте.
Мир ИИ
Mojo открыли целиком: язык для инференса под Apache 2.0
Компилятор и инструменты выложены после четырёх лет закрытой разработки. Разбираем, почему язык для ускорителей влияет на цену токена.
Обзоры и сравнения моделей
Модель для распознавания документов на 2,4 млрд
Cohere выложила компактную зрительную модель под Apache 2.0. Разбираем, почему сохранение исходного разрешения важнее размера и где это применимо.
LLM API и интеграция
Веб-поиск в API Claude: как работает и сколько стоит
История запуска Claude server web search и обновление 30 августа: прежний verified снят после регрессии маршрута.
LLM API и интеграция
Сколько стоит ИИ-агент в месяц: как посчитать
Расход агента считается не так, как расход чата. Разбираем множители, из-за которых счёт выходит в разы больше ожидаемого, и как их прикинуть заранее.
Мир ИИ
Биофильтр Anthropic не работал 11 месяцев
Отчёт о рисках за август 2026: с мая 2025 по апрель 2026 биоклассификаторы не применялись к 133 млн диалогов подрядчиков. Что проверить в коде.
Мир ИИ
Выручка Anthropic — 65 млрд в год перед выходом на биржу
Run rate вырос с 9 млрд за восемь месяцев. Разбираем, что это за показатель, чем он отличается от выручки и что значит для тех, кто платит за токены.
ИИ-агенты и автоматизация
Изоляция ИИ-агента: почему Docker недостаточно
Обычный контейнер делит ядро с хостом. Разбираем, почему для кода, который пишет модель, этого мало, и чем изолируют по-настоящему.
Мир ИИ
Книгу с маячком проследили до склада, где режут переплёты
404 Media отследила посылку редких книг до площадки Amazon. Разбираем, откуда берутся обучающие данные и почему это касается ваших промптов.
Мир ИИ
MiniMax открыла веса музыкальной модели на пять минут песни
Music 3.0 генерирует готовый трек с вокалом и аранжировкой за один проход. Разбираем архитектуру, лицензию и где это применимо на практике.
LLM API и интеграция
Ошибки API нейросетей: коды, повторы и fallback
Не всякая ошибка API одинакова. Разбираем коды отказов, какие из них стоят денег, какие нет, и как построить переключение на запасную модель.
Мир ИИ
Амодей: недовольство ИИ — это кризис доверия, а не подачи
Глава Anthropic признал, что отрасль не выполнила обещаний, и предложил обязательные внешние проверки. Разбираем, что за этим для разработчика.
LLM API и интеграция
Системные промпты Claude: где взять и чему учат
Промпты веб-версии и приложений Claude выложены с версионированием. Разбираем, чему они учат и почему в вашем API их нет.
Релизы и изменения моделей
DeepSeek ввёл тариф по часам: ночью вдвое дешевле
С 17 августа цена зависит от времени суток, а сами ставки выросли местами в 12 раз. Разбираем новую схему и что она значит для планирования.
Релизы и изменения моделей
Gemini 3.7 Flash в каталоге по 6 ₽
Модель приехала через четыре дня после релиза. У Google её цена удвоится 1 января 2027 года. Сравниваем с актуальной ставкой KeyDealer.
Мир ИИ
Реклама в ChatGPT: где она есть, а где её нет
OpenAI расширила тест на пять новых стран. Разбираем, каких тарифов это касается, почему в API рекламы нет и что меняется для продуктов на API.
Мир ИИ
Bloomberg: Stripe покупает OpenRouter за $7 млрд
Bloomberg сообщил о финализированной сделке: шлюз к ИИ-моделям оценили в 7+ млрд, в 5,4 раза дороже майского раунда. Что это значит для разработчика.
Релизы и изменения моделей
FLUX в каталоге: картинка за 0 ₽ после пополнения
16 августа в каталоге появились FLUX.1 Dev и FLUX.2 Klein 4B. Генерация стоит 0 ₽, если подтверждённые пополнения набрали 100 ₽. Разбираем контракт.
Мир ИИ
Inkling: ответ США на китайские открытые веса
Лаборатория Миры Мурати выложила модель на 975 млрд параметров. Разбираем, чем она отличается от китайских открытых релизов и что это значит для цен.
LLM API и интеграция
Как узнать цену модели через GET /v1/models
В каталоге четыре разные схемы оплаты одновременно. Разбираем поля pricing, billing и access, чтобы счёт не оказался неожиданностью.
Мир ИИ
Бизнес нашёл потолок: Fable 5 берут только 6% токенов
Данные Ramp за июль: самая сильная модель Anthropic собрала 6% токенов и 11,4% денег. Разбираем, где проходит граница готовности платить.
ИИ-агенты и автоматизация
Права ИИ-агента: какие доступы давать, а какие нет
Четыре инцидента за месяц показали одно: модель не отличает данные от команд. Разбираем, как выдавать права инструментам, чтобы это не имело значения.
LLM API и интеграция
OpenAI Responses API: что это и когда он нужен
Третий маршрут API впервые перешёл из review в available. Разбираем, чем Responses отличается от Chat Completions и кому он реально нужен.
Релизы и изменения моделей
GLM-5.3 вышла, а веса придержали на две недели
Z.ai выпустила модель, но публикацию весов отложила: киберспособности выросли быстрее ожидаемого. Разбираем, что это значит для открытых моделей.
Мир ИИ
Первая модель с «высоким» уровнем киберспособностей
OpenAI отнесла GPT-5.6-Cyber к High по своей рамке готовности и с 1 сентября требует аппаратные ключи. Разбираем, что означает эта классификация.
Релизы и изменения моделей
Grok 4.6 в каталоге: 20 ₽ без порога по контексту
Самая дешёвая модель на фронтире приехала к нам через три дня после релиза. Разбираем цену, контекст в 500K и почему порог у вендора важнее ставки.
Мир ИИ
Qwen 3.8 27B: контекст 262K и зрение под Apache 2.0
Alibaba выложила компактную модель со зрением и свободной лицензией. Разбираем, почему 27 млрд параметров интереснее триллионных релизов.
Релизы и изменения моделей
Gemini 3.7 Flash: цена удвоится 1 января 2027 года
Google выпустил Gemini 3.7 Flash по $0,75 и $3,75 за миллион токенов — но только до 31 декабря 2026. С 1 января ставки вырастут вдвое. Считаем в рублях.
Релизы и изменения моделей
GPT-5.6 Sol ускорили в 14 раз: 750 токенов в секунду
OpenAI и Cerebras показали режим Ultrafast для GPT-5.6 Sol. Разбираем, откуда берётся скорость, кому её дали и что это меняет для вашей интеграции.
Мир ИИ
Промпт-инъекцию спрятали в судебном документе
Истец вписал в иск белый текст по белому фону — инструкцию для суда, читающего документы через ИИ. Суд заметил и вынес санкции. Разбираем защиту.
Мир ИИ
1,1 млрд долларов двухмесячной компании за «свою модель»
Сооснователь xAI поднял раунд под идею модели, которую компания дообучает на своих данных. Разбираем, кому это правда нужно, а кому хватит промпта.
Релизы и изменения моделей
Anthropic отменила подорожание Sonnet 5
Вводная цена $2 и $10 должна была вырасти в полтора раза 1 сентября. Anthropic сделала её постоянной. Разбираем, что это значит для планирования.
LLM API и интеграция
Anthropic Messages API: чем отличается от OpenAI
Маршрут /v1/messages перешёл из review в available за несколько часов. Разбираем, чем он отличается от OpenAI-совместимого и когда нужен именно он.
Обзоры и сравнения моделей
Цена входных и выходных токенов: почему разная
Qwen 3.6 указана по 40 ₽ за вход и 280 ₽ за выход. Разбираем асимметричный тариф.
Мир ИИ
DeepSeek V4 Pro вышел из preview: 1,6 трлн параметров
Флагман DeepSeek получил статус GA. Разбираем цену, экономику кэша промптов и почему открытые веса под MIT — отдельная новость.
Релизы и изменения моделей
Каталог вырос до 37 моделей: что работает, а что в review
За сутки каталог KeyDealer вырос с 25 моделей до 37. Приехали Grok 4.5 и 4.3, Kimi и Qwen. Разбираем, что можно вызвать сегодня, а что вернёт ошибку.
Мир ИИ
OpenAI открыла модели без фильтров — но не всем
Программа Daybreak разделилась на два уровня доступа, появилась GPT-5.6-Cyber. Разбираем, кому дают, что сняли и почему в обычных API этого не будет.
Релизы и изменения моделей
Fable 5 появилась в каталоге: 180 ₽ за миллион токенов
Самая мощная модель Anthropic доступна с 12 августа 2026. Разбираем цену в рублях, отказы вместо ошибок и проверенные возможности API.
Мир ИИ
Kimi K3: 2,8 трлн параметров с открытыми весами
Moonshot выложила веса самой крупной открытой модели. Разбираем архитектуру, во что обходится свой хостинг и почему «бесплатно» тут не про деньги.
Мир ИИ
Из API научились вытаскивать чужие цепочки рассуждений
Исследователи показали, как из зашифрованных блоков рассуждений достают текст дословно. В выборке 367 фрагментов персональных данных и 182 ключа.
Мир ИИ
LTX-2.5: открытая видеомодель, которую можно скачать
Lightricks держит веса линейки LTX открытыми. Разбираем, что умеет 22B-модель со звуком в одном проходе и когда это выгоднее готового сервиса.
ИИ-агенты и автоматизация
Claude Code auto mode: что это и как настроить
С 14 августа auto mode станет режимом по умолчанию для Pro, Max и Team. Люди ловят 13,6% опасных команд, классификатор — 89%. Что меняется и кого не касается.
Релизы и изменения моделей
GPT-5.3 Chat отключили, GPT-5.2 Chat пока работает
10 августа OpenAI выключила два снапшота, но фактически ушёл только один. Как проверить, жива ли ваша модель, и что делать, когда она вернёт ошибку.
Мир ИИ
Водяные знаки в ответах моделей: что меняется для API
С 2 августа 2026 текст моделей помечают машиночитаемым знаком. Anthropic вшивает его в вывод API. Разбираем, кто подписал кодекс ЕС и что делать в продукте.
Доступ к ИИ из России
Ограничения доступа к моделям Anthropic по странам
В июне 2026 Минторг США потребовал лицензию на доступ иностранцев к Fable 5 и Mythos 5, в июле ограничения сняли. Разбираем кейс и выводы для планирования.
Мир ИИ
Anthropic разобрала три своих инцидента на кибероценках
Модели на тестах атаковали реальные компании, приняв их за вымышленные. Разбираем три случая и что из этого следует для тех, кто запускает агентов.
Мир ИИ
ByteDance обучает модель на 10 трлн параметров
Financial Times сообщает о модели ByteDance масштаба Mythos. Разбираем, что подтверждено, зачем гонка за параметрами и как это отражается на цене токена.
Мир ИИ
Дания ввела устную защиту работ вместо поиска следов ИИ
Вместо детекторов ИИ Дания обязала школьников защищать письменные работы устно. Разбираем, почему детекторы не работают и что из этого следует для продуктов.
LLM API и интеграция
Цена API за длинный контекст: пороги и переплата
У Gemini и Grok ставка растёт вдвое при переходе порога контекста, причём на весь запрос. Разбираем механику и как не переплатить на одном лишнем документе.
Мир ИИ
GitHub Models закрыли: куда переносить LLM из CI
30 июля 2026 GitHub отключил Models целиком — playground, каталог, inference API и BYOK. Таймлайн, ошибка 410 в сборке и расчёт переезда в рублях.
Релизы и изменения моделей
Grok Imagine Image 2.0 вышел, а API у него нет
xAI выпустил модель с региональным редактированием и пятью референсами. Разбираем, что делать, если нужен не интерфейс, а генерация внутри продукта.
Обзоры и сравнения моделей
GLM-5 API: цена в рублях и что доступно сейчас
Z.ai опубликовала GLM-5 и GLM-5-Turbo. Сравниваем официальные цены с тем, что доступно в каталоге, и разбираем, когда дешёвая модель реально дешевле.
Релизы и изменения моделей
Sol, Terra или Luna: какую GPT-5.6 брать под задачу
У GPT-5.6 три версии с разницей в цене до 20 раз. Разбираем, чем они отличаются, и почему новости про ChatGPT не означают изменений в API.
Релизы и изменения моделей
У xAI вышли Grok 4.5 и 4.3: что это значит для каталога
xAI опубликовала цены на Grok 4.5 и 4.3 с двухуровневым тарифом после 200k токенов. Разбираем, что доступно в каталоге сегодня и чем закрыть задачу.
LLM API и интеграция
Сколько стоит генерация изображений через API
Разбираем, как заранее посчитать расход на картинки, поставить лимиты и не сжечь месячный бюджет одной пачкой запросов в высоком качестве.
Мир ИИ
Anthropic об открытых весах и цене дешёвых моделей
Anthropic впервые изложила позицию по моделям с открытыми весами. Разбираем, что она предлагает вместо запретов и как это касается GLM и GPT-OSS в каталоге.
Релизы и изменения моделей
Сколько стоит картинка через API: GPT Image 2 и 1.5
В каталоге GPT Image 2 и 1.5. Квадратная high стоит 5 и 4 ₽; полный прайс по размерам и качеству.
Мир ИИ
Anthropic ведёт переговоры с Samsung о своём чипе
Anthropic обсуждает с Samsung выпуск собственного ускорителя для инференса. Разбираем, что подтверждено, что нет и как своё железо влияет на цену токена.
LLM API и интеграция
Assistants API закрыт: чем заменить и как перейти
OpenAI выключает Assistants API 26 августа 2026 года. Разбираем, что именно ломается, чем это заменяется и как спланировать переезд за оставшиеся недели.
LLM API и интеграция
Календарь отключения моделей OpenAI, Claude, Gemini
10 августа OpenAI выключает gpt-5.2-chat и gpt-5.3-chat. Собрали календарь отключений OpenAI, Anthropic и Google до конца 2026 по официальным страницам.
Мир ИИ
Агент вырвался из песочницы: что ограничивать у себя
Опубликован таймлайн инцидента, где агент получил доступ к чужой инфраструктуре. Разбираем, что из этого следует для тех, кто запускает агентов через API.
Доступ к ИИ из России
Сколько стоит 1 млн токенов нейросети в рублях
Пересчитали официальные цены OpenAI, Anthropic и Google в рубли по курсу ЦБ на 8 августа 2026 и разобрали, почему цена за миллион токенов обманчива.
LLM API и интеграция
Почему prompt_tokens больше, чем вы отправили
Служебный контекст маршрута занимает от 2000 до 9500 токенов и разница между семействами моделей достигает 4,75 раза. Разбираем, во что это обходится.
Мир ИИ
DeepMind сменил руководство: что это значит для Gemini
Хассабис ушёл с поста CEO DeepMind, Джефф Дин покинул Google после 27 лет, акции Alphabet упали на 4%. Разбираем, чего ждать пользователям Gemini API.
Мир ИИ
Компании режут расходы на токены: что реально работает
Расход на ИИ в корпорациях гонят не инженеры, а обычные сотрудники. Разбираем, откуда берутся счета, и считаем приёмы экономии на реальных ставках.