Доступно на английскомvust.ai
vust

Документация для разработчиков · Yandex AI

Yandex AI Studio: какой сервис под какую задачу

Не просто список моделей: когда нужна чат-модель, embeddings или realtime-речь в AI Studio, а когда правильный инструмент — отдельный сервис Яндекса: Wordstat, Search API, OCR, Translate или SpeechKit. И безопасная схема интеграции, которая переживает обновления: зафиксированные версии моделей, валидация по схеме и — у моделей, которые это поддерживают, — явный бюджет рассуждения и вывода.

6 классов сервисов · выбор по задаче, а не по модеНезависимое руководство по официальной документации
AI Studio: генерация, векторы и realtime-речьSchema validation и явный бюджет вывода — с первого дняWordstat, Search API, OCR, Translate и SpeechKit — отдельные сервисы под профильные задачи

Выбор сервиса по задаче

Chat, embeddings и realtime живут в AI Studio; Wordstat, Search API, OCR, Translate и SpeechKit — отдельные сервисы Яндекса со своими API и документацией.

Chat / Completions

Генерация, рассуждение, преобразование текста в AI Studio. Фиксируйте версию модели и валидируйте структурированный вывод по схеме.

Embeddings

Векторы для поиска и retrieval. Смена модели или версии — это перестройка индекса: векторы разных моделей не сравнимы между собой.

Realtime и SpeechKit

Живой голосовой диалог по WebSocket — либо классические распознавание и синтез речи как отдельный сервис.

Wordstat и Search API

Отдельные сервисы Яндекса: Wordstat — частотность, динамика и регионы запроса; Search API — программное получение веб-выдачи.

OCR

Текст с фото, сканов и PDF. Отдельный сервис распознавания со своим API — не просьба к чат-модели «прочитай картинку».

Translate

Отдельный сервис машинного перевода с поддержкой глоссариев — когда важна единообразная терминология, а не пересказ смысла генеративной моделью.

Безопасная схема интеграции

  • Ключи — на сервере; в клиентский код, логи и репозитории они не попадают.
  • Для генеративных моделей AI Studio в production фиксируется версия, которую официальный список называет текущей; предрелизные — только в staging, deprecated — план миграции. У соседних сервисов своя схема версионирования.
  • Каждый структурированный ответ проходит валидацию по JSON Schema до использования — «обычно парсится» не контракт.
  • У моделей с управлением рассуждением бюджет вывода задаётся явно под задачу: простым — минимальное рассуждение и тесный лимит, сложным — осознанно щедрый.
  • Профильная задача идёт в профильный сервис: у OCR, перевода и речи документированный контракт ответа — там, где чат-модель даёт пересказ.
  • Перед релизом — повторная сверка списка моделей, цен и схем с официальной документацией: платформа развивается быстро.

Частые вопросы

Что такое Yandex AI Studio, если одним абзацем?

Платформа Яндекса для работы с генеративными моделями: чат-модели и генерация (включая семейство YandexGPT), embeddings для поиска и retrieval, realtime-интерфейсы речи. Рядом — отдельные сервисы Яндекса со своими API: Wordstat для статистики запросов, Search API для веб-выдачи, OCR для текста на изображениях, Translate для машинного перевода с управлением глоссариями и SpeechKit для распознавания и синтеза речи. Это не функции одного API AI Studio — страница сопоставляет задачу с нужной поверхностью, где бы та ни жила: внутри AI Studio или рядом.

Когда нужен Wordstat, Search API, OCR, Translate или SpeechKit, а не чат-модель?

Всегда, когда у задачи есть профильный сервис, — и каждый из них отдельный сервис Яндекса со своим API, а не функция AI Studio: Wordstat отвечает, как часто запрос ищут, с динамикой и разбивкой по регионам; Search API возвращает настоящую веб-выдачу; OCR читает текст с фото и сканов; Translate даёт машинный перевод с управлением глоссариями; SpeechKit превращает речь в текст и обратно. Чат-модель способна имитировать каждый из них — менее проверяемо и без опоры на реальные данные. Генеративная модель нужна там, где задача — генерация, рассуждение или преобразование текста, который вы ей дали.

Как безопасно выбрать версию модели?

Для генеративных моделей AI Studio официальный список моделей документирует версии и статусы жизненного цикла: какой релиз текущий, какой — release candidate, какой устарел. Для всего, от чего зависят пользователи, фиксируйте именно ту версию, которую официальный список называет текущей; предрелизные версии пробуйте только в staging; уведомление об устаревании воспринимайте как запланированную задачу миграции. Соседние сервисы (OCR, Translate, SpeechKit и другие) версионируются по-своему — сверяйтесь со справочником каждого API, а не предполагайте единую схему.

Как получить надёжный структурированный вывод?

Просите его явно и проверяйте локально: там, где модель и версия API поддерживают режим structured output с JSON Schema, используйте его — и в любом случае валидируйте каждый ответ по своей схеме до использования. JSON «по просьбе в промпте» — частая точка отказа: модель охотно заворачивает его в Markdown-ограждения или добавляет вежливое предложение сверху. Пара «схема плюс валидация» превращает «обычно парсится» в контракт.

Что такое бюджет рассуждения и вывода и зачем его задавать?

Генеративные модели тратят токены на ответ, а модели, у которых есть управление рассуждением, — ещё и на размышления до ответа. И то и другое расходует ваш лимит вывода, поэтому простая задача с тесным лимитом и включённым рассуждением может сжечь весь бюджет на скрытое мышление и вернуть почти пустой видимый текст. Там, где модель и API дают эти настройки, задавайте лимит вывода осознанно, для простых задач держите рассуждение выключенным или минимальным, а щедрые бюджеты оставьте задачам, которым многошаговое мышление действительно нужно.

Как выглядит безопасная первая интеграция?

Ключи на сервере и никогда в клиентском коде; версия модели, зафиксированная в конфигурации; валидация по схеме каждого структурированного ответа; явные лимиты вывода под каждую задачу; экспоненциальная пауза при ограничении частоты; логи с идентификаторами запросов, а не с пользовательским содержимым. Начните с одной узкой задачи, измерьте качество и стоимость на своих данных и только потом расширяйтесь: экосистема большая, и осваивать её по сервису за раз надёжнее, чем всю сразу.

Первоисточник — официальная документация Yandex AI Studio и смежных сервисов: списки моделей, алиасы, цены и лимиты меняются, сверяйтесь там перед стартом и перед релизом. Официальная документация.