Создавайте ИИ-приложения и агентов для решения ваших бизнес‑задач
Широкий ассортимент моделей
Платформа предлагает нейросети Яндекса нового поколения, а также передовые решения для синтеза и распознавания речи. Доступны и актуальные open-source LLM и VLM, например Qwen, OpenAI OSS и DeepSeek
Гибкие бизнес-сценарии
Выбирайте необходимые компоненты и создавайте собственные сервисы на основе ML-технологий для задач поддержки, продаж, HR, аналитики и других подразделений
Интеллектуальные текстовые и голосовые агенты
Агенты работают на сайтах, в чатах и мессенджерах, облегчая коммуникацию. Они удерживают контекст диалога и интегрируются с вашими базами знаний (RAG)
Удобные инструменты для разработчиков
Готовые API, SDK и другие инструменты для быстрой реализации приложений и внедрения агентских сценариев на базе генеративных моделей, интеллектуального поиска и речевых технологий
Закажите демонстрацию Yandex AI Studio!
Покажем интерфейс, ответим на ваши вопросы, проконсультируем по внедрению AI в бизнес-процессы вашей компании
Архитектура платформы Yandex AI Studio
Архитектура включает понятную пользовательскую оболочку, гибкую среду разработки, широкий выбор AI-моделей, удобные API-интерфейсы и надежный уровень безопасности.
Agent Atelier
Среда разработки ИИ-агентов с набором инструментов (Agent Tools), системой памяти, средствами поиска (AI Search), создания рабочих процессов (Workflows), интеграции (MCP Hub), и модулем работы с речью (SpeechKit). Есть интеграция с API для обработки запросов в реальном времени, хранения векторных данных и управления ответами.
UI & Console
Верхний уровень — это интерфейс для пользователей: Playground и no-code-интерфейс для быстрой сборки и тестирования агентов без программирования.
Model Gallery
Библиотека моделей — включает собственные модели Яндекса (Alice AI LLM, YandexGPT, YandexART, ASR/TTS, Vision OCR) и актуальные open-source модели (Qwen, Deepseek, Gemma и др.).
API-уровень
Доступ к возможностям платформы через API: Completion, Tuning, Batch и другие для интеграции и расширения функционала.
Слой безопасности
Все компоненты работают с обязательным обеспечением безопасности данных на уровне всей платформы.
ИИ-модели Yandex AI Studio
Alice AI LLM — это новая генеративная языковая модель Яндекса для AI Studio
Модель справляется с творческими задачами и эффективно работает в чатах, предоставляя развернутые и контекстные ответы. Используйте Alice AI LLM для создания виртуальных ассистентов и решения различных коммуникационных задач с помощью передовой нейросети Яндекса.
Генеративные модели Yandex AI Studio
| Название | Описание | Автор | Тип задачи |
|---|---|---|---|
| Alice AI LLM | Новая модель Alice AI LLM обладает высоким уровнем креативности и отлично поддерживает разговор на свободные темы в диалоговых сценариях. Она хорошо покажет себя в задачах маркетинга, коммуникаций и создания помощников, поддерживающих диалог с пользователями. При этом Alice AI LLM сохраняет преимущества предыдущей версии YandexGPT, показывая прекрасные результаты при работе с поиском и генерации ответов по базам знаний. | Yandex | text-generation |
| YandexGPT 4 Lite | Облегчённая версия модели YandexGPT 4, предназначенная для быстрого вывода и развертывания на ограниченных ресурсах. Длина контекста 8К. | Yandex | text-generation |
| YandexGPT 5 Lite | Новая облегчённая языковая модель от Yandex, с улучшенным качеством генерации и понимания текста. | Yandex | text-generation |
| YandexGPT 5 Pro | Продвинутая версия YandexGPT пятого поколения, рассчитанная на корпоративные и научные задачи, поддерживает сложное рассуждение, анализ длинных документов, генерацию осмысленного текста и диалогов, многоуровневые рассуждения и обработку больших данных. | Yandex | text-generation |
| YandexGPT 5.1 Pro | Продвинутая версия YandexGPT пятого поколения, рассчитанная на корпоративные и научные задачи, поддерживает сложное рассуждение, анализ длинных документов, генерацию осмысленного текста и диалогов, многоуровневые рассуждения и обработку больших данных. | Yandex | text-generation |
| Qwen2-VL-7B-Instruct | Мультимодальная версия Qwen2 с 7 миллиардами параметров предназначена для работы с текстом и изображениями. Модель позволяет создавать компактные мультимодальные ассистенты и корпоративные сервисы. Основное направление использования — визуальный вопросно-ответный анализ (VQA) и создание подписей к изображениям (captioning). Длина контекста 32K | Alibaba | text-generation |
| Qwen2.5 7B Instruct | Компактная версия Qwen2.5, оптимизированная для малого и среднего бизнеса, мобильных приложений и диалоговых ассистентов. Хорошо понимает инструкции, генерирует лаконичные тексты. Длина контекста 128K | Alibaba | text-generation |
| Qwen2.5 32B Instruct | Большая языковая модель от Alibaba с 32 млрд параметров. Она специально обучена для выполнения инструкций и ведения диалогов. Модель используется для создания ассистентов, корпоративных агентов и глубокой аналитики. Длина контекста 128K | Alibaba | text-generation |
| Qwen2.5 72B Instruct | Самая большая версия Qwen2.5 (72 млрд параметров), предназначена для задач, требующих рассуждений. Длина контекста 128K | Alibaba | text-generation |
| Qwen2.5 VL 7B Instruct | Компактная мультимодальная модель для решения задач визуального вопросно-ответного анализа (VQA), создания подписей к изображениям (captioning) и ассистирования. Модель нацелена на эффективное использование памяти и быструю генерацию мультимодальных ответов. Длина контекста 128K | Alibaba | text-generation |
| Qwen2.5 VL 32B Instruct | Мультимодальная модель с 32 млрд параметров, которая работает с текстом и изображениями. Она предназначена для решения сложных задач, анализа изображений, визуального вопросно-ответного анализа (VQA) и создания подписей к изображениям (captioning). Длина контекста 128K | Alibaba | text-generation |
| Qwen3 0.6B | Базовая модель нового поколения Qwen3 с 600 млн параметров. Поддерживает переключение между обычным режимом генерации и режимом рассуждений. Длина контекста 32 768 | Alibaba | text-generation |
| Qwen3 1.7B | Небольшая модель Qwen3, поддерживает переключение между обычным режимом генерации и режимом рассуждений. Длина контекста 32 768 | Alibaba | text-generation |
| Qwen3 4B | Компактная версия Qwen3 для чатов и аналитики в небольших системах. Длина контекста 128K | Alibaba | text-generation |
| Qwen3 8B | Модель Qwen3 с 8 млрд параметров для работы с текстом. Длина контекста 128K | Alibaba | text-generation |
| Qwen3 30B A3B | Продвинутая генеративная языковая модель среднего размера (30 млрд параметров) с поддержкой режима рассуждений. Применяется в аналитике и для создания сложных ассистентов. Длина контекста 128K | Alibaba | text-generation |
| Qwen3 32B | Модель Qwen3 с 32 млрд параметров. Длина контекста 128K | Alibaba | text-generation |
| Qwen3 235B A22B | Одна из крупнейших языковых моделей с 235 миллиардами параметров. Она обучена для выполнения сложных задач, требующих рассуждений, анализа и генерации в корпоративных и научных сценариях. Длина контекста 128K | Alibaba | text-generation |
| Qwen3 235B A22B Instruct 2507 FP8 | FP8-оптимизированная версия Qwen3 235B со сниженными требованиями к ресурсам. | Alibaba | text-generation |
| Qwen3-14B | Средняя по размеру модель семейства Qwen3, предназначена для диалогов, рассуждений и задач анализа. Длина контекста 32 768, зависит от инференса | Alibaba | text-generation |
| Qwq-32B | Специализированная модель семейства Qwen (32 млрд параметров), предназначена для ассистентов, анализа и сложных генеративных сценариев, поддерживает большой контекст и быструю обработку информации. Длина контекста 128K | Alibaba | text-generation |
| DeepSeek VL2 | Визуально-языковая мультимодальная модель для анализа изображений, генерации изображений и текста по изображениям. Преимущества: работа с изображениями любых размеров, мультимодальный контекст. Длина контекста 32K. | DeepSeek | text-generation |
| DeepSeek VL2 Tiny | Облегчённая версия мультимодальной модели DeepSeek-VL2, разработана для устройств с ограниченными ресурсами и быстрого применения. При этом модель сохраняет ключевые мультимодальные возможности: визуальный анализ, генерацию текста по изображениям. Преимущества: компактность, скорость, мультимодальный ввод. Длина контекста 32K | DeepSeek | text-generation |
| DeepSeek R1 Distill Qwen 32B | Высокопроизводительная дистиллированная и оптимизированная модель на базе Qwen-32B. К преимуществам модели относят ускоренный вывод, качество генерации и поддержку коммерческой эксплуатации. | DeepSeek | text-generation |
| Gemma 3 1B IT | Компактная версия модели Gemma, всего 1 млрд параметров. Максимально быстрая и оптимизированная для запуска на устройствах с ограниченными ресурсами, подходит для мобильных и встраиваемых платформ, чат-ботов и простых ассистентов. Контекст 8K | text-generation | |
| Gemma 3 4B IT | Языковая модель среднего размера с 4 миллиардами параметров обеспечивает баланс между производительностью и эффективным использованием ресурсов. Она подходит для приложений с ограниченными вычислительными мощностями и памятью, но при этом требующих высокого качества генерации. Модель используется для диалогов, генерации текста, поиска и креативных задач. Контекст 8K | text-generation | |
| Gemma 3 12B IT | Языковая модель Google с 12 млрд параметров, обученная специально для интерактивных приложений (instruction tuning). Обеспечивает высокое качество генерации, хорошие способности к обобщению и универсальность: подходит для диалоговых ассистентов, генерации, анализа и обобщения больших текстов. Контекст 8K | text-generation | |
| DeepSeek R1 Distill Llama 70B | Оптимизированная дистиллированная версия Llama-70B, разработанная для высокой скорости и эффективности при сохранении качества вывода. Модель подходит для широкого спектра языковых задач, чата и генерации кода в коммерческих и исследовательских проектах. Контекст до 32K | Meta Meta признана экстремистской организацией, её деятельность в России запрещена. | text-generation |
| Llama 3.1 70B Instruct | Версия Llama 3.1 с 70 млрд параметров, обученная для выполнения диалоговых и интерактивных инструкций. Подходит для ассистентов, генерации, корпоративных агентов и автоматизации сложных процессов. Преимущества: масштабируемая генерация, улучшенная логика и длинный контекст. Длина контекста 8K | Meta Meta признана экстремистской организацией, её деятельность в России запрещена. | text-generation |
| Phi-4 | Современная открытая модель, обученная на синтетических наборах данных, информации с отфильтрованных веб-сайтов. Модель подойдет для анализа данных и создания ассистентов. Длина контекста 16K | Microsoft | text-generation |
| GPT OSS 20B | Для снижения задержки и локальных или специализированных сценариев использования (21 млрд параметров, 3,6 млрд активных параметров). | OpenAI | text-generation |
| GPT OSS 120B | Для производственных, общецелевых и ресурсоемких сценариев использования (117 млрд параметров, 5,1 млрд активных параметров). | OpenAI | text-generation |
| T-pro-it-2.0-FP8 | Это открытая крупная языковая модель на 32 млрд параметров, разработанная группой «Т-Технологии». Она доступна под лицензией Apache 2.0, что позволяет свободно использовать, адаптировать и дообучать её на собственных данных. | T-tech | text-generation |
| Yandex Text embeddings (doc) 1 | Векторизация больших текстов исходных данных, например статей документации. | Yandex | feature-extraction |
| Yandex Text embeddings (query) 1 | Векторизация коротких текстов: поисковых запросов, обращений и т.п. | Yandex | feature-extraction |
| Yandex Text embeddings 1 | Дообученные модели эмбеддингов | Yandex | feature-extraction |
| YandexART | Мультимодальная модель от Yandex, предназначена для создания изображений и визуального контента по текстовому описанию. | Yandex | text-to-image |
| Gemma 3 27B IT | Одна из наиболее мощных моделей серии Gemma с 27 млрд параметров. Модель предназначена для решения сложных задач, требующих рассуждений, анализа и генерации сложных инструкций. | image-text-to-text |
Другие ИИ-модели
- Классификаторы
- Эмбеддеры
- Реранкеры
- Токенизаторы
- Qwen3 235B
- OpenAI OSS 120B
- OpenAI OSS 20B
- Gemma 27B VL
- QwQ 32B
Создавайте собственные модели с нуля или дообучайте готовые LLM, используя инструменты кастомизации и тонкой настройки.
Agent Atelier — платформа для создания агентов
В среде Agent Atelier агенты проектируются не по шаблону, а настраиваются под индивидуальные задачи вашего бизнеса — в гибкой среде разработки вы сможете реализовать уникальные решения.
MCP Hub — это инструмент AI Studio для создания, управления и мониторинга MCP-серверов, которые пополняются за счет обратной связи пользователей и имеют все самые распространенные запросы. С помощью MCP Hub можно как подключать сторонние MCP-серверы, так и развертывать свои собственные — с нуля или на основе готовых шаблонов. В состав платформы входит MCP Builder — low-code-инструмент для разработки собственных серверов, а также средства для мониторинга стабильности работы и управления обращениями к подключённым серверам.
Набор готовых инструментов для выбора и настройки параметров моделей, интеграции поиска по корпоративным данным (RAG) и в интернете, а также для подключения внешних сервисов и систем. Дополнительно обеспечивается поддержка расширения функциональности агентов и упрощённая интеграция с бизнес-процессами.
Безкодовые сценарии автоматизации: вместо сложной программирования — удобный drag-and-drop интерфейс и простая логика для управления действиями агентов.
Возможности Workflows включают:
- наглядное создание последовательностей шагов;
- поддержка ветвлений, условий и циклов;
- построение многоагентных пайплайнов;
- интеграция с внешними сервисами и обработка событий;
- быстрый запуск и масштабирование процессов под задачи бизнеса.
Интеллектуальная система поиска, обеспечивающая агентам доступ к нужной информации как во внутренних корпоративных данных, так и в интернете:
- поиск по корпоративным файлам всех популярных форматов (PDF, PPTX, Excel, DOCX и др.), с пониманием смысла запросов, даже если они сформулированы иначе;
- внешний поиск через Yandex Search API с использованием актуальных интернет-источников;
- поддержка сложных документов — специальные парсеры извлекают данные из таблиц, схем и визуального контента.
Голосовые технологии для агентов на базе SpeechKit и современных инструментов:
- STT (Speech-to-Text): мгновенное распознавание речи;
- TTS (Text-to-Speech): естественный синтез голоса с поддержкой нужной интонации;
- Brand Voice: настройка уникального фирменного голоса компании, включая self-service режим;
- Realtime API: создание голосовых агентов, которые понимают и отвечают в режиме реального времени, с минимальной задержкой;
- Преобразование, анализ и суммаризация речи по заданным шаблонам.
API для разработчиков
Responses API
API для текстовых сценариев: агенты учитывают контекст переписки, могут автоматически вызывать подключенные инструменты и поддерживают работу с любыми моделями.
Realtime API
API для реализации голосовых сценариев: агенты способны взаимодействовать с пользователями в голосовом и текстовом форматах и поддерживают диалог, максимально приближенный к естественной человеческой коммуникации.
Vector Store API
Работа с векторными базами данных
Completion API
Генерация текстов по запросу
Yandex Search API
Поиск информации в интернете
Tuning API
Дообучение моделей методом LoRA
Batch API
Пакетная обработка больших объемов данных
Yandex AI Studio уже используют