Высокоскоростной inference API на инфраструктуре Groq
- Русский
- API
- Бесплатный тариф
AI Gateway, наблюдаемость и защитные правила для LLM-приложений
Обновлено
Сведения о доступности и функциях проверены 16.07.2026 по официальному источнику.
Portkey — самостоятельная инфраструктурная платформа для подключения приложений к нескольким поставщикам моделей через единый AI Gateway. Она добавляет маршрутизацию и fallback, кеширование, повторные попытки, логи и метрики, guardrails, управление промптами и правила доступа; ядро gateway также доступно с открытым кодом.
Разработчик направляет OpenAI-совместимый клиент на endpoint Portkey, хранит ключи провайдеров в защищённом контуре и задаёт конфигурацию маршрутизации, бюджета и fallback. Затем команда проверяет сбои и задержку на тестовом трафике, редактирует чувствительные поля в логах и постепенно включает guardrails и кеширование. Рабочий процесс стоит начинать с небольшого теста и заранее определённого критерия качества. Команде полезно зафиксировать владельца результата, права доступа, допустимые автоматические действия и способ возврата к исходным данным. Сгенерированные ответы, прогнозы, черновики или автоматические действия нельзя считать достоверными без проверки человеком и сверки с первичным источником.
Developer бесплатен и включает 10 000 записанных логов в месяц. Production стоит $49 в месяц и включает 100 000 логов, а каждые дополнительные 100 000 стоят $9. Enterprise рассчитывается по запросу; open-source gateway можно развернуть самостоятельно, оплачивая свою инфраструктуру. Тариф, названия планов и единица расхода сверены только с официальным материалом вендора 16 июля 2026 года. Если публичная страница не раскрывает числовую сумму, карточка честно указывает «по запросу» или «цена в аккаунте». Перед оплатой нужно повторно проверить валюту, налоги, период списания, лимиты, число мест и правила возврата.
Portkey подходит продуктовым командам, которым нужен единый слой управления несколькими модельными API и централизованная наблюдаемость. Gateway становится критическим компонентом, поэтому до production нужно проверить поведение при отказе, пределы задержки, хранение payload и возможность прямого обходного маршрута. При внедрении важно проверить экспорт, хранение и удаление данных, список субпроцессоров, права на загружаемый контент и условия коммерческого использования результата. Стабильная работа из России официально не гарантирована и может зависеть от региона аккаунта или сети. Оплата картой российского банка официально не подтверждена. Для интеграции заявлен официальный API, SDK или документированный программный интерфейс. Поддержка русского результата и полная русская локализация отмечаются раздельно. Карточка описывает самостоятельный продукт и его основную функцию на дату проверки, не создавая отдельную сущность для вторичного AI-режима. Функции, цены и региональные ограничения могут измениться, поэтому перед рабочим запуском нужен повторный контроль официальной документации.
Точные лимиты и состав тарифов уточняйте на сайте сервиса — цены могут меняться.
Высокоскоростной inference API на инфраструктуре Groq
Serverless Python, GPU, inference и пакетные задания
Платформа экспериментов, артефактов и оценки AI-систем
Open-source фреймворк для приложений с языковыми моделями
Графовая оркестрация долгоживущих AI-агентов
Open-source наблюдаемость, оценки и промпты для LLM-приложений