ИИ-шлюзы для агентов программирования: что выбрать команде
ИИ-шлюзы для агентов программирования: сравниваем цены Vercel, Requesty, LiteLLM, OpenRouter, Portkey и Cloudflare, маршрутизацию и правила выбора.

Если сравнивать ИИ-шлюзы для агентов программирования, Vercel AI Gateway — лучший выбор для большинства команд: теперь одна команда настраивает девять агентов, а на базовом тарифе на токены нет наценки. При ежемесячных расходах на модели в $2,000 комиссия шлюза составит $0 у Vercel, $100 у Requesty и $110 у OpenRouter — ещё до подключения дополнительных средств контроля. Поэтому такой выбор уже нужно учитывать в инженерном бюджете, а не относить к экспериментам.
Какие ИИ-шлюзы для агентов программирования выбрать: короткий ответ
По умолчанию выбирайте Vercel AI Gateway, если только требования к развёртыванию, атрибуции расходов или корпоративному управлению не указывают на другой вариант. Сейчас это самый прямой путь от разрозненных настроек Claude Code, Codex, Cursor и OpenCode к единому счёту за модели, общей схеме резервного переключения и одной картине расходов.
От Vercel стоит отказаться в пяти чётко определённых случаях. Выбирайте Requesty, когда финансам важно знать, какой репозиторий, ветка или разработчик создали расходы. Выбирайте LiteLLM, если трафик моделей и ключи провайдеров должны оставаться в вашей инфраструктуре. Выбирайте OpenRouter, если доступ к максимально широкому каталогу моделей и провайдеров важнее настройки под конкретные агентские инструменты. Выбирайте Portkey, когда бюджет выделен именно на управляемые защитные правила, автоматические выключатели и политики. Выбирайте Cloudflare AI Gateway, если Workers, журналы Cloudflare и средства безопасности Cloudflare уже образуют ваш контур управления.
ИИ-шлюз — это уровень управления между агентом программирования и провайдерами моделей. Агент по-прежнему планирует работу, редактирует файлы, выполняет команды и вызывает инструменты. Шлюз определяет, куда направить запрос к модели, сколько он может стоить, какой провайдер его получит, что произойдёт после тайм-аута и какие данные попадут в журнал.
Это принципиальное различие. Шлюз не улучшит слабую модель для программирования, не исправит неудачный файл с инструкциями к репозиторию и не проведёт ревью небезопасного кода. Зато он способен не дать сбою у провайдера оборвать долгий запуск, ограничить вышедший из-под контроля ключ и показать, что ветка миграции израсходовала на модели в четыре раза больше, чем обычное исправление ошибки. Покупать его стоит ради контроля, а не ради интеллекта.
Почему шлюз для ИИ-агентов становится отдельной статьёй бюджета
Агенты программирования превращают небольшое решение о маршрутизации в вопрос операционных расходов, потому что одна задача может породить целую цепочку обращений к моделям. Для ответа в чате порой достаточно одного запроса. Агент же может изучить репозиторий, найти символы, предложить патч, запустить тесты, прочитать сообщения об ошибках, переработать патч и передать результат более сильной модели на ревью.
Производственный индекс Vercel показал, что 22.2% запросов содержали 58.9% всех токенов: запросы с вызовом инструментов оказались примерно в 2.6 раза тяжелее по токенам, чем остальной трафик. В том же наборе данных резервное переключение спасло 3.5% запросов. Если бы нагрузка из 10,000 запросов повторяла эту общую картину, около 350 запросов завершились бы через резервный маршрут, а не оборвались у первого провайдера. Это лишь иллюстрация, а не обещанный процент спасённых запросов для другой нагрузки, но она показывает, почему надёжность нужно оценивать вместе с ценой модели.
Базовую стоимость шлюзов проще сравнивать, если зафиксировать исходный счёт за модели. При инференсе по ценам провайдеров на $2,000 в месяц:
- Vercel добавляет к стоимости токенов $0.
- Наценка Requesty в 5% добавляет $100.
- Комиссия OpenRouter Pay as you go в 5.5% добавляет $110.
- Cloudflare Unified Billing добавляет $100, если покупать кредиты через этот сервис.
- Portkey начинается с $49 в месяц за 100,000 записанных логов — здесь используется другая единица тарификации, не расходы на токены.
- Лицензия LiteLLM с открытым исходным кодом добавляет $0, но за хостинг и рабочее время специалистов отвечаете вы.

Разница в процентах — не единственный критерий. Дополнительные $100 за Requesty могут оказаться небольшой платой, если атрибуция по веткам не позволит одному неконтролируемому репозиторию потратить гораздо больше. $49 за Portkey могут быть оправданы, если автоматический выключатель сохранит рабочий процесс выпуска. А нулевая стоимость лицензии LiteLLM обойдётся дорого, если инженер платформы навсегда станет дежурным по этому прокси.
Шлюз должен снижать стоимость смены моделей, провайдеров и агентских инструментов. Если он лишь заменяет шесть счетов от провайдеров седьмым счётом, своё место в архитектуре он не оправдывает.
Как отбирались ИИ-шлюзы
Эти шесть решений оценивались по задачам, которые создают агенты программирования, а не по универсальному списку функций API. Цены и страницы продуктов были проверены 15 августа 2026 года. В рамках этой работы сервисы не испытывались в промышленной эксплуатации, поэтому рейтинг основан на актуальной документации, приведённом к общей базе анализе стоимости и последствиях границ каждого продукта.
Порядок определяют шесть критериев:
- Настройка агентских инструментов: шлюз, для которого документирована работа с Claude Code, Codex, Cursor и похожими агентами, несёт меньше интеграционных рисков, чем сервис, предлагающий лишь OpenAI-совместимую конечную точку.
- Надёжность маршрутизации: порядок провайдеров, тайм-ауты, повторные попытки, резервные модели и автоматические выключатели важны, потому что длинная цепочка действий агента может оборваться на последнем обращении к модели.
- Прозрачность расходов: затраты на модели должны быть привязаны к ключу, агенту, репозиторию, разработчику, команде или политике, а не сливаться в единую неразличимую сумму за токены.
- Управление политиками: списки разрешённых провайдеров и одобренных моделей, бюджеты, правила хранения данных и журналы аудита определяют, сможет ли команда выйти за рамки личных экспериментов.
- Нагрузка от развёртывания: управляемые шлюзы берут деньги за снятие операционных задач. При самостоятельном размещении плата за платформу исчезает, но доступность, обновления, хранение данных и реагирование на инциденты возвращаются покупателю.
- Актуальная цена: все тарифы и лимиты взяты с действующих страниц поставщиков. Цены инференса моделей исключены из рейтинга, поскольку они зависят от модели и провайдера, а в этом сравнении исходный счёт остаётся постоянным.
Helicone рассматривался, но в рейтинг не вошёл. Это сильный продукт для наблюдаемости с функциями шлюза, однако его главное преимущество — трассировка и анализ, а не широкая поддержка настройки агентских инструментов. Обычные API-шлюзы тоже были исключены. Они умеют проксировать HTTP-трафик, но агентам программирования нужны резервные маршруты с учётом моделей, бюджеты токенов, контроль промптов и ответов, а также совместимость с несколькими протоколами обмена.
В итоге получился короткий список с жёсткими правилами выбора. У каждого продукта ниже есть задача, в которой он побеждает, и граница, после которой разумнее купить другое решение.
1. Vercel AI Gateway: лучший ИИ-шлюз в целом
Vercel AI Gateway — лучший вариант по умолчанию, потому что устраняет сложности настройки, из-за которых шлюзы раньше редко использовали в личных процессах с агентами программирования. Текущий CLI умеет создать ключ, показать предварительный просмотр изменений конфигурации и настроить девять поддерживаемых агентов командой vercel ai-gateway coding-agents setup.

В актуальной таблице поддержки перечислены Claude Code, Cline, OpenAI Codex, Cursor, Hermes, Kilo Code, OpenClaw, OpenCode и Pi. Для дополнительных инструментов Vercel также описывает ручную настройку. Claude Code, Codex и Cursor получили отдельные конечные точки совместимости, поскольку особенности их протоколов не укладываются в универсальный OpenAI-совместимый интерфейс. Именно эта функция меняет решение о покупке: шлюз больше не является только инфраструктурой за приложением, которое вы разработали сами. Его можно поставить за инструментами программирования, которыми инженеры уже пользуются.
Для продуктовой команды из 12 человек это означает единый бюджет и общую политику резервного переключения при разных стилях работы. Один инженер может остаться в Claude Code, другой — запускать Codex из терминала, а третий — пользоваться Cursor. Все их запросы по-прежнему попадут в единое представление расходов, и компании не придётся навязывать всем один редактор или одну лабораторию моделей.
Лучше всего подходит для: команд с несколькими агентами программирования, которым нужна максимально быстрая управляемая настройка
Главное преимущество: единый процесс CLI для девяти поддерживаемых агентов и отдельные конечные точки для Claude Code, Codex и Cursor
Цена: ежемесячный бесплатный кредит $5; платный инференс по прейскуранту провайдера без наценки на токены
Бесплатный доступ: постоянный бесплатный тариф для подходящих моделей, а не ограниченный по времени пробный период
Базовый тариф устроен необычно прозрачно. На действующей странице цен Vercel указано, что на токены нет ни наценки, ни платформенной комиссии. Бесплатный тариф включает ежемесячный кредит $5, ограниченный набор подходящих моделей и более низкие лимиты для каждой модели. После покупки кредитов аккаунт переходит на Pay as you go и ежемесячный бесплатный кредит исчезает. Bring Your Own Key доступен только после перехода на платный тариф, при этом отдельной комиссии за BYOK у Vercel нет.
Есть две оговорки. Во-первых, нулевая наценка относится к токенам, но не ко всем средствам контроля. Общий для команды список разрешённых провайдеров и общее для команды нулевое хранение данных стоят по $0.10 за 1,000 запросов. Выгрузка трейсов стоит $0.05 за 1,000 трейсов плюс $0.50 за GB исходящего трафика. У пользовательской отчётности есть собственные тарифы на запись и запросы. Небольшая команда может почти всё это не подключать, а регулируемой организации следует учесть такие расходы до того, как объявлять шлюз бесплатным.
Во-вторых, неудачный запрос с BYOK может быть повторён с системными учётными данными Vercel, а резервное использование спишется с кредитного баланса шлюза. Это разумный способ повысить надёжность, но в бюджете появляется пограничный случай. Если финансовый отдел ожидает, что каждый запрос останется в рамках существующего контракта с провайдером, резервный маршрут нужно проверить, а не считать очевидным.
Возможностей маршрутизации хватает большинству продуктовых команд. Vercel документирует фильтрацию, порядок и сортировку провайдеров, автоматическое кэширование, тайм-ауты провайдеров и резервные модели. Обычный трафик дополнения кода можно направить предпочтительному провайдеру, при превышении допустимой задержки быстро переключиться, а более дорогую модель оставить последним резервным вариантом.
Главное ограничение связано с владением развёртыванием. Vercel AI Gateway — управляемый сервис. Он не подходит команде, которой необходимо запускать процесс шлюза, базу данных, ключи и журналы внутри собственной сети. При таком требовании LiteLLM выигрывает ещё до сравнения функций.
- Одна документированная команда настройки для девяти агентов программирования
- Отдельные конечные точки совместимости для Claude Code, Codex и Cursor
- Нулевая наценка и отсутствие платформенной комиссии на токены
- Порядок провайдеров, тайм-ауты, кэширование и резервные модели
- Единый счёт и представление расходов для 200+ моделей
- Нет варианта самостоятельного размещения шлюза
- BYOK доступен только на платном тарифе
- Расширенная отчётность, трейсы, списки разрешённых сервисов и общее для команды ZDR тарифицируются отдельно
- После создания ключа через CLI настройки аккаунта Cursor всё равно приходится завершать вручную
Как настроить Vercel AI Gateway, не превращая миграцию в отдельный проект
Самый безопасный сценарий сохраняет прямой маршрут к провайдеру для отката и начинается с одного репозитория. Не переводите сразу всех разработчиков и все агентские инструменты.
Создайте отдельный ключ для пилота
Создайте один ключ шлюза для пилотного репозитория и установите для него недельный или месячный бюджет. Не используйте общий ключ корпоративного приложения: циклам агентов программирования нужен собственный предел расхода.
Выполните документированную команду настройки
Запустите
vercel ai-gateway coding-agents setup. Позвольте CLI обнаружить установленных агентов, выберите только пилотные инструменты и изучите показанную разницу до подтверждения любых изменений конфигурации.Оставьте одну основную и одну резервную модель
Начните с модели, которой команда уже доверяет. Добавьте одного резервного провайдера или одну модель с сопоставимым поведением при вызове инструментов. В большом дереве маршрутизации сложнее объяснить причину неудачного запуска.
Проверьте идентификаторы и метки расходов
Выполните по одной ограниченной задаче из каждого настроенного агента. Убедитесь, что панель показывает агента, модель, провайдера, число токенов, стоимость, задержку и статус резервного переключения именно так, как ожидает покупатель.
Сохраните прямой маршрут
Оставьте прежнюю конфигурацию провайдера в документированном файле для отката. Если шлюз изменит вызов инструментов, обнаружение моделей или задержку, пилот должен откатываться за считаные минуты.
2. Requesty: лучшая атрибуция расходов по веткам, репозиториям и разработчикам
Requesty — лучший шлюз, когда руководителю разработки нужно связать расходы на модели с работой, которая их создала. Интеграция с Claude Code умеет размечать запросы по ветке, репозиторию, разработчику и версии агента, превращая счёт за токены в данные, которые команда действительно может анализировать.

Для команд, где параллельно идут миграции, работа над функциональными ветками и автоматические ревью, такая атрибуция полезнее низкой комиссии. Например, команда B2B SaaS может обнаружить, что фоновое ревью обходится дёшево, а цикл исправления тестов в одном репозитории съедает основную часть месячного бюджета. Тогда и реакция будет адресной: скорректировать политику для конкретного репозитория или модели, а не урезать доступ всем разработчикам.
Лучше всего подходит для: команд, которым нужно учитывать расходы агентов программирования по веткам, репозиториям или разработчикам
Главное преимущество: аналитические метки Claude Code, политики маршрутизации, хранение данных в EU и MCP-шлюз
Цена: $0 для бесплатных моделей; Pay as you go добавляет 5% к базовой стоимости моделей; Enterprise рассчитывается индивидуально
Бесплатный доступ: бесплатный тариф с 200 запросами в день без банковской карты
На текущей странице цен Requesty указаны 600+ моделей от 20+ провайдеров. В Pay as you go нет абонентской платы, оплаты за место, минимальных расходов или отдельной комиссии за маршрутизацию, кэширование, резервное переключение и хранение данных в EU. При ежемесячном инференсе по ценам провайдеров на $2,000 наценка 5% составит $100.
Эти $100 легко обосновать, если метаданные предотвращают более крупный неконтролируемый запуск или позволяют распределить затраты. Для одиночного разработчика, которому нужен лишь другой базовый URL, аргумент заметно слабее. OpenRouter заявляет более широкий каталог, а Vercel предлагает поддерживаемым агентам более прямой маршрут без наценки.
Тариф Requesty Enterprise добавляет SSO, RBAC, журналы аудита, политики одобренных моделей, обнаружение PII, групповые бюджеты, сервисные аккаунты для CI/CD и индивидуальные SLA. Благодаря этому продукт подходит более крупным инженерным организациям, но цена рассчитывается отдельно. Сравнить Enterprise без коммерческого предложения и репрезентативного профиля запросов команда не сможет.
Следует учитывать расхождение в документации. На странице коммерческих тарифов указано 600+ моделей, тогда как страница интеграции с Claude Code, изменённая 10 августа 2026 года, всё ещё говорит о 300+ моделях. Для платного каталога здесь используется более крупное число, поскольку именно действующая страница цен определяет предложение. Но из-за несоответствия покупателю стоит проверить нужные модели в библиотеке аккаунта, а не принимать любой из заголовков за гарантию.
Настройка Claude Code у Requesty охватывает меньше инструментов, чем многоагентный CLI Vercel, зато даёт более глубокую атрибуцию. CLI Requesty может записать конфигурацию Claude и создать резервную копию существующего файла. Дополнительная shell-обёртка при запуске сеанса подставляет заголовки с репозиторием, веткой, пользователем и версией агента. Обёртка видна в конфигурации shell, а перед отправкой запроса провайдеру модели эти заголовки удаляются.
Главное ограничение — процентная тарификация. Наценка 5% растёт вместе с расходами на модели, даже если объём работы самого контура управления шлюза не меняется. При $20,000 в месяц это уже $1,000. Крупному покупателю стоит сравнить такой счёт с подпиской Portkey, операционными расходами LiteLLM и индивидуальным предложением Requesty Enterprise.
- Атрибуция расходов по ветке, репозиторию, разработчику и версии агента
- 200 бесплатных запросов в день к бесплатным моделям
- Маршрутизация, кэширование, резервное переключение, лимиты расходов и хранение данных в EU на Pay as you go
- MCP-шлюз и сервисные аккаунты для CI/CD
- Нет подписки, платы за места или минимальных расходов в Pay as you go
- Наценка 5% растёт прямо пропорционально расходам на инференс
- Цена Enterprise доступна только по запросу
- Настройка нескольких агентов объединена хуже, чем в CLI Vercel для девяти агентов
- Действующие страницы расходятся в оценке каталога: 300+ или 600+ моделей
3. LiteLLM: лучший ИИ-шлюз для самостоятельного размещения
LiteLLM — лучший выбор, когда контроль над развёртыванием и данными важнее удобства. Его прокси с открытым исходным кодом можно бесплатно разместить самостоятельно для промышленной эксплуатации, объединив 100+ провайдеров за одним OpenAI-совместимым API.

Для технического директора компании среднего размера с закрытым сетевым периметром преимущество очевидно: ключи моделей, трафик запросов, виртуальные ключи, бюджеты, журналы и метрики Prometheus находятся в инфраструктуре самой компании. По заявлению LiteLLM, самостоятельно размещаемый продукт не видит данные или трафик клиента. Таким образом, управляемый шлюз исключается из тракта модельных данных.
Лучше всего подходит для: платформенных команд, которым нужен самостоятельно размещаемый или изолированный от сети доступ к моделям
Главное преимущество: бесплатный прокси с открытым исходным кодом, 100+ провайдеров, виртуальные ключи, бюджеты, резервное переключение и Prometheus
Цена: open source за $0; Enterprise оплачивается ежегодно, а цена зависит от мощности и способа развёртывания
Бесплатный доступ: пробный Enterprise на 30 дней без банковской карты; версия с открытым исходным кодом остаётся бесплатной
Цена программного обеспечения здесь самая понятная во всём обзоре — и именно её чаще всего понимают неверно. Шлюз с открытым исходным кодом стоит $0, в том числе при промышленном использовании. В него входят пользователи и команды, учёт расходов, ограничения частоты, журналирование запросов и ответов, а также резервное переключение LLM. Лицензионной платы LiteLLM за каждый токен нет.
Но стоимость эксплуатации не равна $0. Кто-то должен развернуть прокси, управлять его базой данных и секретами, масштабировать и отслеживать его, обновлять при изменениях API провайдеров, сохранять журналы, проверять резервные маршруты и реагировать, когда шлюз становится общей точкой отказа. LiteLLM заменяет счёт поставщика инфраструктурной ответственностью. Для платформенной команды это может быть выгодным обменом, а для стартапа из пяти человек — плохим.
Enterprise добавляет SSO, SCIM, аутентификацию OIDC или JWT, журналы аудита, интеграции с хранилищами секретов, ротацию ключей, средства управления организацией, мультирегиональный контур управления, поддержку, SLA и развёртывание без доступа к внешней сети. Цена годовая и зависит от пропускной способности запросов, архитектуры развёртывания и поддержки, а не от числа токенов. Эта граница важна: регулируемая компания может начать с open source, но перейти на Enterprise, как только обязательными станут управление идентификацией, аудит или круглосуточная поддержка.
У LiteLLM есть два интерфейса продукта, которые покупатели часто смешивают. Python SDK — библиотека для приложения. Proxy Server — централизованный шлюз с аутентификацией, многопользовательским учётом расходов, виртуальными ключами и панелью администратора. При внедрении агентов программирования с общей политикой следует оценивать прокси, а не просто добавлять SDK в несколько скриптов.
Слабое место для агентов программирования — документация и ответственность за эксплуатацию. LiteLLM даёт совместимую конечную точку, к которой способны обращаться многие агенты, но не предлагает единого актуального установщика Vercel для девяти названных инструментов. Переменные окружения, формат ответа, обнаружение моделей и работа с инструментами каждого агента всё равно требуют проверки. Поведение Responses API у Codex и протокол Anthropic у Claude Code заслуживают отдельных пилотных тестов.
- Лицензия open source за $0 для самостоятельного размещения в промышленной среде
- 100+ провайдеров через единый OpenAI-совместимый API
- Виртуальные ключи, бюджеты, лимиты частоты, резервное переключение, журналы и метрики Prometheus
- Трафик и ключи остаются в инфраструктуре, которой управляет клиент
- Переход на Enterprise для идентификации, аудита, изолированной среды, поддержки и мультирегионального управления
- Покупатель отвечает за доступность, обновления, хранение, масштабирование и инциденты
- Цена Enterprise не публикуется
- Настройка конкретных агентских инструментов упакована хуже, чем у Vercel
- При небрежном развёртывании централизованный прокси может стать новой внутренней областью отказа
4. OpenRouter: лучший выбор моделей и быстрые эксперименты
OpenRouter — лучший шлюз для сравнения широкого рынка моделей через один аккаунт. На актуальной странице Pay as you go перечислены 500+ моделей от 80+ провайдеров — самый широкий опубликованный каталог в этом списке.

Такой выбор полезен самостоятельному техническому специалисту или небольшой команде, активно занимающейся исследованиями. Агент программирования может сравнить передовую модель для планирования работы с репозиторием, более быструю — для поиска и классификации, а открытую — для рутинных преобразований, не создавая платёжный аккаунт у каждого провайдера.
Лучше всего подходит для: быстрого сравнения моделей и доступа к широкому рынку провайдеров
Главное преимущество: 500+ моделей, 80+ провайдеров и учитывающий тип задачи Auto Router
Цена: бесплатный тариф за $0; комиссия платформы 5.5% в Pay as you go; скидки Enterprise рассчитываются индивидуально
Бесплатный доступ: бесплатный тариф с 25+ моделями, 4 провайдерами и 50 запросами в день
Коммерческий компромисс обозначен прямо. У тарифа OpenRouter Pay as you go нет минимальной суммы расходов, но действует платформенная комиссия 5.5%. При покупке кредитов на $2,000 это $110. Для Bring Your Own Key сейчас доступен месячный лимит инференса по прейскуранту в $25,000, после которого применяется комиссия 5%. В Enterprise этот лимит повышается до $200,000, а скидки на комиссии предоставляются по запросу.
Бесплатный тариф годится для проверки совместимости, но не для постоянной работы агентов. Пятьдесят запросов в день могут закончиться прямо посреди длинного цикла программирования. Рассматривайте его как тест подключения, а не как командный бюджет.
Auto Router в OpenRouter интереснее самого размера каталога. В актуальной документации по маршрутизации говорится, что сервис классифицирует промпты примерно по 30 типам задач, включая отладку кода и многошаговое планирование агентов, а затем ранжирует модели по совокупным расходам за скользящее семидневное окно. Учитываются возможности, поддержка инструментов, стоимость, ограничения аккаунта и варианты резервного переключения.
Этот рыночный сигнал упрощает эксперименты, но мешает воспроизводимости. Маршрутизатор может выбрать на каждом ходе другую модель. Привязка сеанса предпочитает предыдущую модель, пока та остаётся одним из лучших кандидатов, однако при смене задачи выбор всё равно может измениться. Для агента программирования, создающего патч в течение многих ходов, смена модели в середине сеанса способна повлиять на синтаксис вызова инструментов, стиль рассуждений или дисциплину ответа.
Это не повод отказываться от маршрутизации — важно определить, где уместен динамический выбор. Используйте его при оценке, низкорисковой классификации или для ограниченного фонового этапа. Для патча, от которого зависит релиз, закрепите одобренные модель и политику провайдера, если команда ещё не проверила непрерывность работы между моделями.
OpenRouter также предоставляет маршрутизацию по политикам и резервное переключение между провайдерами. Это полезно, когда одну и ту же модель предлагают несколько площадок инференса. Но такая возможность менее значима, если покупателю требуется распределение расходов по репозиториям, самостоятельный контроль развёртывания или управляемые корпоративные защитные правила. В этих отдельных задачах Requesty, LiteLLM и Portkey сильнее.
- Самый большой опубликованный каталог в списке: 500+ моделей и 80+ провайдеров
- Быстрое сравнение моделей без отдельных аккаунтов у провайдеров
- Auto Router учитывает текущую задачу и рыночные сигналы
- Резервное переключение провайдеров, контроль расходов и маршрутизация по политикам
- Бесплатный тариф для проверки совместимости
- Комиссия 5.5% в Pay as you go растёт вместе с расходами
- 50 запросов в день на бесплатном тарифе недостаточно для постоянных агентских циклов
- Динамическая маршрутизация может менять модель между ходами
- Меньше настройки под конкретные агентские инструменты и атрибуции по репозиториям, чем у двух лидеров
5. Portkey: лучший управляемый уровень корпоративного контроля
Portkey — лучший выбор, когда бюджет выделен на управляемую платформу контроля, а не просто на единую конечную точку. Шлюз объединяет резервное переключение, условную маршрутизацию, повторные попытки, автоматический выключатель, балансировку нагрузки, канареечное тестирование, поддержку MCP, бюджеты, ограничения частоты, кэши и защитные правила.

Такой набор подходит платформенной команде среднего размера, переходящей от личных ключей агентов к согласованному доступу. Одна политика может ограничить модели, один бюджет — расходы команды, а один автоматический выключатель — остановить повторные обращения к отказавшему провайдеру. Продукт рассчитан на момент, когда задача «выдать разработчикам ключ шлюза» превращается в проблему идентификации, политик и управления инцидентами.
Лучше всего подходит для: управляемой маршрутизации, защитных правил и корпоративного управления в растущей платформенной команде
Главное преимущество: автоматические выключатели, канареечное тестирование, контроль MCP, условная маршрутизация и локальный шлюз с открытым исходным кодом
Цена: Developer за $0, Production за $49 в месяц, индивидуальный Enterprise
Бесплатный доступ: тариф Developer остаётся бесплатным навсегда, но прямо обозначен как непригодный для промышленной эксплуатации
Границы тарифов сформулированы на редкость откровенно. Тариф Developer у Portkey записывает 10,000 логов в месяц, хранит логи три дня, а метрики — 30 дней. На странице прямо сказано, что для промышленной эксплуатации он не подходит.
Production стоит $49 в месяц и записывает 100,000 логов; за каждые дополнительные 100,000 запросов до опубликованного порога взимается $9. Логи хранятся 30 дней, метрики — 90 дней. При 200,000 записанных логов подписка обойдётся в $58 без учёта исходного инференса. На той же странице сказано, что Production не рекомендуется, когда нужны особые средства безопасности или гарантии размещения данных.
Для таких требований необходим Enterprise. Он рассчитывается индивидуально и добавляет 10 миллионов и более записанных логов, настраиваемые сроки хранения, SSO, детализированные бюджеты и ограничения частоты, размещение в частном облаке и VPC, экспорт в озеро данных и расширенные средства соответствия требованиям. Это существенный переход от оплаты $49 банковской картой к полноценной закупочной процедуре.
Portkey также публикует локальный шлюз с открытым исходным кодом, который запускается командой npx @portkey-ai/gateway. С его помощью можно проверить интерфейс маршрутизации или самостоятельно разместить тракт данных. Однако покупателю всё равно нужно отличать локальный шлюз от управляемых средств наблюдаемости, политик, поддержки и возможностей Enterprise, благодаря которым Portkey и вошёл в этот рейтинг.
Отдельного внимания заслуживает текущая смена продукта. В документации Portkey теперь указано название Prisma AIRS AI Gateway. Страницы шлюза и цены продолжают действовать, но покупателю стоит уточнить, какое название попадёт в договор, какая дорожная карта применяется и как отдельные аккаунты Portkey соотносятся с портфелем Palo Alto Networks. Это обычная проверка перед закупкой, а не причина отвергать продукт.
Ограничение для агентов программирования — настройка. Portkey может работать за совместимыми агентскими протоколами и предлагает более глубокий универсальный контур управления, чем Vercel. Но сейчас у него нет сопоставимого опыта одной команды для девяти инструментов. Выбирайте Portkey, когда политика оправдывает интеграционную работу, а не просто из-за более длинного списка функций.
- Богатая управляемая маршрутизация с автоматическими выключателями, повторами, резервным переключением и канареечными тестами
- Поддержка MCP, защитные правила, бюджеты и ограничения частоты
- Публичный тариф Production за $49 с понятной тарификацией по записанным логам
- Локальный шлюз с открытым исходным кодом
- Enterprise для SSO, частного развёртывания, размещения данных и соответствия требованиям
- Бесплатный тариф прямо обозначен как непригодный для промышленной эксплуатации
- Production за $49 прямо обозначен как неподходящий для особых требований к безопасности или размещению данных
- Цена Enterprise рассчитывается индивидуально
- Настройка агентских инструментов упакована хуже, чем у Vercel
- Переход к Prisma AIRS добавляет вопросы о договоре и дорожной карте
6. Cloudflare AI Gateway: лучший выбор для команд на Workers
Cloudflare AI Gateway — самый простой вариант, если Cloudflare уже обслуживает edge-уровень приложения, журналы и безопасность. Сейчас основные функции шлюза бесплатны на всех тарифах, включая аналитику, кэширование и ограничение частоты.

Продукт особенно привлекателен для команды, чей агент или внутренняя платформа разработки уже работает на Workers. Через OpenAI-совместимый REST-интерфейс тот же аккаунт может обращаться к сторонним моделям и моделям Cloudflare, записывать расходы и ошибки, кэшировать безопасные повторные запросы, вводить ограничения частоты, искать конфиденциальные данные и повторять неудачные обращения.
Лучше всего подходит для: команд, уже использующих Workers, журналы Cloudflare или средства безопасности Cloudflare
Главное преимущество: бесплатный базовый шлюз, интеграция на периферии, DLP, кэширование и OpenAI-совместимый доступ к сторонним моделям
Цена: основные функции за $0; комиссия 5% при покупке кредитов через Unified Billing; защитные правила тарифицируются по ценам Workers AI
Бесплатный доступ: основные функции шлюза бесплатны без ограничения по времени
На странице цен у бесплатного предложения есть чёткие границы. Workers Free хранит суммарно 100,000 логов для всех шлюзов. Workers Paid хранит 10 миллионов логов на каждый шлюз. Постоянные логи, аналитика, кэширование и ограничение частоты доступны на всех тарифах.
Unified Billing добавляет комиссию 5%, если кредиты приобретаются через Cloudflare. Поэтому покупка кредитов на $2,000 стоит $2,100, хотя инференс провайдера по-прежнему оплачивается без наценки. Разница существенна: цена модели не меняется, но объединение учётных данных и выставления счетов оплачивается отдельно.
Сканирование Data Loss Prevention бесплатно на всех тарифах. Аккаунты без подписки Zero Trust получают два предустановленных профиля DLP, а более широкий набор профилей зависит от подписки Cloudflare One. Защитные правила не входят в бесплатную базовую версию: Cloudflare тарифицирует проверку промптов и ответов как токенный инференс Workers AI.
Cloudflare также предоставляет полезные средства управления запросами. В документации REST поддерживаются тайм-ауты для отдельных запросов, методы повторов, до пяти попыток и задержка повтора до 5,000 миллисекунд. Эти настройки не позволяют медленному провайдеру бесконечно удерживать цикл агента.
Ограничение — удобство подключения агентских инструментов. Cloudflare объясняет, как приложения обращаются к шлюзу, но не предлагает такого же уровня настройки для названных агентов, как Vercel или процесс Requesty для Claude Code. Разработчику придётся проверить, как каждый инструмент меняет базовый URL, аутентификацию, обнаружение моделей и протокол. Само ПО может стоить $0, но расходы на интеграцию всё равно возьмёт на себя инженерная команда.
- Основные функции аналитики, кэширования и ограничения частоты бесплатны
- OpenAI-совместимый доступ к моделям Cloudflare и сторонних провайдеров
- Сканирование DLP бесплатно на всех тарифах
- Отлично сочетается с Workers, журналами Cloudflare и продуктами безопасности
- Явные настройки повторов и тайм-аутов
- Unified Billing добавляет 5% к покупке кредитов
- Бесплатное хранилище логов ограничено 100,000 записями на весь аккаунт
- Защитные правила создают отдельные расходы на инференс Workers AI
- Нет сопоставимой настройки агентских инструментов одной командой
- Для полного набора профилей DLP может потребоваться отдельная подписка Zero Trust
Какой ИИ-шлюз кому подходит
Лучший шлюз устраняет текущие издержки координации команды, не создавая ещё более тяжёлой операционной нагрузки. Начните с ограничения, по которому нельзя торговаться, и только потом сравнивайте комиссии.
Выбирайте Vercel AI Gateway для смешанной команды, которая работает с Claude Code, Codex, Cursor, OpenCode и другими агентами. Решение меняется, если самостоятельное размещение обязательно или расходы нужно связывать не только с агентом, ключом и моделью, но и с репозиторием и разработчиком.
Выбирайте Requesty для агентства, консалтинговой компании или продуктовой организации, которым нужна атрибуция по веткам, репозиториям и разработчикам. Выбор меняется, если эти метаданные не повлияют на бюджетное решение: тогда наценка 5% покупает сведения, которыми никто не пользуется.
Выбирайте LiteLLM для платформенной команды, где уже налажена работа с контейнерами, базами данных, секретами, журналами и дежурствами. Переходите на управляемый шлюз, если иначе прокси неформально окажется в собственности инженера продукта.
Выбирайте OpenRouter, пока самостоятельный разработчик или исследовательская команда сравнивает модели и провайдеров. После того как короткий список стабилизируется, регулярная комиссия 5.5% может превысить ценность широкого каталога — и выбор изменится.
Выбирайте Portkey, когда основанием для покупки служат одобренные модели, защитные правила, автоматические выключатели, канареечные тесты и централизованное управление. Выбор меняется, если организации нужны только одна конечная точка и панель расходов.
Выбирайте Cloudflare AI Gateway, если Workers и средства безопасности Cloudflare уже оплачены и знакомы команде. Выбор меняется, если внедрение окружающей платформы создаст больше интеграционной работы, чем снимет шлюз.

Есть ещё одно правило: выбирайте шлюз отдельно от агентского инструмента. Claude Code, Codex и Cursor решают разные инженерные задачи, а шлюз управляет их модельным трафиком. Компания может стандартизировать шлюз, не стандартизируя редактор. Часто это и есть более полезная граница контроля.
Чтобы расширить список агентов, сравните лучших ИИ-агентов для программирования. Для вопросов SSO, хранения данных, аудита и внедрения, выходящих за рамки шлюза, обратитесь к сравнению агентов программирования для предприятий.
Какие решения не подходят для этой задачи
Не выбирайте Helicone как основной продукт, если насущная проблема — настройка агентских инструментов. Тариф Hobby у Helicone бесплатен для 10,000 запросов, Pro стоит $79 в месяц, Team — $799 в месяц. Наблюдаемость, сеансы, промпты и аналитика могут быть полезны, но рейтинг изменится только тогда, когда главной проблемой станет прозрачность. Для этого запроса Helicone не превосходит актуальный процесс настройки Vercel, атрибуцию по репозиториям Requesty или контроль развёртывания LiteLLM.
Не выбирайте универсальный API-шлюз только потому, что компания уже им владеет. Традиционные шлюзы понимают маршруты, аутентификацию и политики HTTP. В трафике агентов программирования появляются специфичные для провайдеров модели, учёт токенов, совместимость с вызовом инструментов, кэширование промптов, резервные модели и несколько протоколов ответов. Расширение универсального шлюза может быть разумным для платформенной команды, но фраза «у нас уже есть Kong» не заменяет план внедрения.
Не используйте самописный прокси-посредник, когда от него уже зависят несколько агентов. Поменять базовый URL просто. Но поддержка адаптеров провайдеров, безопасных повторов, потоковых ответов, счётчиков бюджета, изоляции ключей, сроков хранения журналов и вывода моделей из эксплуатации — это отдельный продукт. Разрабатывать его стоит лишь тогда, когда уникальная политика или ограничение развёртывания оправдывает постоянное владение.
Не включайте динамическую маршрутизацию моделей на каждом этапе критичного для релиза агентского цикла, пока не проверена непрерывность работы между моделями. Маршрутизатор может подобрать эффективную модель для каждой задачи, но при этом усложнить воспроизведение длинного патча. Закрепите модель для этапов, которые изменяют код, а динамическую маршрутизацию оставьте для ограниченной вспомогательной работы.
Наконец, не переводите всех разработчиков на шлюз в первый же день. Шлюз способен изменить аутентификацию, обнаружение моделей, кэширование, обработку ошибок и выбор резервного маршрута, хотя интерфейс агента программирования останется прежним. Поэтому внедрение должно начинаться с ограниченного пилота и сохранённого прямого маршрута к провайдеру для отката.
Часто задаваемые вопросы
Какой LLM-шлюз лучший?
Vercel AI Gateway — лучший вариант по умолчанию для агентов программирования: одна команда настраивает девять поддерживаемых агентов, а на токены нет наценки. LiteLLM лучше, когда обязательно самостоятельное размещение, Requesty — когда важнее всего атрибуция по репозиториям и разработчикам, а Portkey — когда основанием для покупки служит централизованное управление.
Какие тарифы и комиссии действуют у OpenRouter в 2026 году?
На актуальном тарифе OpenRouter Pay as you go действует платформенная комиссия 5.5%, доступны 500+ моделей от 80+ провайдеров, а минимальной суммы расходов нет. Бесплатный тариф ограничен 25+ бесплатными моделями, 4 провайдерами и 50 запросами в день. Текущий лимит BYOK в Pay as you go покрывает инференс по прейскуранту на $25,000 в месяц, после чего применяется комиссия 5%.
Сколько стоит Cloudflare AI Gateway в 2026 году?
Основные функции Cloudflare AI Gateway бесплатны. Покупка кредитов через Unified Billing добавляет 5%, Workers Free хранит 100,000 логов на весь аккаунт, Workers Paid — 10 миллионов логов на каждый шлюз, а защитные правила отдельно тарифицируются как инференс Workers AI.
Может ли один шлюз маршрутизировать запросы Claude Code и Codex?
Да. Шлюз должен поддерживать протоколы, которые ожидает каждый агентский инструмент, или предоставлять отдельные конечные точки совместимости. Vercel документирует разные конечные точки для Claude Code и Codex, тогда как для самостоятельно размещаемых и универсальных шлюзов покупателю придётся проверить конфигурацию каждого инструмента.
Что сделать в понедельник
Не тратьте понедельник на миграцию всей компании. Докажите, что один шлюз способен снизить неопределённость расходов и риск сбоя провайдера в одном репрезентативном репозитории.
Понедельник: определите границы контроля
Выберите один репозиторий, одну небольшую группу разработчиков и два агентских инструмента, которыми они уже пользуются. Одним предложением сформулируйте причину, под которую выделен бюджет: объединение счетов, спасение запросов при сбое провайдера, атрибуция расходов, применение списка одобренных моделей или сохранение трафика в частном развёртывании. Если в предложении перечислены три несвязанные цели, сузьте пилот.
Создайте отдельный ключ шлюза с жёстким лимитом расходов. Выберите одну основную модель и одну резервную с сопоставимой поддержкой инструментов. Сохраните прямую конфигурацию провайдера в файле для отката и зафиксируйте текущий счёт провайдера до перевода трафика.
Вторник: подключите шлюз и проверьте изменения
Для Vercel выполните документированную команду настройки и изучите каждое изменение до записи. Для Requesty создайте резервную копию настроек Claude Code и включите только те заголовки атрибуции, которыми команда будет пользоваться. LiteLLM развёртывайте через обычный инфраструктурный процесс, а не на ноутбуке. Для каждого шлюза убедитесь, что секреты попадают в одобренное хранилище.
Запустите из каждого агента по одной ограниченной задаче. Проверьте выбор модели, вызовы инструментов, потоковые ответы, ошибки, поведение кэша, стоимость и привязанные к запросу сведения об отправителе. Успешного ответа недостаточно, если панель не может объяснить, кто потратил деньги или какой резервный маршрут ответил.
Среда и четверг: принудительно проверьте отказ
Создайте контролируемый тайм-аут или используйте тестовый маршрут, направляющий основной запрос недоступному провайдеру. Убедитесь, что резервный маршрут сохраняет формат протокола, которого ожидает агент программирования. Проверьте, тарифицируется ли неудачная попытка, использует ли резервный запрос другие учётные данные и отображает ли трейс обе попытки.
В рамках пилота исправьте одну обычную ошибку, внесите одно изменение в несколько файлов, проведите один цикл исправления тестов и выполните одну задачу ревью. Зафиксируйте стоимость выполненной задачи, сбои провайдеров, спасённые запросы, время на изменение конфигурации и проблемы, о которых сообщили разработчики. Не сравнивайте число промптов без учёта результата работы.
Пятница: покупайте только контроль, который изменил решение
Внедряйте шлюз, только если его данные или надёжность меняют операционное решение. Спасённый запрос имеет значение. Перерасход бюджета репозитория имеет значение. Нарушение политики провайдеров имеет значение. А заполненная графиками токенов панель, которую никто из ответственных не просматривает, — нет.
Для большинства смешанных команд в понедельник стоит выбрать Vercel AI Gateway с одним пилотным ключом, одной основной моделью, одной резервной моделью и без платных дополнений, пока их не потребует политика. Выбор меняется на Requesty, если ответственность за расходы должна доходить до репозитория и разработчика, и на LiteLLM, если тракт данных обязан оставаться внутри инфраструктуры компании.
Храните конфигурацию шлюза в системе контроля версий, документируйте путь отката и не усложняйте политику моделей. Цель не в том, чтобы направлять трафик через большее число поставщиков. Следующий сбой провайдера, выпуск модели или пересмотр бюджета должен стать изменением конфигурации, а не миграцией всей компании.
3 сент. 2026 г.







