Цены за 1 млн токенов (input / output), если не указано иное; рублёвые прайсы РФ-вендоров приведены к 1 млн токенов, доллар для сопоставимости - по курсу 84 ₽/$ (ЦБ РФ на 22.09.2026). Рублёвые цены РФ-облаков - с НДС, долларовые - без НДС. Для open-weight моделей цена API у провайдеров приведена как ориентир или не указана: главное в них лицензия и возможность self-host, а экономика считается через TCO железа. «On-prem / РФ-контур» - возможно ли развернуть модель внутри периметра заказчика.
Цены не-Anthropic вендоров - по их публичным прайсам; сверяйте с первоисточником на дату (см. блок «Источники»). Передовые зарубежные модели (Fable 5.1, GPT-6 Astra, Opus 5.5) применяются под 152-ФЗ через продуктизированный шлюз приватности KT.Team: ПДн обезличиваются перед отправкой в облако и подставляются обратно в ответ. Таблица показывает цену за токен - но это ещё не стоимость задачи.
| Модель | Вендор | Цена in/out (1М) | Контекст | Лицензия | On-prem / РФ-контур | Данные в РФ / 152-ФЗ | Под что брать |
| Fable 5.1 | Anthropic | $10 / $50; кэш-чтение $0,25 | 1M | Closed | Нет | Через security gate (API-прокси) | Долгоживущие агенты: тот же прайс, но кэш-чтение вчетверо дешевле |
| GPT-6 Astra | OpenAI | $10 / $50; кэш $1 | 1,05M (выход 128K) | Closed | Нет | Через security gate (API-прокси) | Работа с интерфейсами; доступ поэтапный — проверяйте до планирования |
| Fable 5 | Anthropic | $10 / $50 | 1M | Closed | Нет | Через security gate (API-прокси) | Только после проверки доступности: тяжёлый long-horizon reasoning и агентика |
| Claude Opus 5.5 | Anthropic | $4 / $20; кэш-чтение $0,20 | сверяйте у вендора | Closed | Нет | Через security gate (API-прокси) | Лучший дефолт «цена/интеллект» среди передовых closed: по заявлению вендора — уровень Fable 5.1 на большинстве задач |
| GPT-5.5 | OpenAI | ~$5 / $30\* | ~1M+ | Closed | Нет | Через security gate (API-прокси) | Большой контекст, дешёвый кэш и batch |
| DeepSeek V4 | DeepSeek | Flash $0,30 / $1,20; Pro $1,32 / $3,96 (пиковые часы; вне пика вдвое дешевле) | 1M | MIT | Да | Да, если развернуть в РФ | Код и длинный контекст в контуре заказчика |
| Qwen 3.x | Alibaba | open-weight (Apache 2.0) | 128–256K | Apache 2.0 (младшие); Max — closed | Да (235B/Coder); Max — нет | Да, если развернуть | Код, мультиязычность, дешёвый on-prem |
| GigaChat 3.5 Ultra | Сбер | API-прайса нет; self-host/TCO | длинный контекст; 432B MoE | MIT | Да | Да, если развернуть в РФ | Российская open-weight модель для on-prem, кода, математики и агентных сценариев |
| Gemma 4 | Google | self-host / ~$0,06–0,30 хостед | 256K | open weights\* | Да | Да, если развернуть | Дешёвый массовый инференс в контуре |
| Llama 4 | Meta | self-host | 1M–10M | Community License\*\* | Да | Да, если развернуть | Зрелая экосистема, очень длинный контекст |
| GigaChat API | Сбер | Lite 65 ₽, Pro 500 ₽, Max 650 ₽ за 1М, вход = выход, с НДС ($0,8 / $6,0 / $7,7); минимум 600 ₽ в месяц | 128K | Closed/API | Облако в РФ | Да, ДЦ в РФ | RU-задачи без VPN и без своего железа; рублёвый opex |
| Alice AI LLM | Яндекс | 500 / 1 200 ₽ за 1М с НДС ($6,0 / $14,3); YandexGPT Lite — 200 / 200 ₽ | сверяйте у вендора | Closed/API; YandexGPT 5 Lite — open (кастомная) | Облако в РФ; Lite 8B — да | Да, заявлено ФЗ-152 | RU-задачи без VPN, оплата в рублях; флагман Yandex AI Studio |
\* Цены и контекст GPT-5.5 - по публичным заявлениям OpenAI; сверяйте с актуальным прайсом на странице прайса OpenAI на дату. Конкретные множители (порог длинного контекста, наценка за регион) указывайте только со ссылкой на страницу прайса. \* Лицензия Gemma 4 разрешает коммерческое использование, но исторически не полностью OSI-open (есть use-policy ограничения). Перед on-prem читайте текст лицензии на HuggingFace. \*\* Llama 4 Community License - open-weight с ограничениями (AUP, порог 700 млн MAU).
Это «open-weight с оговорками лицензии», а не классический open-source.