Часто задаваемые вопросы
О данных, методологии и самом сайте.
Mistral Small 4 (Mistral) — самая дешёвая модель из отслеживаемых нами, по $0.15 за миллион входных токенов и $0.60 за миллион выходных. Несколько других бюджетных моделей идут почти вплотную — см. полную таблицу выше.
Значительный. Claude Fable 5.1 (Anthropic) берёт в 66.7 раз больше за входной токен, чем Mistral Small 4 (наравне с GPT-6 Astra на вершине). Флагманские цены обычно отражают более крупные модели с более глубоким рассуждением, а не линейное улучшение качества вывода — стоит проверить на своей задаче, прежде чем считать, что более дорогая модель — правильный выбор.
Входные токены — это то, что вы отправляете модели: промпт, контекст, документы, история переписки. Выходные токены — это то, что она генерирует в ответ. Выход почти всегда стоит дороже, часто в 3–5 раз больше цены входа, потому что генерация текста требует больше вычислений, чем его чтение.
Meta не продаёт прямой доступ к API для Llama — компания публикует веса модели и позволяет другим компаниям размещать её у себя. Цены, которые мы показываем для Llama 4, взяты у Together AI — одного из нескольких провайдеров инференса, предлагающих эту модель; другие хостинги (Groq, Fireworks и другие) могут устанавливать иные цены.
Каждая цена на этой странице была проверена напрямую по странице цен провайдера September 10, 2026. Впредь мы перепроверяем каждые 48 часов — это была первая проверка, поэтому истории пока нет, но каждая будущая проверка будет датирована, а любое изменение — зафиксировано, так что история начнёт складываться отсюда.
Нет. PerTokens независим и не спонсируется. Каждый провайдер представлен одинаково, с использованием одного и того же источника (его собственной публичной страницы цен) и одной и той же даты проверки.
Пока нет в основной таблице — мы показываем стандартную цену короткого контекста по факту использования для каждой модели, чтобы сравнение между провайдерами оставалось честным. Если провайдер публикует заметно отличающуюся цену на пакетную обработку или кэширование, мы упоминаем это в примечаниях к модели или на её отдельной странице.
Напишите на contact@pertokens.com, указав модель или провайдера и ссылку на его официальную страницу цен. Отслеживаемый список отбирается вручную среди крупных провайдеров с публичной страницей цен на API — новые добавления получают такое же обращение, как и всё уже присутствующее: данные берутся напрямую со страницы провайдера, датируются и никогда не оцениваются приблизительно.
Эта страница отвечает на конкретные вопросы; страница методологии в одном месте описывает весь процесс получения данных и проверки, включая то, на что мы ориентируемся при стандартизации и что намеренно не учитываем.