Детальное объяснение правил тарификации AI API: Token, цены на ввод/вывод и оценка стоимости (проверено 2026)
Разберитесь в тарификации по токенам, разнице цен на ввод/вывод, накопительных затратах на контекст, расчёте наценки и скидках на кеширование. С примерами реальных счетов, формулами оценки затрат и 5 распространёнными ловушками тарификации, основано на реальном тестировании популярных ретрансляторов в августе 2026.
Введение
AI API тарифицирует по количеству обработанных токенов, а не по количеству чатов. Короткий вопрос-ответ может стоить всего 0.01 юаня, но запрос на анализ с 10 страницами документов может превысить 1 юань. Цены на ввод и вывод обычно различаются, цена вывода обычно в 2-3 раза выше ввода. Агрегаторы также устанавливают множитель на основе официальных цен. Эта статья основана на реальных тестах основных агрегаторов в августе 2026 года, поможет вам понять правила тарификации и научиться оценивать стоимость.
Подготовка
Перед началом вам нужно подготовить:
-
Выбрать 1-2 агрегатора
Рекомендуется сначала выбрать в списке провайдеров платформы с прозрачными ценами и подробными объяснениями тарификации -
Небольшой тестовый бюджет
Подготовьте 5-10 юаней для реального тестирования, записи данных реальных счетов -
Образцы обычных задач
Подготовьте 3-5 типичных задач (например, перевод 500 слов, резюмирование статьи на 3000 слов, написание отчета на 1000 слов) -
Ожидаемое время
Чтение статьи 5 минут, завершение реального тестирования 10-15 минут
Подробное объяснение
Что такое Token
Token — это минимальная единица обработки текста моделью. В китайском языке обычно 1 символ равен 1.5-2 токенам, в английском 1 слово около 1.3 токена. Например:
- "你好" ≈ 3 токена
- "Hello world" ≈ 2 токена
- Китайская статья на 1000 символов ≈ 1500-2000 токенов
Способы разделения токенов у разных моделей немного отличаются, но порядок величины близок.
Как просмотреть количество токенов:
- OpenAI официально предоставляет инструмент Tokenizer
- Некоторые агрегаторы отображают количество токенов ввода/вывода каждого запроса в детальном счете
- Клиенты типа Claude Code, ChatBox также отображают статистику токенов внизу интерфейса
Раздельная тарификация ввода и вывода
Ввод (Input) включает:
- Ваш вопрос или инструкцию
- Системный промпт (System Prompt)
- Содержимое загруженных документов
- Историю диалога (повторно отправляется для сохранения контекста)
Вывод (Output) включает:
- Содержимое ответа, сгенерированного моделью
Пример различия цен (на примере Claude Sonnet 3.5, официальные цены 2026-08):
- Ввод: $3.00 / миллион токенов
- Вывод: $15.00 / миллион токенов (в 5 раз выше ввода)
Формула фактической тарификации:
Общая стоимость = (Количество токенов ввода × Цена ввода + Количество токенов вывода × Цена вывода) × Множитель агрегатора
Реальный тест (2026-08-14, определенный агрегатор, множитель 1.2):
Задача: Перевести 500 китайских символов на английский
- Ввод: 520 символов промпта + 500 символов оригинала = около 1530 токенов
- Вывод: английский перевод около 650 токенов
- Стоимость ввода: 1530 × $3.00 / 1,000,000 = $0.00459
- Стоимость вывода: 650 × $15.00 / 1,000,000 = $0.00975
- Множитель агрегатора: 1.2×
- Фактическое списание: ($0.00459 + $0.00975) × 1.2 = $0.0172 ≈ ¥0.12
Почему диалоги становятся дороже
Эффект накопления контекста:
Клиент отправляет историю сообщений вместе с новым вопросом, чтобы модель "запомнила" содержимое диалога. Предположим, каждый раунд вопросов-ответов по 200 токенов:
| Раунд | Новый ввод | Накопленная история | Фактический ввод | Кратность стоимости |
|---|---|---|---|---|
| Раунд 1 | 200 | 0 | 200 | 1× |
| Раунд 5 | 200 | 800 | 1000 | 5× |
| Раунд 10 | 200 | 1800 | 2000 | 10× |
Вы видите только новое предложение, которое отправили, но сервер каждый раз обрабатывает всю историю диалога.
Методы снижения стоимости:
- Создавайте новый диалог после завершения темы
- Периодически удаляйте несвязанные исторические сообщения
- Сначала резюмируйте и сжимайте длинные документы, затем задавайте вопросы
- Используйте модели с поддержкой кэширования (см. ниже)
Множитель и обменный курс агрегатора
Множитель: коэффициент надбавки агрегатора к официальной цене, обычный диапазон 1.0× - 2.0×
Реальное сравнение (2026-08-14, цена ввода Claude Sonnet 3.5):
| Провайдер | Официальная цена | Множитель | Цена агрегатора | Примечание |
|---|---|---|---|---|
| Официальный | $3.00/M | 1.0× | $3.00/M | - |
| H API | $3.00/M | 1.0× | $3.00/M | Без надбавки |
Обменный курс: коэффициент конвертации при пополнении в юанях, некоторые платформы могут устанавливать льготы или дополнительные комиссии
Цены кэширования и другие тарифы
Prompt Caching (поддерживается некоторыми моделями):
- Для повторно отправляемого одинакового контента (например, длинные документы, системные промпты), цена повторного чтения ниже
- Цена кэширования Claude: $0.30/M (только 1/10 от обычного ввода)
- Срок действия кэша обычно 5-10 минут
Другие возможные тарифы:
- Ввод изображений: тарифицируется по разрешению (например, $0.005/изображение)
- Ввод аудио: тарифицируется по длительности (например, $0.10/минута)
- Поиск в интернете: тарифицируется по количеству поисков (например, $0.02/поиск)
- Вызов инструментов: тарифицируется по количеству вызовов (например, $0.01/вызов)
Важное напоминание: Если прайс-лист не объясняет четко какую-либо функцию, обязательно сначала протестируйте с небольшой суммой и проверьте детальный счет.
Метод оценки стоимости
Быстрая оценка для новичков
-
Выберите обычные задачи
Выберите 3-5 типичных задач (перевод, письмо, анализ, обслуживание клиентов и т.д.) -
Реальное тестирование 5 раз
Выполните каждую задачу 5 раз, запишите фактический расход из счета -
Рассчитайте среднюю стоимость за раз
Общие расходы ÷ Количество тестов = Стоимость за раз -
Оцените месячный бюджет
Стоимость за раз × Предполагаемое месячное использование × 1.2 (резерв 20% колебаний)
Пример (легкое личное использование):
| Тип задачи | Месячная частота | Стоимость за раз | Месячная стоимость |
|---|---|---|---|
| Перевод 500 слов | 20 раз | ¥0.15 | ¥3.00 |
| Написание отчета на 1000 слов | 5 раз | ¥0.40 | ¥2.00 |
| Повседневные вопросы | 100 раз | ¥0.05 | ¥5.00 |
| Итого | - | - | ¥10.00 |
Рекомендуется первое пополнение 20-30 юаней, после использования 1-2 недель корректировать по фактическому расходу.
Проверка результатов
После завершения реального тестирования проверьте следующие пункты:
-
Четкость детального счета
Должны быть видны количество токенов ввода/вывода каждого запроса и конкретное списание -
Соответствие множителя ожиданиям
Используйте фактическое списание ÷ (стоимость ввода + стоимость вывода) для обратного расчета множителя, сравните с прайс-листом -
Разумность изменения баланса
Разница баланса до и после теста должна соответствовать общей сумме счета
Если данные счета непрозрачны или результат расчета отличается более чем на 10%, рекомендуется сменить провайдера.
Распространенные ошибки
Ошибка 1: Смотреть только на единичную цену, не на множитель
Симптом: Выбрал агрегатор с заявленной "официальной ценой", но фактическое списание на 50% выше
Причина: Пропущено объяснение "множитель 1.5×" или "комиссия за обслуживание 30%"
Решение:
- На странице цен ищите ключевые слова "множитель", "коэффициент надбавки", "комиссия за обслуживание"
- После реального теста 1-2 раз используйте формулу для обратного расчета фактического множителя
- Попросите службу поддержки четко указать окончательный множитель тарификации
Ошибка 2: Игнорирование накопления контекста
Симптом: Задали только несколько вопросов, но расходы быстро растут
Причина: История диалога повторно отправляется с каждым запросом, фактический ввод в 10-м раунде может быть в 10 раз больше, чем в 1-м
Решение:
- Создавайте новый диалог после завершения темы
- Используйте функцию "резюмировать предыдущее" для сжатия истории
- Периодически вручную удаляйте несвязанные ранние сообщения
Ошибка 3: Избыточный вывод приводит к перерасходу
Симптом: Модель выводит слишком много, расходы намного превышают ожидания
Причина: Не ограничена длина вывода, модель может генерировать тысячи слов
Решение:
- Четко укажите количество выводимых слов в промпте (например, "резюмируйте в 200 словах")
- Используйте параметр Max Tokens клиента для ограничения верхнего предела вывода
- Выбирайте подходящую для задачи модель (не используйте GPT-4 для простых вопросов)
Ошибка 4: Повторяющиеся неудачные запросы
Симптом: После неудачи одного запроса многократные повторы, расход быстро увеличивается
Причина: Автоматический повтор клиента + ручной повтор, одно и то же содержимое отправлено несколько раз
Решение:
- После неудачи сначала проверьте причину ошибки, не повторяйте вслепую
- Отключите функцию "автоматический повтор" клиента
- При большом количестве неудач сначала приостановите использование, свяжитесь со службой поддержки для расследования проблемы
Ошибка 5: Смешивание цен разных моделей
Симптом: Проверили цену GPT-3.5, но используете для оценки стоимости Claude Opus
Причина: Цены разных моделей различаются в 10-100 раз
Решение:
- Найдите фактически используемую вами модель в прайс-листе
- Обратите внимание на различие версий моделей (например, GPT-4 и GPT-4 Turbo)
- Проведите небольшое тестирование для каждой модели отдельно
Объяснение стоимости
- Чтение статьи: бесплатно
- Тест расчета токенов: бесплатно (использование OpenAI Tokenizer)
- Реальный тест API: ¥5-10 (рекомендуется подготовить 10 юаней тестового бюджета)
- Месячная стоимость использования:
- Легкая личная: ¥10-30/месяц
- Средняя личная: ¥50-100/месяц
- Интенсивная личная/малая команда: ¥200-500/месяц
Политика возврата различается у разных провайдеров, необходимо уточнить перед пополнением.
Напоминания о безопасности
-
Рекомендация по пополнению
Первое пополнение 10-20 юаней достаточно, после тестирования 1-2 недель корректируйте по фактическому объему использования -
Мониторинг счетов
Проверяйте детальный счет раз в неделю, при обнаружении аномалий немедленно прекращайте использование и свяжитесь со службой поддержки -
Классификация задач
Используйте дешевые модели для частых задач, дорогие модели для сложных задач, не используйте одну и ту же для всего -
Настройка бюджета
Установите дневной/месячный лимит квоты в панели агрегатора для предотвращения случайного перерасхода
Дата тестирования: 2026-08-14
Тестируемые объекты: Claude Sonnet 3.5, GPT-4
Тестовая платформа: H API
Справочная документация: Официальные цены Claude, Цены OpenAI