Sonar API: модели, цены и переход на Agent API
Sonar API отдаёт тот же поиск с источниками, что работает внутри Perplexity, — только в ваш код. Интерфейс совместим с OpenAI, поэтому подключение занимает несколько строк.
Sonar Chat Completions поддерживается до 27 сентября 2026
Дальше работа идёт через Agent API, где модель Sonar доступна наряду с моделями OpenAI, Anthropic, Google и xAI. Готовые интеграции продолжат отвечать до этой даты, но переносить их разумнее заранее, не в последнюю неделю. Ни одна русскоязычная страница в выдаче эту дату пока не называет, хотя в документации она стоит прямым текстом.
Четыре модели Perplexity Sonar
Разница между ними — в глубине поиска и в том, сколько работы модель проделывает до ответа.
Из чего складывается сумма
Цена состоит из двух независимых частей. Первая — токены: считаются и входящие, и исходящие, по разным ставкам. Вторая — плата за сам запрос, она берётся за тысячу обращений и зависит от заданной глубины поиска: низкая, средняя или высокая.
У Deep Research сверх этого тарифицируются токены цитат и токены рассуждений, а поисковые запросы считаются отдельно — по $5 за тысячу.
Что даёт совместимость с OpenAI
Sonar работает через OpenAI-совместимый интерфейс: если в проекте уже стоит клиент OpenAI, меняются адрес и ключ, остальной код остаётся прежним. Есть и родные SDK — для Python и TypeScript, они добавляют работу с источниками и потоковую отдачу ответа.
Подписка для API не нужна: оплата идёт по факту потребления. Ключ создаётся в консоли разработчика, полный прайс — на странице цен, список моделей — в разделе моделей.
Чем ответ Sonar отличается от обычного LLM-ответа
Каждый ответ приходит вместе со списком найденных страниц, и ссылки можно показать пользователю как есть. Модель ходит в веб на каждый запрос, поэтому дата окончания обучения не ограничивает свежесть — это то, ради чего API обычно и берут.
Попробовать Sonar на практике
Оценить качество ответов проще всего на живых запросах — до того, как встраивать API в продукт.