Perplexity Logo

Perplexity

Perplexity is an AI-native answer engine and model provider redefining search with real-time, citation-backed responses, offering high-performance Sonar models optimized for reasoning, retrieval, and scalable AI-powered knowledge workflows.

Built for real-time information access, Perplexity models excel in retrieval-augmented generation and citation accuracy. ModelCosts.com helps you evaluate Sonar model pricing, monitor pricing trends, and optimize query-heavy workloads with precise cost forecasting and automated alerts tailored for search-driven AI applications.

Last updated Sep 28, 2026

Never miss an AI pricing or launch update

Get notified about new model launches, pricing changes, provider updates, deprecations, and cost-saving insights.

🔒 We respect your privacy. Unsubscribe anytime.

Provider Details

Uptime Status
  • Headquarter: San Francisco, California, USA
  • Notable Models: Sonar Pro, Sonar Reasoning, Sonar Deep Research

Model Release Timeline

Perplexity is a San Francisco–based AI company focused on building an answer engine that combines large language models with real-time web retrieval. Its Sonar model family is designed for fast, factual, and citation-backed responses, making it ideal for search, research, and knowledge workflows. Unlike static LLMs, Perplexity emphasizes freshness and accuracy through retrieval-augmented generation. Developers and businesses can integrate these capabilities via APIs to power search assistants, research tools, and AI copilots. With ModelCosts.com, users can track Sonar API pricing, analyze cost per query, and set alerts to maintain efficient, predictable spending across high-volume use cases.
Selling Points:
- Retrieval-first architecture: Sonar models deliver real-time, citation-backed answers, reducing hallucinations and improving trust in AI outputs.
- Optimized for search workloads: Built specifically for query-heavy applications like research tools, copilots, and AI search engines.
- Flexible API integration: Easily deploy across web apps, enterprise tools, and knowledge systems with scalable infrastructure.
- Cost-aware usage: ModelCosts.com enables detailed cost analysis per query, helping teams control spend in high-frequency environments.
- Competitive differentiation: Strong focus on accuracy, freshness, and transparency positions Perplexity as a leader in AI-powered search and retrieval systems.

Quick Model Estimate

(USD 10.0000 per 1M tokens)
(USD 50.0000 per 1M tokens)

Your Cost Estimate

💰 Total Cost

—

for 1000 input + 1000 output tokens

📥 Input (1000 × $10.000000) —
📤 Output (1000 × $50.000000) —

Cost Breakdown

📥 Input 📤 Output

Prices are watched for changes and checked against the provider's own page.

Pricing

Model ↕
Modality ↕
Service Tier ↕
Input Price
(per 1M tokens)
↕
Output Price
(per 1M tokens)
↕
Cached Input
(per 1M tokens)
↕
Embedding Price
(per 1M tokens)
↕
Context Window ↕
View
SonarTextStandard$1.0000$1.0000N/AN/AN/A→
Sonar Deep ResearchTextStandard$2.0000$8.0000N/AN/AN/A→
Sonar ProTextStandard$3.0000$15.0000N/AN/AN/A→
Sonar Reasoning ProTextStandard$2.0000$8.0000N/AN/AN/A→
Claude Haiku 4.5TextStandard$1.0000$5.0000$0.1000N/A200,000 tokens→
Claude Opus 4.5TextStandard$5.0000$25.0000$0.5000N/A200,000 tokens→
Claude Opus 4.6TextStandard$5.0000$25.0000$0.5000N/A200,000 tokens→
Claude Sonnet 4.5TextStandard$3.0000$15.0000$0.3000N/A200,000 tokens→
Claude Sonnet 4.6TextStandard$3.0000$15.0000$0.3000N/A200,000 tokens→
GPT-5 MiniTextStandard$0.2500$2.0000$0.0250N/A400,000 tokens→
GPT-5.1TextStandard$1.2500$10.0000$0.1250N/A400,000 tokens→
GPT-5.2TextStandard$1.7500$14.0000$0.1750N/A400,000 tokens→
GPT-5.4TextStandard$2.5000$15.0000$0.2500N/A1,050,000 tokens→
GPT-5.4TextStandard$5.0000$22.5000N/AN/A1,050,000 tokens→
Sonar (LLM)TextStandard$0.2500$2.5000$0.0625N/A128,000 tokens→
PPLX Embed Context v1-0.6bTextStandardN/AN/AN/A$0.0080N/A→
PPLX Embed Context v1-4bTextStandardN/AN/AN/A$0.0500N/A→
PPLX Embed v1-0.6bTextStandardN/AN/AN/A$0.0040N/A→
PPLX Embed v1-4bTextStandardN/AN/AN/A$0.0300N/A→
Gemini 2.5 ProTextStandard$1.2500$10.0000N/AN/A1,000,000 tokens→
Gemini 2.5 ProTextStandard$2.5000$15.0000N/AN/A1,000,000 tokens→
Gemini 3 Flash PreviewTextStandard$0.5000$3.0000$0.0500N/A1,000,000 tokens→
Gemini 3.1 Pro PreviewTextStandard$2.0000$12.0000$0.2000N/A1,000,000 tokens→
Gemini 3.1 Pro PreviewTextStandard$4.0000$18.0000N/AN/A1,000,000 tokens→
Nemotron-3 Super-120b-a12bTextStandard$0.2500$2.5000N/AN/A32,000 tokens→
Grok-4.1 Fast Non-ReasoningTextStandard$0.2000$0.5000$0.0500N/A128,000 tokens→
Claude Opus 4.7TextStandard$5.0000$25.0000$0.5000N/A200,000 tokens→
GPT-5.4 MiniTextStandard$0.7500$4.5000$0.0750N/A400,000 tokens→
GPT-5.4 NanoTextStandard$0.2000$1.2500$0.0200N/A400,000 tokens→
Claude Opus 5TextStandard$5.0000$25.0000$0.5000N/A1,000,000 tokens→
Claude Opus 4.8TextStandard$5.0000$25.0000$0.5000N/A1,000,000 tokens→
Claude Sonnet 5TextStandard$2.0000$10.0000$0.2000N/A1,000,000 tokens→
GPT-5.6 SolTextStandard$5.0000$30.0000$0.5000N/A1,050,000 tokens→
GPT-5.6 SolTextStandard$10.0000$45.0000$1.0000N/A1,050,000 tokens→
GPT-5.6 TerraTextStandard$2.0000$12.0000$0.2000N/A1,050,000 tokens→
GPT-5.6 TerraTextStandard$4.0000$18.0000$0.4000N/A1,050,000 tokens→
GPT-5.6 LunaTextStandard$0.2000$1.2000$0.0200N/A1,050,000 tokens→
GPT-5.6 LunaTextStandard$0.4000$1.8000$0.0400N/A1,050,000 tokens→
GPT-5.5TextStandard$5.0000$30.0000$0.5000N/A1,050,000 tokens→
GPT-5.5TextStandard$10.0000$45.0000N/AN/A1,050,000 tokens→
GPT-5TextStandard$1.2500$10.0000$0.1250N/A400,000 tokens→
Gemini 3.1 Flash LiteTextStandard$0.2500$1.5000$0.0250N/A1,048,576 tokens→
Gemini 3.5 FlashTextStandard$1.5000$9.0000$0.1500N/A1,048,576 tokens→
Gemini 3.5 Flash LiteTextStandard$0.3000$2.5000$0.0300N/A1,048,576 tokens→
Gemini 3.6 FlashTextStandard$1.5000$7.5000$0.1500N/A1,048,576 tokens→
Grok-4.5TextStandard$2.0000$6.0000$0.3000N/A500,000 tokens→
Grok-4.5TextStandard$4.0000$12.0000$0.6000N/A500,000 tokens→
Grok-4.3TextStandard$1.2500$2.5000$0.2000N/A1,000,000 tokens→
Grok-4.3TextStandard$2.5000$5.0000N/AN/A1,000,000 tokens→
Grok-4.20 ReasoningTextStandard$1.2500$2.5000$0.2000N/A1,000,000 tokens→
Grok-4.20 ReasoningTextStandard$2.5000$5.0000N/AN/A1,000,000 tokens→
Grok-4.20 Non-ReasoningTextStandard$1.2500$2.5000$0.2000N/A1,000,000 tokens→
Grok-4.20 Non-ReasoningTextStandard$2.5000$5.0000N/AN/A1,000,000 tokens→
Grok-4.20 Multi-AgentTextStandard$1.2500$2.5000$0.2000N/A1,000,000 tokens→
Grok-4.20 Multi-AgentTextStandard$2.5000$5.0000N/AN/A1,000,000 tokens→
GLM 5.2TextStandard$1.4000$4.4000$0.1400N/A1,000,000 tokens→
Kimi-k3TextStandard$3.0000$15.0000$0.3000N/A1,048,576 tokens→
Kimi-k2.7 CodeTextStandard$0.9500$4.0000$0.1900N/A262,144 tokens→
Claude Fable 5TextStandard$10.0000$50.0000$1.0000N/A1,000,000 tokens→
Grok-4.6TextStandard$2.0000$6.0000$0.5000N/A500,000 tokens→
Grok-4.6TextStandard$4.0000$12.0000$1.0000N/A500,000 tokens→
Nemotron-3 Ultra-550b-a55bTextStandard$0.2500$2.5000$0.2500N/A1,048,576 tokens→
Nemotron-3.5 Lightning-30b-a3bTextStandard$0.0115$0.1700$0.0012N/A1,048,576 tokens→
DeepSeek v4 Flash-0731TextStandard$0.1300$0.2600$0.0280N/A1,048,576 tokens→
Gemini 3.7 FlashTextStandard$0.7500$3.7500$0.0750N/A1,048,576 tokens→
GLM 5.3TextStandard$1.4000$4.4000$0.2600N/A1,000,000 tokens→
GLM 5.3 FlashTextStandard$0.1500$0.5000$0.0300N/A1,000,000 tokens→
Gemini 3.8 FlashTextStandard$0.7500$3.7500$0.0750N/A1,048,576 tokens→
Grok-4.7TextStandard$2.0000$6.0000$0.5000N/A500,000 tokens→
Grok-4.7TextStandard$4.0000$12.0000$1.0000N/A500,000 tokens→