Python 88.3%
TypeScript 7.6%
Shell 4.1%
1provider,model_or_service,dimension,tier,price,currency,unit,effective_notes,source,retrieved_at2openai,gpt-image-2.5-sunburst,text_input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-183openai,gpt-image-2.5-sunburst,cached_text_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-184openai,gpt-image-2.5-sunburst,image_input,standard,8.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-185openai,gpt-image-2.5-sunburst,cached_image_input,standard,2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-186openai,gpt-image-2.5-sunburst,image_output,standard,30.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-187openai,gpt-image-2.5-flare,text_input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-188openai,gpt-image-2.5-flare,cached_text_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-189openai,gpt-image-2.5-flare,image_input,standard,8.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1810openai,gpt-image-2.5-flare,cached_image_input,standard,2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1811openai,gpt-image-2.5-flare,image_output,standard,30.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1812openai,gpt-image-2,text_input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1813openai,gpt-image-2,cached_text_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1814openai,gpt-image-2,image_input,standard,8.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1815openai,gpt-image-2,cached_image_input,standard,2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1816openai,gpt-image-2,image_output,standard,30.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1817openai,gpt-image-1.5,text_input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1818openai,gpt-image-1.5,cached_text_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1819openai,gpt-image-1.5,image_input,standard,8.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1820openai,gpt-image-1.5,cached_image_input,standard,2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1821openai,gpt-image-1.5,image_output,standard,32.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1822openai,gpt-image-1.5,text_output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1823openai,chatgpt-image-latest,text_input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1824openai,chatgpt-image-latest,cached_text_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1825openai,chatgpt-image-latest,image_input,standard,8.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1826openai,chatgpt-image-latest,cached_image_input,standard,2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1827openai,chatgpt-image-latest,image_output,standard,32.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1828openai,chatgpt-image-latest,text_output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1829openai,gpt-image-1,text_input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1830openai,gpt-image-1,cached_text_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1831openai,gpt-image-1,image_input,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1832openai,gpt-image-1,cached_image_input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1833openai,gpt-image-1,image_output,standard,40.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1834openai,gpt-image-1-mini,text_input,standard,2.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1835openai,gpt-image-1-mini,cached_text_input,standard,0.2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1836openai,gpt-image-1-mini,image_input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1837openai,gpt-image-1-mini,cached_image_input,standard,0.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1838openai,gpt-image-1-mini,image_output,standard,8.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1839openai,gpt-image-2,text_input,batch,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1840openai,gpt-image-2,cached_text_input,batch,0.625,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1841openai,gpt-image-2,image_input,batch,4.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1842openai,gpt-image-2,cached_image_input,batch,1,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1843openai,gpt-image-2,image_output,batch,15.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1844openai,gpt-image-1.5,text_input,batch,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1845openai,gpt-image-1.5,cached_text_input,batch,0.63,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1846openai,gpt-image-1.5,image_input,batch,4.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1847openai,gpt-image-1.5,cached_image_input,batch,1,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1848openai,gpt-image-1.5,image_output,batch,16.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1849openai,gpt-image-1.5,text_output,batch,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1850openai,gpt-image-1-mini,text_input,batch,1.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1851openai,gpt-image-1-mini,cached_text_input,batch,0.1,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1852openai,gpt-image-1-mini,image_input,batch,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1853openai,gpt-image-1-mini,cached_image_input,batch,0.13,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1854openai,gpt-image-1-mini,image_output,batch,4.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1855openai,gpt-image-1,text_input,batch,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1856openai,gpt-image-1,cached_text_input,batch,0.63,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1857openai,gpt-image-1,image_input,batch,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1858openai,gpt-image-1,cached_image_input,batch,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1859openai,gpt-image-1,image_output,batch,20.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1860openai,chatgpt-image-latest,text_input,batch,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1861openai,chatgpt-image-latest,cached_text_input,batch,0.63,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1862openai,chatgpt-image-latest,image_input,batch,4.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1863openai,chatgpt-image-latest,cached_image_input,batch,1,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1864openai,chatgpt-image-latest,image_output,batch,16.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1865openai,chatgpt-image-latest,text_output,batch,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-1866openai,gpt-image-1.5,image_output low 1024x1024,standard,0.009,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1.5,2026-09-1867openai,gpt-image-1.5,image_output low 1024x1536,standard,0.013,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1.5,2026-09-1868openai,gpt-image-1.5,image_output low 1536x1024,standard,0.013,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1.5,2026-09-1869openai,gpt-image-1.5,image_output medium 1024x1024,standard,0.034,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1.5,2026-09-1870openai,gpt-image-1.5,image_output medium 1024x1536,standard,0.05,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1.5,2026-09-1871openai,gpt-image-1.5,image_output medium 1536x1024,standard,0.05,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1.5,2026-09-1872openai,gpt-image-1.5,image_output high 1024x1024,standard,0.133,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1.5,2026-09-1873openai,gpt-image-1.5,image_output high 1024x1536,standard,0.2,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1.5,2026-09-1874openai,gpt-image-1.5,image_output high 1536x1024,standard,0.2,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1.5,2026-09-1875openai,chatgpt-image-latest,image_output low 1024x1024,standard,0.009,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/chatgpt-image-latest,2026-09-1876openai,chatgpt-image-latest,image_output low 1024x1536,standard,0.013,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/chatgpt-image-latest,2026-09-1877openai,chatgpt-image-latest,image_output low 1536x1024,standard,0.013,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/chatgpt-image-latest,2026-09-1878openai,chatgpt-image-latest,image_output medium 1024x1024,standard,0.034,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/chatgpt-image-latest,2026-09-1879openai,chatgpt-image-latest,image_output medium 1024x1536,standard,0.05,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/chatgpt-image-latest,2026-09-1880openai,chatgpt-image-latest,image_output medium 1536x1024,standard,0.05,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/chatgpt-image-latest,2026-09-1881openai,chatgpt-image-latest,image_output high 1024x1024,standard,0.133,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/chatgpt-image-latest,2026-09-1882openai,chatgpt-image-latest,image_output high 1024x1536,standard,0.2,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/chatgpt-image-latest,2026-09-1883openai,chatgpt-image-latest,image_output high 1536x1024,standard,0.2,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/chatgpt-image-latest,2026-09-1884openai,gpt-image-1,image_output low 1024x1024,standard,0.011,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1,2026-09-1885openai,gpt-image-1,image_output low 1024x1536,standard,0.016,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1,2026-09-1886openai,gpt-image-1,image_output low 1536x1024,standard,0.016,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1,2026-09-1887openai,gpt-image-1,image_output medium 1024x1024,standard,0.042,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1,2026-09-1888openai,gpt-image-1,image_output medium 1024x1536,standard,0.063,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1,2026-09-1889openai,gpt-image-1,image_output medium 1536x1024,standard,0.063,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1,2026-09-1890openai,gpt-image-1,image_output high 1024x1024,standard,0.167,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1,2026-09-1891openai,gpt-image-1,image_output high 1024x1536,standard,0.25,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1,2026-09-1892openai,gpt-image-1,image_output high 1536x1024,standard,0.25,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1,2026-09-1893openai,gpt-image-1-mini,image_output low 1024x1024,standard,0.005,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1-mini,2026-09-1894openai,gpt-image-1-mini,image_output low 1024x1536,standard,0.006,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1-mini,2026-09-1895openai,gpt-image-1-mini,image_output low 1536x1024,standard,0.006,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1-mini,2026-09-1896openai,gpt-image-1-mini,image_output medium 1024x1024,standard,0.011,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1-mini,2026-09-1897openai,gpt-image-1-mini,image_output medium 1024x1536,standard,0.015,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1-mini,2026-09-1898openai,gpt-image-1-mini,image_output medium 1536x1024,standard,0.015,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1-mini,2026-09-1899openai,gpt-image-1-mini,image_output high 1024x1024,standard,0.036,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1-mini,2026-09-18100openai,gpt-image-1-mini,image_output high 1024x1536,standard,0.052,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1-mini,2026-09-18101openai,gpt-image-1-mini,image_output high 1536x1024,standard,0.052,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/models/gpt-image-1-mini,2026-09-18102openai,gpt-image-2,image_output low 1024x1024,standard,0.006,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/guides/image-generation,2026-09-18103openai,gpt-image-2,image_output low 1024x1536,standard,0.005,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/guides/image-generation,2026-09-18104openai,gpt-image-2,image_output low 1536x1024,standard,0.005,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/guides/image-generation,2026-09-18105openai,gpt-image-2,image_output medium 1024x1024,standard,0.053,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/guides/image-generation,2026-09-18106openai,gpt-image-2,image_output medium 1024x1536,standard,0.041,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/guides/image-generation,2026-09-18107openai,gpt-image-2,image_output medium 1536x1024,standard,0.041,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/guides/image-generation,2026-09-18108openai,gpt-image-2,image_output high 1024x1024,standard,0.211,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/guides/image-generation,2026-09-18109openai,gpt-image-2,image_output high 1024x1536,standard,0.165,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/guides/image-generation,2026-09-18110openai,gpt-image-2,image_output high 1536x1024,standard,0.165,USD,per image,Output-token equivalent; text/image input tokens billed on top. gpt-image-2 row from the guide's comparison table.,https://developers.openai.com/api/docs/guides/image-generation,2026-09-18111openai,sora-2,video_output 720p (720x1280|1280x720),standard,0.1,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-18112openai,sora-2,video_output 720p (720x1280|1280x720),batch,0.05,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-18113openai,sora-2-pro,video_output 720p (720x1280|1280x720),standard,0.3,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-18114openai,sora-2-pro,video_output 720p (720x1280|1280x720),batch,0.15,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-18115openai,sora-2-pro,video_output 1024p (1024x1792|1792x1024),standard,0.5,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-18116openai,sora-2-pro,video_output 1024p (1024x1792|1792x1024),batch,0.25,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-18117openai,sora-2-pro,video_output 1080p (1080x1920|1920x1080),standard,0.7,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-18118openai,sora-2-pro,video_output 1080p (1080x1920|1920x1080),batch,0.35,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-18119openai,text-embedding-3-small,input,standard,0.02,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-18120openai,text-embedding-3-large,input,standard,0.13,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-18121openai,text-embedding-ada-002,input,standard,0.1,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-18122openai,omni-moderation-latest,input,standard,0.0,USD,per call,Free,https://developers.openai.com/api/docs/pricing,2026-09-18123openai,content_provenance_checks,call,standard,0.0,USD,per call,No price listed on the pricing page; strict rate limits instead (UNVERIFIED that it is free),https://developers.openai.com/api/docs/pricing,2026-09-18124anthropic,claude-fable-5-1,input,standard,10,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18125anthropic,claude-fable-5-1,output,standard,50,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18126anthropic,claude-fable-5-1,cached_input_write_5m,standard,12.5,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18127anthropic,claude-fable-5-1,cached_input_write_1h,standard,20,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18128anthropic,claude-fable-5-1,cached_input_read,standard,0.25,USD,per 1M tokens,0.025x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18129anthropic,claude-fable-5-1,input,batch,5.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18130anthropic,claude-fable-5-1,output,batch,25.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18131anthropic,claude-mythos-5-1,input,standard,10,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18132anthropic,claude-mythos-5-1,output,standard,50,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18133anthropic,claude-mythos-5-1,cached_input_write_5m,standard,12.5,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18134anthropic,claude-mythos-5-1,cached_input_write_1h,standard,20,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18135anthropic,claude-mythos-5-1,cached_input_read,standard,0.25,USD,per 1M tokens,0.025x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18136anthropic,claude-mythos-5-1,input,batch,5.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18137anthropic,claude-mythos-5-1,output,batch,25.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18138anthropic,claude-fable-5,input,standard,10,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18139anthropic,claude-fable-5,output,standard,50,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18140anthropic,claude-fable-5,cached_input_write_5m,standard,12.5,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18141anthropic,claude-fable-5,cached_input_write_1h,standard,20,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18142anthropic,claude-fable-5,cached_input_read,standard,1.0,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18143anthropic,claude-fable-5,input,batch,5.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18144anthropic,claude-fable-5,output,batch,25.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18145anthropic,claude-mythos-5,input,standard,10,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18146anthropic,claude-mythos-5,output,standard,50,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18147anthropic,claude-mythos-5,cached_input_write_5m,standard,12.5,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18148anthropic,claude-mythos-5,cached_input_write_1h,standard,20,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18149anthropic,claude-mythos-5,cached_input_read,standard,1.0,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18150anthropic,claude-mythos-5,input,batch,5.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18151anthropic,claude-mythos-5,output,batch,25.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18152anthropic,claude-opus-5,input,standard,5,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18153anthropic,claude-opus-5,output,standard,25,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18154anthropic,claude-opus-5,cached_input_write_5m,standard,6.25,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18155anthropic,claude-opus-5,cached_input_write_1h,standard,10,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18156anthropic,claude-opus-5,cached_input_read,standard,0.5,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18157anthropic,claude-opus-5,input,batch,2.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18158anthropic,claude-opus-5,output,batch,12.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18159anthropic,claude-opus-5,input,fast,10,USD,per 1M tokens,speed: fast (research preview); applies across full context; caching + data residency multipliers stack; not available on Batch or clouds,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18160anthropic,claude-opus-5,output,fast,50,USD,per 1M tokens,speed: fast (research preview),https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18161anthropic,claude-opus-5,tool_use_system_prompt_overhead_tokens,standard,406,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18162anthropic,claude-opus-4-8,input,standard,5,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18163anthropic,claude-opus-4-8,output,standard,25,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18164anthropic,claude-opus-4-8,cached_input_write_5m,standard,6.25,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18165anthropic,claude-opus-4-8,cached_input_write_1h,standard,10,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18166anthropic,claude-opus-4-8,cached_input_read,standard,0.5,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18167anthropic,claude-opus-4-8,input,batch,2.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18168anthropic,claude-opus-4-8,output,batch,12.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18169anthropic,claude-opus-4-8,input,fast,10,USD,per 1M tokens,speed: fast (research preview); applies across full context; caching + data residency multipliers stack; not available on Batch or clouds,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18170anthropic,claude-opus-4-8,output,fast,50,USD,per 1M tokens,speed: fast (research preview),https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18171anthropic,claude-opus-4-8,tool_use_system_prompt_overhead_tokens,standard,410,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18172anthropic,claude-opus-4-7,input,standard,5,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18173anthropic,claude-opus-4-7,output,standard,25,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18174anthropic,claude-opus-4-7,cached_input_write_5m,standard,6.25,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18175anthropic,claude-opus-4-7,cached_input_write_1h,standard,10,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18176anthropic,claude-opus-4-7,cached_input_read,standard,0.5,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18177anthropic,claude-opus-4-7,input,batch,2.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18178anthropic,claude-opus-4-7,output,batch,12.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18179anthropic,claude-opus-4-7,tool_use_system_prompt_overhead_tokens,standard,804,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18180anthropic,claude-opus-4-6,input,standard,5,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18181anthropic,claude-opus-4-6,output,standard,25,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18182anthropic,claude-opus-4-6,cached_input_write_5m,standard,6.25,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18183anthropic,claude-opus-4-6,cached_input_write_1h,standard,10,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18184anthropic,claude-opus-4-6,cached_input_read,standard,0.5,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18185anthropic,claude-opus-4-6,input,batch,2.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18186anthropic,claude-opus-4-6,output,batch,12.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18187anthropic,claude-opus-4-6,tool_use_system_prompt_overhead_tokens,standard,589,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18188anthropic,claude-opus-4-5-20251101,input,standard,5,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18189anthropic,claude-opus-4-5-20251101,output,standard,25,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18190anthropic,claude-opus-4-5-20251101,cached_input_write_5m,standard,6.25,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18191anthropic,claude-opus-4-5-20251101,cached_input_write_1h,standard,10,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18192anthropic,claude-opus-4-5-20251101,cached_input_read,standard,0.5,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18193anthropic,claude-opus-4-5-20251101,input,batch,2.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18194anthropic,claude-opus-4-5-20251101,output,batch,12.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18195anthropic,claude-opus-4-5-20251101,tool_use_system_prompt_overhead_tokens,standard,588,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18196anthropic,claude-sonnet-5,input,standard,2,USD,per 1M tokens,introductory $2/$10 made permanent on 2026-08-10 (planned $3/$15 increase cancelled),https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18197anthropic,claude-sonnet-5,output,standard,10,USD,per 1M tokens,introductory $2/$10 made permanent on 2026-08-10 (planned $3/$15 increase cancelled),https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18198anthropic,claude-sonnet-5,cached_input_write_5m,standard,2.5,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18199anthropic,claude-sonnet-5,cached_input_write_1h,standard,4,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18200anthropic,claude-sonnet-5,cached_input_read,standard,0.2,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18201anthropic,claude-sonnet-5,input,batch,1.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18202anthropic,claude-sonnet-5,output,batch,5.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18203anthropic,claude-sonnet-5,tool_use_system_prompt_overhead_tokens,standard,474,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18204anthropic,claude-sonnet-4-6,input,standard,3,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18205anthropic,claude-sonnet-4-6,output,standard,15,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18206anthropic,claude-sonnet-4-6,cached_input_write_5m,standard,3.75,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18207anthropic,claude-sonnet-4-6,cached_input_write_1h,standard,6,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18208anthropic,claude-sonnet-4-6,cached_input_read,standard,0.3,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18209anthropic,claude-sonnet-4-6,input,batch,1.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18210anthropic,claude-sonnet-4-6,output,batch,7.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18211anthropic,claude-sonnet-4-6,tool_use_system_prompt_overhead_tokens,standard,589,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18212anthropic,claude-sonnet-4-5-20250929,input,standard,3,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18213anthropic,claude-sonnet-4-5-20250929,output,standard,15,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18214anthropic,claude-sonnet-4-5-20250929,cached_input_write_5m,standard,3.75,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18215anthropic,claude-sonnet-4-5-20250929,cached_input_write_1h,standard,6,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18216anthropic,claude-sonnet-4-5-20250929,cached_input_read,standard,0.3,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18217anthropic,claude-sonnet-4-5-20250929,input,batch,1.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18218anthropic,claude-sonnet-4-5-20250929,output,batch,7.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18219anthropic,claude-sonnet-4-5-20250929,tool_use_system_prompt_overhead_tokens,standard,588,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18220anthropic,claude-haiku-4-5-20251001,input,standard,1,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18221anthropic,claude-haiku-4-5-20251001,output,standard,5,USD,per 1M tokens,,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18222anthropic,claude-haiku-4-5-20251001,cached_input_write_5m,standard,1.25,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18223anthropic,claude-haiku-4-5-20251001,cached_input_write_1h,standard,2,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18224anthropic,claude-haiku-4-5-20251001,cached_input_read,standard,0.1,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18225anthropic,claude-haiku-4-5-20251001,input,batch,0.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18226anthropic,claude-haiku-4-5-20251001,output,batch,2.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18227anthropic,claude-haiku-4-5-20251001,tool_use_system_prompt_overhead_tokens,standard,588,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18228anthropic,claude-opus-4-1-20250805,input,standard,15,USD,per 1M tokens,retired on the Claude API; price kept for Bedrock/Google Cloud availability,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18229anthropic,claude-opus-4-1-20250805,output,standard,75,USD,per 1M tokens,retired on the Claude API; price kept for Bedrock/Google Cloud availability,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18230anthropic,claude-opus-4-1-20250805,cached_input_write_5m,standard,18.75,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18231anthropic,claude-opus-4-1-20250805,cached_input_write_1h,standard,30,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18232anthropic,claude-opus-4-1-20250805,cached_input_read,standard,1.5,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18233anthropic,claude-opus-4-1-20250805,input,batch,7.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18234anthropic,claude-opus-4-1-20250805,output,batch,37.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18235anthropic,claude-opus-4-1-20250805,tool_use_system_prompt_overhead_tokens,standard,315,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18236anthropic,claude-opus-4-20250514,input,standard,15,USD,per 1M tokens,retired on the Claude API; price kept for Bedrock/Google Cloud availability,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18237anthropic,claude-opus-4-20250514,output,standard,75,USD,per 1M tokens,retired on the Claude API; price kept for Bedrock/Google Cloud availability,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18238anthropic,claude-opus-4-20250514,cached_input_write_5m,standard,18.75,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18239anthropic,claude-opus-4-20250514,cached_input_write_1h,standard,30,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18240anthropic,claude-opus-4-20250514,cached_input_read,standard,1.5,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18241anthropic,claude-opus-4-20250514,input,batch,7.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18242anthropic,claude-opus-4-20250514,output,batch,37.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18243anthropic,claude-opus-4-20250514,tool_use_system_prompt_overhead_tokens,standard,315,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18244anthropic,claude-sonnet-4-20250514,input,standard,3,USD,per 1M tokens,retired on the Claude API; price kept for Bedrock/Google Cloud availability,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18245anthropic,claude-sonnet-4-20250514,output,standard,15,USD,per 1M tokens,retired on the Claude API; price kept for Bedrock/Google Cloud availability,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18246anthropic,claude-sonnet-4-20250514,cached_input_write_5m,standard,3.75,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18247anthropic,claude-sonnet-4-20250514,cached_input_write_1h,standard,6,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18248anthropic,claude-sonnet-4-20250514,cached_input_read,standard,0.3,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18249anthropic,claude-sonnet-4-20250514,input,batch,1.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18250anthropic,claude-sonnet-4-20250514,output,batch,7.5,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18251anthropic,claude-sonnet-4-20250514,tool_use_system_prompt_overhead_tokens,standard,315,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18252anthropic,claude-3-5-haiku-20241022,input,standard,0.8,USD,per 1M tokens,retired on the Claude API; price kept for Bedrock/Google Cloud availability,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18253anthropic,claude-3-5-haiku-20241022,output,standard,4,USD,per 1M tokens,retired on the Claude API; price kept for Bedrock/Google Cloud availability,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18254anthropic,claude-3-5-haiku-20241022,cached_input_write_5m,standard,1.0,USD,per 1M tokens,1.25x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18255anthropic,claude-3-5-haiku-20241022,cached_input_write_1h,standard,1.6,USD,per 1M tokens,2x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18256anthropic,claude-3-5-haiku-20241022,cached_input_read,standard,0.08,USD,per 1M tokens,0.1x base input,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18257anthropic,claude-3-5-haiku-20241022,input,batch,0.4,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18258anthropic,claude-3-5-haiku-20241022,output,batch,2.0,USD,per 1M tokens,"Message Batches API, 50% off",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18259anthropic,claude-3-5-haiku-20241022,tool_use_system_prompt_overhead_tokens,standard,355,USD,input tokens per request,tool_choice any/tool,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18260anthropic,claude-opus-4-7,fast_mode,fast,,USD,per 1M tokens,fast mode removed 2026-07-24: speed: fast returns an error,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18261anthropic,claude-opus-4-6,fast_mode,fast,,USD,per 1M tokens,fast mode removed 2026-06-29: speed: fast runs at standard speed and standard price; usage.speed reports standard,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18262anthropic,long_context_1M,input_over_200k_multiplier,standard,1.0,USD,multiplier,Claude 4.6+ and Mythos Preview: full 1M context at standard pricing (no long-context premium); caching and batch discounts apply across the window,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18263anthropic,inference_geo=us,all_token_dimensions_multiplier,standard,1.1,USD,multiplier,Claude 4.6+ only; global (default) = 1.0; also Foundry US Data Zone Standard; 400 on earlier models,https://platform.claude.com/docs/en/manage-claude/data-residency,2026-09-18264anthropic,bedrock_vertex_regional_endpoints,regional_or_multiregion_premium,standard,0.1,USD,fraction over global endpoint price,Sonnet 4.5 / Haiku 4.5 / Opus 4.5 and later on partner clouds; provider invoices,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18265anthropic,claude_platform_on_aws,claude_consumption_unit,standard,0.01,USD,per CCU,100 CCU = $1 of standard list price after discounts; hourly metering to AWS Marketplace,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18266anthropic,microsoft_foundry,claude_consumption_unit,standard,0.01,USD,per CCU,"Azure Marketplace CCU billing, same conversion",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18267anthropic,web_search,search,standard,10.0,USD,"per 1,000 searches",plus token costs for search results; errors not billed; each search = 1 use regardless of result count,https://platform.claude.com/docs/en/agents-and-tools/tool-use/web-search-tool,2026-09-18268anthropic,web_fetch,fetch,standard,0.0,USD,per fetch,"no extra charge; fetched content billed as input tokens (~2,500 tokens per 10 kB page)",https://platform.claude.com/docs/en/agents-and-tools/tool-use/web-fetch-tool,2026-09-18269anthropic,code_execution,container_hour,standard,0.05,USD,per hour per container,"beyond 1,550 free hours/org/month; 5-minute minimum per execution; billed even if tool not called when files are preloaded",https://platform.claude.com/docs/en/agents-and-tools/tool-use/code-execution-tool,2026-09-18270anthropic,code_execution,free_hours_per_month,standard,1550,USD,hours per organization per month,free tier,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18271anthropic,code_execution,with_web_search_or_web_fetch,standard,0.0,USD,per request,free when web_search_20260209+/web_fetch_20260209+ is in the request (only token costs),https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18272anthropic,managed_agents,session_runtime,standard,0.08,USD,per session-hour,metered to the ms while status=running; replaces container-hour billing; tokens at model rates; no batch discount,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18273anthropic,bash_20250124,tool_definition_overhead_tokens,standard,244,USD,input tokens per request,"Opus 4.6, Sonnet 4.6 and earlier",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18274anthropic,text_editor_20250429,tool_definition_overhead_tokens,standard,700,USD,input tokens per request,Claude 4.x text editor,https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18275anthropic,computer_toolset_20260801,toolset_definition_overhead_tokens,standard,4500,USD,input tokens per request,"~4,520 on Fable 5/Mythos 5/Opus 5/Opus 4.8, ~4,590 on Sonnet 5; disabling zoom saves ~410; screenshots billed as image input",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18276anthropic,computer_20251124|computer_20250124,tool_definition_overhead_tokens,standard,735,USD,input tokens per request,plus 466-499 system prompt tokens (measured with computer_20250124),https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18277anthropic,browser_toolset_20260801,toolset_definition_overhead_tokens,standard,6600,USD,input tokens per request,"~6,610 Fable 5/Mythos 5/Opus 5/Opus 4.8, ~6,670 Sonnet 5; all four optional members +~880",https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18278anthropic,priority_tier,capacity_commitment,priority,,USD,contract,"no longer available for purchase; existing commitments run to contract end; token prices unchanged; burndown: cache read 0.1, 5m write 1.25, 1h write 2.0, inference_geo us 1.1",https://platform.claude.com/docs/en/api/service-tiers,2026-09-18279anthropic,files_api,storage,standard,,USD,n/a,no storage price documented on the pricing page; Files API ~500 RPM; files can expire via expires_in_seconds,https://platform.claude.com/docs/en/build-with-claude/files,2026-09-18280anthropic,token_counting,request,standard,0.0,USD,per request,"free; separate RPM limits (Start 5,000 / Build 10,000 / Scale 20,000)",https://platform.claude.com/docs/en/build-with-claude/token-counting,2026-09-18281anthropic,claude_code,n/a,standard,,USD,n/a,not priced on the platform pricing page (consumer/Team plans; API usage at model rates),https://platform.claude.com/docs/en/about-claude/pricing,2026-09-18282gemini,gemini-3.8-flash,input,standard,0.75,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $1.5,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18283gemini,gemini-3.8-flash,output,standard,3.75,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $7.5; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18284gemini,gemini-3.8-flash,cached_input,standard,0.075,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.15,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18285gemini,gemini-3.8-flash,cache_storage_hour,standard,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18286gemini,gemini-3.8-flash,input,batch,0.375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.75,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18287gemini,gemini-3.8-flash,output,batch,1.875,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $3.75; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18288gemini,gemini-3.8-flash,cached_input,batch,0.0375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.075,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18289gemini,gemini-3.8-flash,cache_storage_hour,batch,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18290gemini,gemini-3.8-flash,input,flex,0.375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.75,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18291gemini,gemini-3.8-flash,output,flex,1.875,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $3.75; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18292gemini,gemini-3.8-flash,cached_input,flex,0.0375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.075,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18293gemini,gemini-3.8-flash,cache_storage_hour,flex,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18294gemini,gemini-3.8-flash,input,priority,1.35,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $2.7,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18295gemini,gemini-3.8-flash,output,priority,6.75,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $13.5; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18296gemini,gemini-3.8-flash,cached_input,priority,0.135,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.27,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18297gemini,gemini-3.8-flash,cache_storage_hour,priority,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18298gemini,gemini-3.8-flash,free_tier,free,0,USD,per 1M tokens,input/output/caching free of charge (standard & priority rows); Batch/Flex not available,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18299gemini,gemini-3.8-flash,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18300gemini,gemini-3.8-flash,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.8-flash,2026-09-18301gemini,gemini-3.5-flash,input,standard,1.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18302gemini,gemini-3.5-flash,output,standard,9.0,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18303gemini,gemini-3.5-flash,cached_input,standard,0.15,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18304gemini,gemini-3.5-flash,cache_storage_hour,standard,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18305gemini,gemini-3.5-flash,input,batch,0.75,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18306gemini,gemini-3.5-flash,output,batch,4.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18307gemini,gemini-3.5-flash,cached_input,batch,0.075,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18308gemini,gemini-3.5-flash,cache_storage_hour,batch,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18309gemini,gemini-3.5-flash,input,flex,0.75,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18310gemini,gemini-3.5-flash,output,flex,4.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18311gemini,gemini-3.5-flash,cached_input,flex,0.08,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18312gemini,gemini-3.5-flash,cache_storage_hour,flex,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18313gemini,gemini-3.5-flash,input,priority,2.7,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18314gemini,gemini-3.5-flash,output,priority,16.2,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18315gemini,gemini-3.5-flash,cached_input,priority,0.27,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18316gemini,gemini-3.5-flash,cache_storage_hour,priority,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18317gemini,gemini-3.5-flash,free_tier,free,0,USD,per 1M tokens,input/output/caching free of charge; Batch/Flex not available,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18318gemini,gemini-3.5-flash,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18319gemini,gemini-3.5-flash,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash,2026-09-18320gemini,gemini-3.5-flash-lite,input,standard,0.3,USD,per 1M tokens,text / image / video / audio same price,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18321gemini,gemini-3.5-flash-lite,output,standard,2.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18322gemini,gemini-3.5-flash-lite,cached_input,standard,0.03,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18323gemini,gemini-3.5-flash-lite,cache_storage_hour,standard,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18324gemini,gemini-3.5-flash-lite,input,batch,0.15,USD,per 1M tokens,text / image / video / audio same price,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18325gemini,gemini-3.5-flash-lite,output,batch,1.25,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18326gemini,gemini-3.5-flash-lite,cached_input,batch,0.02,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18327gemini,gemini-3.5-flash-lite,cache_storage_hour,batch,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18328gemini,gemini-3.5-flash-lite,input,flex,0.15,USD,per 1M tokens,text / image / video / audio same price,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18329gemini,gemini-3.5-flash-lite,output,flex,1.25,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18330gemini,gemini-3.5-flash-lite,cached_input,flex,0.02,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18331gemini,gemini-3.5-flash-lite,cache_storage_hour,flex,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18332gemini,gemini-3.5-flash-lite,input,priority,0.54,USD,per 1M tokens,text / image / video / audio same price,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18333gemini,gemini-3.5-flash-lite,output,priority,4.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18334gemini,gemini-3.5-flash-lite,cached_input,priority,0.05,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18335gemini,gemini-3.5-flash-lite,cache_storage_hour,priority,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18336gemini,gemini-3.5-flash-lite,free_tier,free,0,USD,per 1M tokens,input/output free of charge on all four rows (page lists Batch/Flex as 'Free of charge' too); caching not available on free tier,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18337gemini,gemini-3.5-flash-lite,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18338gemini,gemini-3.5-flash-lite,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.5-flash-lite,2026-09-18339gemini,gemini-3.1-flash-lite,input,standard,0.25,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18340gemini,gemini-3.1-flash-lite,audio_input,standard,0.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18341gemini,gemini-3.1-flash-lite,output,standard,1.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18342gemini,gemini-3.1-flash-lite,cached_input,standard,0.025,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18343gemini,gemini-3.1-flash-lite,cached_audio_input,standard,0.05,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18344gemini,gemini-3.1-flash-lite,cache_storage_hour,standard,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18345gemini,gemini-3.1-flash-lite,input,batch,0.125,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18346gemini,gemini-3.1-flash-lite,audio_input,batch,0.25,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18347gemini,gemini-3.1-flash-lite,output,batch,0.75,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18348gemini,gemini-3.1-flash-lite,cached_input,batch,0.0125,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18349gemini,gemini-3.1-flash-lite,cached_audio_input,batch,0.025,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18350gemini,gemini-3.1-flash-lite,cache_storage_hour,batch,0.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18351gemini,gemini-3.1-flash-lite,input,flex,0.125,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18352gemini,gemini-3.1-flash-lite,audio_input,flex,0.25,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18353gemini,gemini-3.1-flash-lite,output,flex,0.75,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18354gemini,gemini-3.1-flash-lite,cached_input,flex,0.0125,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18355gemini,gemini-3.1-flash-lite,cached_audio_input,flex,0.025,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18356gemini,gemini-3.1-flash-lite,cache_storage_hour,flex,0.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18357gemini,gemini-3.1-flash-lite,input,priority,0.45,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18358gemini,gemini-3.1-flash-lite,audio_input,priority,0.9,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18359gemini,gemini-3.1-flash-lite,output,priority,2.7,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18360gemini,gemini-3.1-flash-lite,cached_input,priority,0.045,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18361gemini,gemini-3.1-flash-lite,cached_audio_input,priority,0.09,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18362gemini,gemini-3.1-flash-lite,cache_storage_hour,priority,1.8,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18363gemini,gemini-3.1-flash-lite,free_tier,free,0,USD,per 1M tokens,input/output free of charge; caching not available on free tier,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18364gemini,gemini-3.1-flash-lite,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18365gemini,gemini-3.1-flash-lite,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-flash-lite,2026-09-18366gemini,gemini-3-flash-preview,input,standard,0.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18367gemini,gemini-3-flash-preview,audio_input,standard,1.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18368gemini,gemini-3-flash-preview,output,standard,3.0,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18369gemini,gemini-3-flash-preview,cached_input,standard,0.05,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18370gemini,gemini-3-flash-preview,cached_audio_input,standard,0.1,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18371gemini,gemini-3-flash-preview,cache_storage_hour,standard,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18372gemini,gemini-3-flash-preview,input,batch,0.25,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18373gemini,gemini-3-flash-preview,audio_input,batch,0.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18374gemini,gemini-3-flash-preview,output,batch,1.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18375gemini,gemini-3-flash-preview,cached_input,batch,0.05,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18376gemini,gemini-3-flash-preview,cached_audio_input,batch,0.1,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18377gemini,gemini-3-flash-preview,cache_storage_hour,batch,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18378gemini,gemini-3-flash-preview,input,flex,0.25,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18379gemini,gemini-3-flash-preview,audio_input,flex,0.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18380gemini,gemini-3-flash-preview,output,flex,1.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18381gemini,gemini-3-flash-preview,cached_input,flex,0.05,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18382gemini,gemini-3-flash-preview,cached_audio_input,flex,0.1,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18383gemini,gemini-3-flash-preview,cache_storage_hour,flex,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18384gemini,gemini-3-flash-preview,input,priority,0.9,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18385gemini,gemini-3-flash-preview,audio_input,priority,1.8,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18386gemini,gemini-3-flash-preview,output,priority,5.4,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18387gemini,gemini-3-flash-preview,cached_input,priority,0.09,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18388gemini,gemini-3-flash-preview,cached_audio_input,priority,0.18,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18389gemini,gemini-3-flash-preview,cache_storage_hour,priority,1.8,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18390gemini,gemini-3-flash-preview,free_tier,free,0,USD,per 1M tokens,input/output/caching free of charge; Batch/Flex not available,https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18391gemini,gemini-3-flash-preview,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18392gemini,gemini-3-flash-preview,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-3-flash-preview,2026-09-18393gemini,gemini-3.1-pro-preview,input,standard,2.0,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18394gemini,gemini-3.1-pro-preview,input_over_200k,standard,4.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18395gemini,gemini-3.1-pro-preview,output,standard,12.0,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18396gemini,gemini-3.1-pro-preview,output_over_200k,standard,18.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18397gemini,gemini-3.1-pro-preview,cached_input,standard,0.2,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18398gemini,gemini-3.1-pro-preview,cached_input_over_200k,standard,0.4,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18399gemini,gemini-3.1-pro-preview,cache_storage_hour,standard,4.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18400gemini,gemini-3.1-pro-preview,input,batch,1.0,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18401gemini,gemini-3.1-pro-preview,input_over_200k,batch,2.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18402gemini,gemini-3.1-pro-preview,output,batch,6.0,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18403gemini,gemini-3.1-pro-preview,output_over_200k,batch,9.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18404gemini,gemini-3.1-pro-preview,cached_input,batch,0.2,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18405gemini,gemini-3.1-pro-preview,cached_input_over_200k,batch,0.4,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18406gemini,gemini-3.1-pro-preview,cache_storage_hour,batch,4.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18407gemini,gemini-3.1-pro-preview,input,flex,1.0,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18408gemini,gemini-3.1-pro-preview,input_over_200k,flex,2.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18409gemini,gemini-3.1-pro-preview,output,flex,6.0,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18410gemini,gemini-3.1-pro-preview,output_over_200k,flex,9.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18411gemini,gemini-3.1-pro-preview,cached_input,flex,0.2,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18412gemini,gemini-3.1-pro-preview,cached_input_over_200k,flex,0.4,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18413gemini,gemini-3.1-pro-preview,cache_storage_hour,flex,4.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18414gemini,gemini-3.1-pro-preview,input,priority,3.6,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18415gemini,gemini-3.1-pro-preview,input_over_200k,priority,7.2,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18416gemini,gemini-3.1-pro-preview,output,priority,21.6,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18417gemini,gemini-3.1-pro-preview,output_over_200k,priority,32.4,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18418gemini,gemini-3.1-pro-preview,cached_input,priority,0.36,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18419gemini,gemini-3.1-pro-preview,cached_input_over_200k,priority,0.72,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18420gemini,gemini-3.1-pro-preview,cache_storage_hour,priority,8.1,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18421gemini,gemini-3.1-pro-preview,free_tier,free,0,USD,per 1M tokens,Not available (paid tier only),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18422gemini,gemini-3.1-pro-preview,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18423gemini,gemini-3.1-pro-preview,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview,2026-09-18424gemini,gemini-2.5-pro,input,standard,1.25,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18425gemini,gemini-2.5-pro,input_over_200k,standard,2.5,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18426gemini,gemini-2.5-pro,output,standard,10.0,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18427gemini,gemini-2.5-pro,output_over_200k,standard,15.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18428gemini,gemini-2.5-pro,cached_input,standard,0.125,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18429gemini,gemini-2.5-pro,cached_input_over_200k,standard,0.25,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18430gemini,gemini-2.5-pro,cache_storage_hour,standard,4.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18431gemini,gemini-2.5-pro,input,batch,0.625,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18432gemini,gemini-2.5-pro,input_over_200k,batch,1.25,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18433gemini,gemini-2.5-pro,output,batch,5.0,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18434gemini,gemini-2.5-pro,output_over_200k,batch,7.5,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18435gemini,gemini-2.5-pro,cached_input,batch,0.125,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18436gemini,gemini-2.5-pro,cached_input_over_200k,batch,0.25,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18437gemini,gemini-2.5-pro,cache_storage_hour,batch,4.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18438gemini,gemini-2.5-pro,input,flex,0.625,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18439gemini,gemini-2.5-pro,input_over_200k,flex,1.25,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18440gemini,gemini-2.5-pro,output,flex,5.0,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18441gemini,gemini-2.5-pro,output_over_200k,flex,7.5,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18442gemini,gemini-2.5-pro,cached_input,flex,0.125,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18443gemini,gemini-2.5-pro,cached_input_over_200k,flex,0.25,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18444gemini,gemini-2.5-pro,cache_storage_hour,flex,4.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18445gemini,gemini-2.5-pro,input,priority,2.25,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18446gemini,gemini-2.5-pro,input_over_200k,priority,4.5,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18447gemini,gemini-2.5-pro,output,priority,18.0,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18448gemini,gemini-2.5-pro,output_over_200k,priority,27.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18449gemini,gemini-2.5-pro,cached_input,priority,0.225,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18450gemini,gemini-2.5-pro,cached_input_over_200k,priority,0.45,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18451gemini,gemini-2.5-pro,cache_storage_hour,priority,8.1,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18452gemini,gemini-2.5-pro,free_tier,free,0,USD,per 1M tokens,"input/output free of charge (standard/priority rows); caching, Batch, Flex not available",https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18453gemini,gemini-2.5-pro,grounding_google_search,standard,35.0,USD,per 1K grounded prompts,"1,500 RPD free, then $35 per 1,000 grounded prompts",https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18454gemini,gemini-2.5-pro,grounding_google_maps,standard,25.0,USD,per 1K grounded prompts,"10,000 RPD free, then $25 per 1,000 grounded prompts",https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-pro,2026-09-18455gemini,gemini-2.5-flash,input,standard,0.3,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18456gemini,gemini-2.5-flash,audio_input,standard,1.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18457gemini,gemini-2.5-flash,output,standard,2.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18458gemini,gemini-2.5-flash,cached_input,standard,0.03,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18459gemini,gemini-2.5-flash,cached_audio_input,standard,0.1,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18460gemini,gemini-2.5-flash,cache_storage_hour,standard,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18461gemini,gemini-2.5-flash,input,batch,0.15,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18462gemini,gemini-2.5-flash,audio_input,batch,0.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18463gemini,gemini-2.5-flash,output,batch,1.25,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18464gemini,gemini-2.5-flash,cached_input,batch,0.03,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18465gemini,gemini-2.5-flash,cached_audio_input,batch,0.1,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18466gemini,gemini-2.5-flash,cache_storage_hour,batch,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18467gemini,gemini-2.5-flash,input,flex,0.15,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18468gemini,gemini-2.5-flash,audio_input,flex,0.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18469gemini,gemini-2.5-flash,output,flex,1.25,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18470gemini,gemini-2.5-flash,cached_input,flex,0.03,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18471gemini,gemini-2.5-flash,cached_audio_input,flex,0.1,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18472gemini,gemini-2.5-flash,cache_storage_hour,flex,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18473gemini,gemini-2.5-flash,input,priority,0.54,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18474gemini,gemini-2.5-flash,audio_input,priority,1.8,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18475gemini,gemini-2.5-flash,output,priority,4.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18476gemini,gemini-2.5-flash,cached_input,priority,0.054,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18477gemini,gemini-2.5-flash,cached_audio_input,priority,0.18,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18478gemini,gemini-2.5-flash,cache_storage_hour,priority,1.8,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18479gemini,gemini-2.5-flash,free_tier,free,0,USD,per 1M tokens,input/output free of charge; caching not available; Google Search grounding free up to 500 RPD (shared with Flash-Lite),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18480gemini,gemini-2.5-flash,grounding_google_search,standard,35.0,USD,per 1K grounded prompts,"1,500 RPD free (limit shared Flash/Flash-Lite), then $35 per 1,000 grounded prompts; free tier: 500 RPD",https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18481gemini,gemini-2.5-flash,grounding_google_maps,standard,25.0,USD,per 1K grounded prompts,"1,500 RPD free, then $25 per 1,000 grounded prompts; free tier 500 RPD",https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash,2026-09-18482gemini,gemini-2.5-flash-lite,input,standard,0.1,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18483gemini,gemini-2.5-flash-lite,audio_input,standard,0.3,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18484gemini,gemini-2.5-flash-lite,output,standard,0.4,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18485gemini,gemini-2.5-flash-lite,cached_input,standard,0.01,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18486gemini,gemini-2.5-flash-lite,cached_audio_input,standard,0.03,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18487gemini,gemini-2.5-flash-lite,cache_storage_hour,standard,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18488gemini,gemini-2.5-flash-lite,input,batch,0.05,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18489gemini,gemini-2.5-flash-lite,audio_input,batch,0.15,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18490gemini,gemini-2.5-flash-lite,output,batch,0.2,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18491gemini,gemini-2.5-flash-lite,cached_input,batch,0.01,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18492gemini,gemini-2.5-flash-lite,cached_audio_input,batch,0.03,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18493gemini,gemini-2.5-flash-lite,cache_storage_hour,batch,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18494gemini,gemini-2.5-flash-lite,input,flex,0.05,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18495gemini,gemini-2.5-flash-lite,audio_input,flex,0.15,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18496gemini,gemini-2.5-flash-lite,output,flex,0.2,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18497gemini,gemini-2.5-flash-lite,cached_input,flex,0.01,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18498gemini,gemini-2.5-flash-lite,cached_audio_input,flex,0.03,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18499gemini,gemini-2.5-flash-lite,cache_storage_hour,flex,1.0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18500gemini,gemini-2.5-flash-lite,input,priority,0.18,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18501gemini,gemini-2.5-flash-lite,audio_input,priority,0.54,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18502gemini,gemini-2.5-flash-lite,output,priority,0.72,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18503gemini,gemini-2.5-flash-lite,cached_input,priority,0.018,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18504gemini,gemini-2.5-flash-lite,cached_audio_input,priority,0.054,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18505gemini,gemini-2.5-flash-lite,cache_storage_hour,priority,1.8,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18506gemini,gemini-2.5-flash-lite,free_tier,free,0,USD,per 1M tokens,input/output free of charge; caching not available; Google Search grounding free up to 500 RPD (shared with Flash),https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18507gemini,gemini-2.5-flash-lite,grounding_google_search,standard,35.0,USD,per 1K grounded prompts,"1,500 RPD free (limit shared Flash/Flash-Lite), then $35 per 1,000 grounded prompts; free tier: 500 RPD",https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18508gemini,gemini-2.5-flash-lite,grounding_google_maps,standard,25.0,USD,per 1K grounded prompts,"1,500 RPD free, then $25 per 1,000 grounded prompts; free tier 500 RPD",https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-flash-lite,2026-09-18509gemini,gemini-robotics-er-2-preview,input,standard,1.0,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $2.0; text / image / video / audio same price,https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18510gemini,gemini-robotics-er-2-preview,output,standard,5.0,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $10.0; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18511gemini,gemini-robotics-er-2-preview,cached_input,standard,0.1,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.2,https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18512gemini,gemini-robotics-er-2-preview,cache_storage_hour,standard,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18513gemini,gemini-robotics-er-2-preview,input,batch,0.5,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $1.0; text / image / video / audio same price,https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18514gemini,gemini-robotics-er-2-preview,output,batch,2.5,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $5.0; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18515gemini,gemini-robotics-er-2-preview,cached_input,batch,0.05,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.1,https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18516gemini,gemini-robotics-er-2-preview,cache_storage_hour,batch,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18517gemini,gemini-robotics-er-2-preview,free_tier,free,0,USD,per 1M tokens,input/output free of charge; caching not available,https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18518gemini,gemini-robotics-er-2-preview,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18519gemini,gemini-robotics-er-2-preview,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-robotics-er-2-preview,2026-09-18520gemini,gemini-2.5-computer-use-preview-10-2025,input,standard,1.0,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $2.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-computer-use-preview-10-2025,2026-09-18521gemini,gemini-2.5-computer-use-preview-10-2025,output,standard,5.0,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $10.0; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-computer-use-preview-10-2025,2026-09-18522gemini,gemini-2.5-computer-use-preview-10-2025,free_tier,free,0,USD,per 1M tokens,input/output free of charge,https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-computer-use-preview-10-2025,2026-09-18523gemini,gemini-2.5-computer-use-preview-10-2025,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-computer-use-preview-10-2025,2026-09-18524gemini,gemini-2.5-computer-use-preview-10-2025,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-2.5-computer-use-preview-10-2025,2026-09-18525gemini,gemini-3.7-flash,input,standard,0.75,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $1.5,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18526gemini,gemini-3.7-flash,output,standard,3.75,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $7.5; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18527gemini,gemini-3.7-flash,cached_input,standard,0.075,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.15,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18528gemini,gemini-3.7-flash,cache_storage_hour,standard,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18529gemini,gemini-3.7-flash,input,batch,0.375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.75,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18530gemini,gemini-3.7-flash,output,batch,1.875,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $3.75; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18531gemini,gemini-3.7-flash,cached_input,batch,0.0375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.075,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18532gemini,gemini-3.7-flash,cache_storage_hour,batch,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18533gemini,gemini-3.7-flash,input,flex,0.375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.75,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18534gemini,gemini-3.7-flash,output,flex,1.875,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $3.75; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18535gemini,gemini-3.7-flash,cached_input,flex,0.0375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.075,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18536gemini,gemini-3.7-flash,cache_storage_hour,flex,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18537gemini,gemini-3.7-flash,input,priority,1.35,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $2.7,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18538gemini,gemini-3.7-flash,output,priority,6.75,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $13.5; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18539gemini,gemini-3.7-flash,cached_input,priority,0.135,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.27,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18540gemini,gemini-3.7-flash,cache_storage_hour,priority,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18541gemini,gemini-3.7-flash,free_tier,free,0,USD,per 1M tokens,input/output/caching free of charge (standard & priority rows); Batch/Flex not available,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18542gemini,gemini-3.7-flash,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18543gemini,gemini-3.7-flash,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.7-flash,2026-09-18544gemini,gemini-3.6-flash,input,standard,0.75,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $1.5,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18545gemini,gemini-3.6-flash,output,standard,3.75,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $7.5; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18546gemini,gemini-3.6-flash,cached_input,standard,0.075,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.15,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18547gemini,gemini-3.6-flash,cache_storage_hour,standard,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18548gemini,gemini-3.6-flash,input,batch,0.375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.75,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18549gemini,gemini-3.6-flash,output,batch,1.875,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $3.75; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18550gemini,gemini-3.6-flash,cached_input,batch,0.0375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.075,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18551gemini,gemini-3.6-flash,cache_storage_hour,batch,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18552gemini,gemini-3.6-flash,input,flex,0.375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.75,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18553gemini,gemini-3.6-flash,output,flex,1.875,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $3.75; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18554gemini,gemini-3.6-flash,cached_input,flex,0.0375,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.075,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18555gemini,gemini-3.6-flash,cache_storage_hour,flex,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18556gemini,gemini-3.6-flash,input,priority,1.35,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $2.7,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18557gemini,gemini-3.6-flash,output,priority,6.75,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $13.5; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18558gemini,gemini-3.6-flash,cached_input,priority,0.135,USD,per 1M tokens,Introductory price through 2026-12-31; from 2027-01-01: $0.27,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18559gemini,gemini-3.6-flash,cache_storage_hour,priority,0.5,USD,per 1M tokens per hour,Introductory price through 2026-12-31; from 2027-01-01: $1.0,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18560gemini,gemini-3.6-flash,free_tier,free,0,USD,per 1M tokens,input/output/caching free of charge (standard & priority rows); Batch/Flex not available,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18561gemini,gemini-3.6-flash,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18562gemini,gemini-3.6-flash,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.6-flash,2026-09-18563gemini,gemini-3.1-pro-preview-customtools,input,standard,2.0,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18564gemini,gemini-3.1-pro-preview-customtools,input_over_200k,standard,4.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18565gemini,gemini-3.1-pro-preview-customtools,output,standard,12.0,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18566gemini,gemini-3.1-pro-preview-customtools,output_over_200k,standard,18.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18567gemini,gemini-3.1-pro-preview-customtools,cached_input,standard,0.2,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18568gemini,gemini-3.1-pro-preview-customtools,cached_input_over_200k,standard,0.4,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18569gemini,gemini-3.1-pro-preview-customtools,cache_storage_hour,standard,4.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18570gemini,gemini-3.1-pro-preview-customtools,input,batch,1.0,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18571gemini,gemini-3.1-pro-preview-customtools,input_over_200k,batch,2.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18572gemini,gemini-3.1-pro-preview-customtools,output,batch,6.0,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18573gemini,gemini-3.1-pro-preview-customtools,output_over_200k,batch,9.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18574gemini,gemini-3.1-pro-preview-customtools,cached_input,batch,0.2,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18575gemini,gemini-3.1-pro-preview-customtools,cached_input_over_200k,batch,0.4,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18576gemini,gemini-3.1-pro-preview-customtools,cache_storage_hour,batch,4.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18577gemini,gemini-3.1-pro-preview-customtools,input,flex,1.0,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18578gemini,gemini-3.1-pro-preview-customtools,input_over_200k,flex,2.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18579gemini,gemini-3.1-pro-preview-customtools,output,flex,6.0,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18580gemini,gemini-3.1-pro-preview-customtools,output_over_200k,flex,9.0,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18581gemini,gemini-3.1-pro-preview-customtools,cached_input,flex,0.2,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18582gemini,gemini-3.1-pro-preview-customtools,cached_input_over_200k,flex,0.4,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18583gemini,gemini-3.1-pro-preview-customtools,cache_storage_hour,flex,4.5,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18584gemini,gemini-3.1-pro-preview-customtools,input,priority,3.6,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18585gemini,gemini-3.1-pro-preview-customtools,input_over_200k,priority,7.2,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18586gemini,gemini-3.1-pro-preview-customtools,output,priority,21.6,USD,per 1M tokens,prompts <= 200k tokens; includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18587gemini,gemini-3.1-pro-preview-customtools,output_over_200k,priority,32.4,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18588gemini,gemini-3.1-pro-preview-customtools,cached_input,priority,0.36,USD,per 1M tokens,prompts <= 200k tokens,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18589gemini,gemini-3.1-pro-preview-customtools,cached_input_over_200k,priority,0.72,USD,per 1M tokens,prompts > 200k tokens (long-context tier),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18590gemini,gemini-3.1-pro-preview-customtools,cache_storage_hour,priority,8.1,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18591gemini,gemini-3.1-pro-preview-customtools,free_tier,free,0,USD,per 1M tokens,Not available (paid tier only),https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18592gemini,gemini-3.1-pro-preview-customtools,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free search requests per month (shared across all Gemini 3.x models), then $14 per 1,000 requests; billed per search query executed (a prompt may trigger several)",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18593gemini,gemini-3.1-pro-preview-customtools,grounding_google_maps,standard,14.0,USD,per 1K search queries,"5,000 prompts per month free (shared across Gemini 3), then $14 per 1,000 search queries",https://ai.google.dev/gemini-api/docs/pricing#gemini-3.1-pro-preview-customtools,2026-09-18594gemini,gemini-3.8-live,input_text,standard,0.75,USD,per 1M tokens,Live API,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18595gemini,gemini-3.8-live,audio_input,standard,3.0,USD,per 1M tokens,= $0.005 per minute,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18596gemini,gemini-3.8-live,image_video_input,standard,1.0,USD,per 1M tokens,= $0.002 per minute,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18597gemini,gemini-3.8-live,output_text,standard,4.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18598gemini,gemini-3.8-live,audio_output,standard,12.0,USD,per 1M tokens,= $0.018 per minute,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18599gemini,gemini-3.8-live,free_tier,free,0,USD,per 1M tokens,free of charge; Google Search grounding supported on free tier for these models,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18600gemini,gemini-3.8-live-extended-thinking,input_text,standard,0.75,USD,per 1M tokens,Live API,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18601gemini,gemini-3.8-live-extended-thinking,audio_input,standard,3.0,USD,per 1M tokens,= $0.005 per minute,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18602gemini,gemini-3.8-live-extended-thinking,image_video_input,standard,1.0,USD,per 1M tokens,= $0.002 per minute,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18603gemini,gemini-3.8-live-extended-thinking,output_text,standard,4.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18604gemini,gemini-3.8-live-extended-thinking,audio_output,standard,12.0,USD,per 1M tokens,= $0.018 per minute,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18605gemini,gemini-3.8-live-extended-thinking,free_tier,free,0,USD,per 1M tokens,free of charge; Google Search grounding supported on free tier for these models,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18606gemini,gemini-3.1-flash-live-preview,input_text,standard,0.75,USD,per 1M tokens,Live API,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18607gemini,gemini-3.1-flash-live-preview,audio_input,standard,3.0,USD,per 1M tokens,= $0.005 per minute,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18608gemini,gemini-3.1-flash-live-preview,image_video_input,standard,1.0,USD,per 1M tokens,= $0.002 per minute,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18609gemini,gemini-3.1-flash-live-preview,output_text,standard,4.5,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18610gemini,gemini-3.1-flash-live-preview,audio_output,standard,12.0,USD,per 1M tokens,= $0.018 per minute,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18611gemini,gemini-3.1-flash-live-preview,free_tier,free,0,USD,per 1M tokens,free of charge; Google Search grounding supported on free tier for these models,https://ai.google.dev/gemini-api/docs/pricing#live-api-models,2026-09-18612gemini,gemini-3.5-live-translate-preview,audio_input,standard,3.5,USD,per 1M tokens,= $0.0053/min; 25 tokens per second of audio; effective ~$0.0368/min in+out,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18613gemini,gemini-3.5-live-translate-preview,audio_output,standard,21.0,USD,per 1M tokens,= $0.0315/min,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18614gemini,gemini-3.5-transcribe-live,audio_input,standard,3.5,USD,per 1M tokens,= $0.005/min (25 audio tokens/s),https://ai.google.dev/gemini-api/docs/pricing,2026-09-18615gemini,gemini-3.5-transcribe-live,output_text,standard,21.0,USD,per 1M tokens,= $0.004/min (175 text tokens/min); blended ~$0.009/min,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18616gemini,gemini-3.5-transcribe,audio_input,standard,2.0,USD,per 1M tokens,= $0.003/min,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18617gemini,gemini-3.5-transcribe,output_text,standard,12.0,USD,per 1M tokens,= $0.002/min; blended ~$0.005/min,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18618gemini,gemini-3.5-live-translate-preview,free_tier,free,0,USD,per 1M tokens,free of charge,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18619gemini,gemini-3.5-transcribe-live,free_tier,free,0,USD,per 1M tokens,free of charge,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18620gemini,gemini-3.5-transcribe,free_tier,free,0,USD,per 1M tokens,free of charge,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18621gemini,gemini-2.5-flash-native-audio-preview-12-2025,input_text,standard,0.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18622gemini,gemini-2.5-flash-native-audio-preview-12-2025,audio_video_input,standard,3.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18623gemini,gemini-2.5-flash-native-audio-preview-12-2025,output_text,standard,2.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18624gemini,gemini-2.5-flash-native-audio-preview-12-2025,audio_output,standard,12.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18625gemini,gemini-omni-1.1-flash,input,standard,1.5,USD,per 1M tokens,text / image / video / audio,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18626gemini,gemini-omni-1.1-flash,output_text,standard,9.0,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18627gemini,gemini-omni-1.1-flash,video_output,standard,17.5,USD,per 1M tokens,"5,792 tokens per second of 720p video => ~$0.10 per second",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18628gemini,gemini-omni-1.1-flash,video_output_per_second,standard,0.1,USD,per second,"effective, 720p, standard",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18629gemini,gemini-omni-flash-preview,input,standard,1.5,USD,per 1M tokens,text / image / video / audio,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18630gemini,gemini-omni-flash-preview,output_text,standard,9.0,USD,per 1M tokens,includes thinking tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18631gemini,gemini-omni-flash-preview,video_output,standard,17.5,USD,per 1M tokens,"5,792 tokens per second of 720p video => ~$0.10 per second",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18632gemini,gemini-omni-flash-preview,video_output_per_second,standard,0.1,USD,per second,"effective, 720p, standard",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18633gemini,gemini-3.1-flash-image,input,standard,0.5,USD,per 1M tokens,text/image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18634gemini,gemini-3.1-flash-image,output_text,standard,3.0,USD,per 1M tokens,text and thinking,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18635gemini,gemini-3.1-flash-image,image_output,standard,60.0,USD,per 1M tokens,per 1M image tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18636gemini,gemini-3.1-flash-image,image_output_0.5K,standard,0.045,USD,per image,747 tokens per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18637gemini,gemini-3.1-flash-image,image_output_1K,standard,0.067,USD,per image,1120 tokens per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18638gemini,gemini-3.1-flash-image,image_output_2K,standard,0.101,USD,per image,1680 tokens per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18639gemini,gemini-3.1-flash-image,image_output_4K,standard,0.151,USD,per image,2520 tokens per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18640gemini,gemini-3.1-flash-image,input,batch,0.25,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18641gemini,gemini-3.1-flash-image,output_text,batch,1.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18642gemini,gemini-3.1-flash-image,image_output,batch,30.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18643gemini,gemini-3.1-flash-image,image_output_0.5K,batch,0.022,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18644gemini,gemini-3.1-flash-image,image_output_1K,batch,0.034,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18645gemini,gemini-3.1-flash-image,image_output_2K,batch,0.05,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18646gemini,gemini-3.1-flash-image,image_output_4K,batch,0.076,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18647gemini,gemini-3.1-flash-image,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free/month shared across Gemini 3.x; text and image search grounding; retrieved context not charged as input",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18648gemini,gemini-3.1-flash-image-preview,input,standard,0.5,USD,per 1M tokens,text/image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18649gemini,gemini-3.1-flash-image-preview,output_text,standard,3.0,USD,per 1M tokens,text and thinking,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18650gemini,gemini-3.1-flash-image-preview,image_output,standard,60.0,USD,per 1M tokens,per 1M image tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18651gemini,gemini-3.1-flash-image-preview,image_output_0.5K,standard,0.045,USD,per image,747 tokens per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18652gemini,gemini-3.1-flash-image-preview,image_output_1K,standard,0.067,USD,per image,1120 tokens per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18653gemini,gemini-3.1-flash-image-preview,image_output_2K,standard,0.101,USD,per image,1680 tokens per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18654gemini,gemini-3.1-flash-image-preview,image_output_4K,standard,0.151,USD,per image,2520 tokens per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18655gemini,gemini-3.1-flash-image-preview,input,batch,0.25,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18656gemini,gemini-3.1-flash-image-preview,output_text,batch,1.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18657gemini,gemini-3.1-flash-image-preview,image_output,batch,30.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18658gemini,gemini-3.1-flash-image-preview,image_output_0.5K,batch,0.022,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18659gemini,gemini-3.1-flash-image-preview,image_output_1K,batch,0.034,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18660gemini,gemini-3.1-flash-image-preview,image_output_2K,batch,0.05,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18661gemini,gemini-3.1-flash-image-preview,image_output_4K,batch,0.076,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18662gemini,gemini-3.1-flash-image-preview,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free/month shared across Gemini 3.x; text and image search grounding; retrieved context not charged as input",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18663gemini,gemini-3.1-flash-lite-image,input,standard,0.25,USD,per 1M tokens,text/image/video,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18664gemini,gemini-3.1-flash-lite-image,output_text,standard,1.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18665gemini,gemini-3.1-flash-lite-image,image_output,standard,30.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18666gemini,gemini-3.1-flash-lite-image,image_output_1K,standard,0.0336,USD,per image,1120 tokens; only 1K supported,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18667gemini,gemini-3.1-flash-lite-image,input,batch,0.125,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18668gemini,gemini-3.1-flash-lite-image,output_text,batch,0.75,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18669gemini,gemini-3.1-flash-lite-image,image_output,batch,15.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18670gemini,gemini-3.1-flash-lite-image,image_output_1K,batch,0.0168,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18671gemini,gemini-3-pro-image,input,standard,2.0,USD,per 1M tokens,text/image; image input = 560 tokens = $0.0011 per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18672gemini,gemini-3-pro-image,image_input,standard,0.0011,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18673gemini,gemini-3-pro-image,output_text,standard,12.0,USD,per 1M tokens,text and thinking,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18674gemini,gemini-3-pro-image,image_output,standard,120.0,USD,per 1M tokens,per 1M image tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18675gemini,gemini-3-pro-image,image_output_1K_2K,standard,0.134,USD,per image,1120 tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18676gemini,gemini-3-pro-image,image_output_4K,standard,0.24,USD,per image,2000 tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18677gemini,gemini-3-pro-image,input,batch,1.0,USD,per 1M tokens,text,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18678gemini,gemini-3-pro-image,image_input,batch,0.0006,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18679gemini,gemini-3-pro-image,output_text,batch,6.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18680gemini,gemini-3-pro-image,image_output_1K_2K,batch,0.067,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18681gemini,gemini-3-pro-image,image_output_4K,batch,0.12,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18682gemini,gemini-3-pro-image,input,flex,1.0,USD,per 1M tokens,text,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18683gemini,gemini-3-pro-image,image_input,flex,0.0006,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18684gemini,gemini-3-pro-image,output_text,flex,6.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18685gemini,gemini-3-pro-image,image_output_1K_2K,flex,0.067,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18686gemini,gemini-3-pro-image,image_output_4K,flex,0.12,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18687gemini,gemini-3-pro-image,input,priority,3.6,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18688gemini,gemini-3-pro-image,output_text,priority,21.6,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18689gemini,gemini-3-pro-image,image_output,priority,216.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18690gemini,gemini-3-pro-image,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free/month shared across Gemini 3.x",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18691gemini,gemini-3-pro-image-preview,input,standard,2.0,USD,per 1M tokens,text/image; image input = 560 tokens = $0.0011 per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18692gemini,gemini-3-pro-image-preview,image_input,standard,0.0011,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18693gemini,gemini-3-pro-image-preview,output_text,standard,12.0,USD,per 1M tokens,text and thinking,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18694gemini,gemini-3-pro-image-preview,image_output,standard,120.0,USD,per 1M tokens,per 1M image tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18695gemini,gemini-3-pro-image-preview,image_output_1K_2K,standard,0.134,USD,per image,1120 tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18696gemini,gemini-3-pro-image-preview,image_output_4K,standard,0.24,USD,per image,2000 tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18697gemini,gemini-3-pro-image-preview,input,batch,1.0,USD,per 1M tokens,text,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18698gemini,gemini-3-pro-image-preview,image_input,batch,0.0006,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18699gemini,gemini-3-pro-image-preview,output_text,batch,6.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18700gemini,gemini-3-pro-image-preview,image_output_1K_2K,batch,0.067,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18701gemini,gemini-3-pro-image-preview,image_output_4K,batch,0.12,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18702gemini,gemini-3-pro-image-preview,input,flex,1.0,USD,per 1M tokens,text,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18703gemini,gemini-3-pro-image-preview,image_input,flex,0.0006,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18704gemini,gemini-3-pro-image-preview,output_text,flex,6.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18705gemini,gemini-3-pro-image-preview,image_output_1K_2K,flex,0.067,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18706gemini,gemini-3-pro-image-preview,image_output_4K,flex,0.12,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18707gemini,gemini-3-pro-image-preview,input,priority,3.6,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18708gemini,gemini-3-pro-image-preview,output_text,priority,21.6,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18709gemini,gemini-3-pro-image-preview,image_output,priority,216.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18710gemini,gemini-3-pro-image-preview,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free/month shared across Gemini 3.x",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18711gemini,nano-banana-pro-preview,input,standard,2.0,USD,per 1M tokens,text/image; image input = 560 tokens = $0.0011 per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18712gemini,nano-banana-pro-preview,image_input,standard,0.0011,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18713gemini,nano-banana-pro-preview,output_text,standard,12.0,USD,per 1M tokens,text and thinking,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18714gemini,nano-banana-pro-preview,image_output,standard,120.0,USD,per 1M tokens,per 1M image tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18715gemini,nano-banana-pro-preview,image_output_1K_2K,standard,0.134,USD,per image,1120 tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18716gemini,nano-banana-pro-preview,image_output_4K,standard,0.24,USD,per image,2000 tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18717gemini,nano-banana-pro-preview,input,batch,1.0,USD,per 1M tokens,text,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18718gemini,nano-banana-pro-preview,image_input,batch,0.0006,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18719gemini,nano-banana-pro-preview,output_text,batch,6.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18720gemini,nano-banana-pro-preview,image_output_1K_2K,batch,0.067,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18721gemini,nano-banana-pro-preview,image_output_4K,batch,0.12,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18722gemini,nano-banana-pro-preview,input,flex,1.0,USD,per 1M tokens,text,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18723gemini,nano-banana-pro-preview,image_input,flex,0.0006,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18724gemini,nano-banana-pro-preview,output_text,flex,6.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18725gemini,nano-banana-pro-preview,image_output_1K_2K,flex,0.067,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18726gemini,nano-banana-pro-preview,image_output_4K,flex,0.12,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18727gemini,nano-banana-pro-preview,input,priority,3.6,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18728gemini,nano-banana-pro-preview,output_text,priority,21.6,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18729gemini,nano-banana-pro-preview,image_output,priority,216.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18730gemini,nano-banana-pro-preview,grounding_google_search,standard,14.0,USD,per 1K requests,"5,000 free/month shared across Gemini 3.x",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18731gemini,gemini-2.5-flash-image,input,standard,0.3,USD,per 1M tokens,text/image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18732gemini,gemini-2.5-flash-image,image_output,standard,0.039,USD,per image,"$30 per 1M image tokens; 1290 tokens per image up to 1024x1024; deprecated, shutdown 2026-10-02",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18733gemini,gemini-2.5-flash-image,input,batch,0.15,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18734gemini,gemini-2.5-flash-image,image_output,batch,0.0195,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18735gemini,gemini-2.5-flash-image,input,flex,0.15,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18736gemini,gemini-2.5-flash-image,image_output,flex,0.0195,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18737gemini,gemini-2.5-flash-image,input,priority,0.54,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18738gemini,gemini-2.5-flash-image,image_output,priority,0.0702,USD,per image,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18739gemini,gemini-3.1-flash-tts-preview,input_text,standard,1.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18740gemini,gemini-3.1-flash-tts-preview,audio_output,standard,20.0,USD,per 1M tokens,25 audio tokens per second,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18741gemini,gemini-3.1-flash-tts-preview,input_text,batch,0.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18742gemini,gemini-3.1-flash-tts-preview,audio_output,batch,10.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18743gemini,gemini-2.5-flash-preview-tts,input_text,standard,0.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18744gemini,gemini-2.5-flash-preview-tts,audio_output,standard,10.0,USD,per 1M tokens,25 audio tokens per second,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18745gemini,gemini-2.5-flash-preview-tts,input_text,batch,0.25,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18746gemini,gemini-2.5-flash-preview-tts,audio_output,batch,5.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18747gemini,gemini-2.5-pro-preview-tts,input_text,standard,1.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18748gemini,gemini-2.5-pro-preview-tts,audio_output,standard,20.0,USD,per 1M tokens,25 audio tokens per second,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18749gemini,gemini-2.5-pro-preview-tts,input_text,batch,0.5,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18750gemini,gemini-2.5-pro-preview-tts,audio_output,batch,10.0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18751gemini,veo-3.1-generate-preview,video_output_720p,standard,0.4,USD,per second,video with audio (default); charged only when the video is successfully generated,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18752gemini,veo-3.1-generate-preview,video_output_1080p,standard,0.4,USD,per second,video with audio (default); charged only when the video is successfully generated,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18753gemini,veo-3.1-generate-preview,video_output_4k,standard,0.6,USD,per second,video with audio (default); charged only when the video is successfully generated,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18754gemini,veo-3.1-fast-generate-preview,video_output_720p,standard,0.1,USD,per second,video with audio (default); charged only when the video is successfully generated,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18755gemini,veo-3.1-fast-generate-preview,video_output_1080p,standard,0.12,USD,per second,video with audio (default); charged only when the video is successfully generated,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18756gemini,veo-3.1-fast-generate-preview,video_output_4k,standard,0.3,USD,per second,video with audio (default); charged only when the video is successfully generated,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18757gemini,veo-3.1-lite-generate-preview,video_output_720p,standard,0.05,USD,per second,video with audio (default); charged only when the video is successfully generated,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18758gemini,veo-3.1-lite-generate-preview,video_output_1080p,standard,0.08,USD,per second,video with audio (default); charged only when the video is successfully generated,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18759gemini,veo-3.1-lite-generate-preview,video_output_4k,standard,,USD,per second,4K output not supported,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18760gemini,lyria-3.5,per_song,standard,0.08,USD,per request,full song,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18761gemini,lyria-3-clip-preview,per_song,standard,0.04,USD,per request,30 s clip,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18762gemini,lyria-3-pro-preview,per_song,standard,0.08,USD,per request,full song; legacy,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18763gemini,gemini-embedding-2,input_text,standard,0.2,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18764gemini,gemini-embedding-2,image_input,standard,0.45,USD,per 1M tokens,= $0.00012 per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18765gemini,gemini-embedding-2,audio_input,standard,6.5,USD,per 1M tokens,= $0.00016 per second,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18766gemini,gemini-embedding-2,video_input,standard,12.0,USD,per 1M tokens,= $0.00079 per frame,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18767gemini,gemini-embedding-2,input_text,batch,0.1,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18768gemini,gemini-embedding-2,image_input,batch,0.225,USD,per 1M tokens,= $0.00006 per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18769gemini,gemini-embedding-2,audio_input,batch,3.25,USD,per 1M tokens,= $0.00008 per second,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18770gemini,gemini-embedding-2,video_input,batch,6.0,USD,per 1M tokens,= $0.000395 per frame,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18771gemini,gemini-embedding-2,free_tier,free,0,USD,per 1M tokens,standard free of charge; batch not available on free tier,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18772gemini,gemini-embedding-2-preview,input_text,standard,0.2,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18773gemini,gemini-embedding-2-preview,image_input,standard,0.45,USD,per 1M tokens,= $0.00012 per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18774gemini,gemini-embedding-2-preview,audio_input,standard,6.5,USD,per 1M tokens,= $0.00016 per second,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18775gemini,gemini-embedding-2-preview,video_input,standard,12.0,USD,per 1M tokens,= $0.00079 per frame,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18776gemini,gemini-embedding-2-preview,input_text,batch,0.1,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18777gemini,gemini-embedding-2-preview,image_input,batch,0.225,USD,per 1M tokens,= $0.00006 per image,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18778gemini,gemini-embedding-2-preview,audio_input,batch,3.25,USD,per 1M tokens,= $0.00008 per second,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18779gemini,gemini-embedding-2-preview,video_input,batch,6.0,USD,per 1M tokens,= $0.000395 per frame,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18780gemini,gemini-embedding-2-preview,free_tier,free,0,USD,per 1M tokens,standard free of charge; batch not available on free tier,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18781gemini,gemini-embedding-001,input,standard,,USD,per 1M tokens,not listed on pricing.md as of 2026-09-18; File Search indexing embeddings billed at $0.15 per 1M tokens (file-search tool row),https://ai.google.dev/gemini-api/docs/pricing,2026-09-18782gemini,gemma-4-26b-a4b-it,input,free,0,USD,per 1M tokens,Gemma 4: free tier free of charge; paid tier 'Not available',https://ai.google.dev/gemini-api/docs/pricing,2026-09-18783gemini,gemma-4-26b-a4b-it,output,free,0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18784gemini,gemma-4-26b-a4b-it,cached_input,free,0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18785gemini,gemma-4-26b-a4b-it,cache_storage_hour,free,0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18786gemini,gemma-4-31b-it,input,free,0,USD,per 1M tokens,Gemma 4: free tier free of charge; paid tier 'Not available',https://ai.google.dev/gemini-api/docs/pricing,2026-09-18787gemini,gemma-4-31b-it,output,free,0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18788gemini,gemma-4-31b-it,cached_input,free,0,USD,per 1M tokens,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18789gemini,gemma-4-31b-it,cache_storage_hour,free,0,USD,per 1M tokens per hour,,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18790gemini,tool:google_search,grounding_google_search,standard,14.0,USD,per 1K requests,"Gemini 3.x: 5,000 free search requests per month shared across all Gemini 3 models; billed per executed search query; retrieved context not charged as input",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18791gemini,tool:google_search,grounding_google_search,standard,35.0,USD,per 1K grounded prompts,"Gemini 2.5 models: 1,500 RPD free (shared Flash/Flash-Lite); billed per grounded prompt",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18792gemini,tool:google_search,grounding_google_search,free,0,USD,per 1K grounded prompts,Free tier: 500 RPD free (shared Flash/Flash-Lite); not available for Pro,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18793gemini,tool:google_maps,grounding_google_maps,standard,14.0,USD,per 1K search queries,"Gemini 3.x: 5,000 prompts/month free shared across Gemini 3",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18794gemini,tool:google_maps,grounding_google_maps,standard,25.0,USD,per 1K grounded prompts,"Gemini 2.5: 1,500 RPD free (Flash/Flash-Lite), 10,000 RPD free for Pro; free tier 500 RPD, not for Pro",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18795gemini,tool:code_execution,tool_usage,standard,0,USD,per call,no per-call fee; generated code + results billed as output tokens when created and as input tokens when re-consumed; no charge for session runtime; free tier: free,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18796gemini,tool:url_context,tool_usage,standard,0,USD,per call,retrieved page content charged as input tokens at model rates,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18797gemini,tool:computer_use,tool_usage,standard,0,USD,per call,charged as regular tokens per model pricing; not available on free tier,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18798gemini,tool:file_search,indexing_embeddings,standard,0.15,USD,per 1M tokens,charged once at indexing; storage and query-time embeddings free; retrieved document tokens billed as input tokens,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18799gemini,tool:custom_tools_endpoint,tokens,standard,,USD,per 1M tokens,gemini-3.1-pro-preview-customtools: same as Gemini 3.1 Pro Preview,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18800gemini,agent:deep-research,tokens,standard,,USD,per 1M tokens,all model inference at standard Gemini list rates incl. intermediate/reasoning tokens; tool fees per tool pricing (search retrieved tokens excluded; url_context/file search retrieved tokens included),https://ai.google.dev/gemini-api/docs/pricing,2026-09-18801gemini,agent:managed-agents,environment_compute,standard,0,USD,per hour,sandbox CPU/memory/execution not billed during preview; inference at list rates,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18802gemini,agent:antigravity,environment_compute,standard,0,USD,per hour,same as managed agents; inference at list rates,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18803gemini,service:batch_api,discount,batch,0.5,USD,multiplier,50% of standard interactive price; target turnaround 24h,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18804gemini,service:flex_inference,discount,flex,0.5,USD,multiplier,"50% discount; best-effort, sheddable; 1-15 min target latency",https://ai.google.dev/gemini-api/docs/pricing,2026-09-18805gemini,service:priority_inference,premium,priority,1.8x,USD,multiplier,75-100% more than standard (tables show 1.8x); graceful downgrade to standard when limits exceeded,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18806gemini,service:context_cache_storage,cache_storage_hour,standard,0.50-8.10,USD,per 1M tokens per hour,model dependent: $0.50 (3.6-3.8 Flash intro) / $1.00 (most Flash) / $1.80 (Flash priority) / $4.50 (Pro) / $8.10 (Pro priority),https://ai.google.dev/gemini-api/docs/pricing,2026-09-18807gemini,service:document_tokens,pdf_page,standard,,USD,per page,DOCUMENT modality (PDF) billed at the image token rate; appears under promptTokensDetails modality DOCUMENT,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18808gemini,service:google_ai_studio,usage,free,0,USD,per call,AI Studio usage is free of charge in all available regions,https://ai.google.dev/gemini-api/docs/pricing,2026-09-18809openai,gpt-6-astra,input,standard,20.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18810openai,gpt-6-astra,cached_input,standard,2.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18811openai,gpt-6-astra,cache_write,standard,25.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18812openai,gpt-6-astra,output,standard,75.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18813openai,gpt-5.6-sol,input,standard,8.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18814openai,gpt-5.6-sol,cached_input,standard,0.8,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18815openai,gpt-5.6-sol,cache_write,standard,10.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18816openai,gpt-5.6-sol,output,standard,30.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18817openai,gpt-5.6-terra,input,standard,4.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18818openai,gpt-5.6-terra,cached_input,standard,0.4,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18819openai,gpt-5.6-terra,cache_write,standard,5.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18820openai,gpt-5.6-terra,output,standard,18.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18821openai,gpt-5.6-luna,input,standard,0.4,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18822openai,gpt-5.6-luna,cached_input,standard,0.04,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18823openai,gpt-5.6-luna,cache_write,standard,0.5,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18824openai,gpt-5.6-luna,output,standard,1.8,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18825openai,gpt-5.5,input,standard,10.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18826openai,gpt-5.5,cached_input,standard,1.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18827openai,gpt-5.5,output,standard,45.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18828openai,gpt-5.5-pro,input,standard,60.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18829openai,gpt-5.5-pro,output,standard,270.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18830openai,gpt-5.4,input,standard,5.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18831openai,gpt-5.4,cached_input,standard,0.5,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18832openai,gpt-5.4,output,standard,22.5,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18833openai,gpt-5.4-mini,input,standard,0.75,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18834openai,gpt-5.4-mini,cached_input,standard,0.075,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18835openai,gpt-5.4-mini,output,standard,4.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18836openai,gpt-5.4-nano,input,standard,0.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18837openai,gpt-5.4-nano,cached_input,standard,0.02,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18838openai,gpt-5.4-nano,output,standard,1.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18839openai,gpt-5.4-pro,input,standard,60.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18840openai,gpt-5.4-pro,output,standard,270.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18841openai,gpt-5.2,input,standard,1.75,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18842openai,gpt-5.2,cached_input,standard,0.175,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18843openai,gpt-5.2,output,standard,14.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18844openai,gpt-5.2-pro,input,standard,21.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18845openai,gpt-5.2-pro,output,standard,168.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18846openai,gpt-5.1,input,standard,1.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18847openai,gpt-5.1,cached_input,standard,0.125,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18848openai,gpt-5.1,output,standard,10.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18849openai,gpt-5,input,standard,1.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18850openai,gpt-5,cached_input,standard,0.125,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18851openai,gpt-5,output,standard,10.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18852openai,gpt-5-mini,input,standard,0.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18853openai,gpt-5-mini,cached_input,standard,0.025,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18854openai,gpt-5-mini,output,standard,2.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18855openai,gpt-5-nano,input,standard,0.05,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18856openai,gpt-5-nano,cached_input,standard,0.005,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18857openai,gpt-5-nano,output,standard,0.4,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18858openai,gpt-5-pro,input,standard,15.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18859openai,gpt-5-pro,output,standard,120.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18860openai,gpt-4.1,input,standard,2.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18861openai,gpt-4.1,cached_input,standard,0.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18862openai,gpt-4.1,output,standard,8.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18863openai,gpt-4.1-mini,input,standard,0.4,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18864openai,gpt-4.1-mini,cached_input,standard,0.1,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18865openai,gpt-4.1-mini,output,standard,1.6,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18866openai,gpt-4.1-nano,input,standard,0.1,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18867openai,gpt-4.1-nano,cached_input,standard,0.025,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18868openai,gpt-4.1-nano,output,standard,0.4,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18869openai,gpt-4o,input,standard,2.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18870openai,gpt-4o,cached_input,standard,1.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18871openai,gpt-4o,output,standard,10.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18872openai,gpt-4o-2024-05-13,input,standard,5.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18873openai,gpt-4o-2024-05-13,output,standard,15.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18874openai,gpt-4o-mini,input,standard,0.15,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18875openai,gpt-4o-mini,cached_input,standard,0.075,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18876openai,gpt-4o-mini,output,standard,0.6,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18877openai,o1,input,standard,15.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18878openai,o1,cached_input,standard,7.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18879openai,o1,output,standard,60.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18880openai,o1-pro,input,standard,150.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18881openai,o1-pro,output,standard,600.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18882openai,o3-pro,input,standard,20.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18883openai,o3-pro,output,standard,80.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18884openai,o3,input,standard,2.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18885openai,o3,cached_input,standard,0.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18886openai,o3,output,standard,8.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18887openai,o4-mini,input,standard,1.1,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18888openai,o4-mini,cached_input,standard,0.275,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18889openai,o4-mini,output,standard,4.4,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18890openai,o3-mini,input,standard,1.1,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18891openai,o3-mini,cached_input,standard,0.55,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18892openai,o3-mini,output,standard,4.4,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18893openai,gpt-4-turbo-2024-04-09,input,standard,10.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18894openai,gpt-4-turbo-2024-04-09,output,standard,30.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18895openai,gpt-4-0613,input,standard,30.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18896openai,gpt-4-0613,output,standard,60.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18897openai,gpt-3.5-turbo,input,standard,0.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18898openai,gpt-3.5-turbo,output,standard,1.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18899openai,gpt-3.5-turbo-0125,input,standard,0.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18900openai,gpt-3.5-turbo-0125,output,standard,1.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18901openai,gpt-3.5-turbo-1106,input,standard,1.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18902openai,gpt-3.5-turbo-1106,output,standard,2.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18903openai,gpt-3.5-turbo-instruct,input,standard,1.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18904openai,gpt-3.5-turbo-instruct,output,standard,2.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18905openai,davinci-002,input,standard,2.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18906openai,davinci-002,output,standard,2.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18907openai,babbage-002,input,standard,0.4,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18908openai,babbage-002,output,standard,0.4,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18909openai,gpt-6-astra,input,batch,10.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18910openai,gpt-6-astra,cached_input,batch,1.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18911openai,gpt-6-astra,cache_write,batch,12.5,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18912openai,gpt-6-astra,output,batch,37.5,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18913openai,gpt-5.6-sol,input,batch,4.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18914openai,gpt-5.6-sol,cached_input,batch,0.4,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18915openai,gpt-5.6-sol,cache_write,batch,5.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18916openai,gpt-5.6-sol,output,batch,15.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18917openai,gpt-5.6-terra,input,batch,2.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18918openai,gpt-5.6-terra,cached_input,batch,0.2,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18919openai,gpt-5.6-terra,cache_write,batch,2.5,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18920openai,gpt-5.6-terra,output,batch,9.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18921openai,gpt-5.6-luna,input,batch,0.2,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18922openai,gpt-5.6-luna,cached_input,batch,0.02,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18923openai,gpt-5.6-luna,cache_write,batch,0.25,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18924openai,gpt-5.6-luna,output,batch,0.9,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18925openai,gpt-5.5,input,batch,5.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18926openai,gpt-5.5,cached_input,batch,0.5,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18927openai,gpt-5.5,output,batch,22.5,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18928openai,gpt-5.5-pro,input,batch,15.0,USD,per 1M tokens,<272K context length; short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18929openai,gpt-5.5-pro,output,batch,90.0,USD,per 1M tokens,<272K context length; short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18930openai,gpt-5.4,input,batch,2.5,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18931openai,gpt-5.4,cached_input,batch,0.25,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18932openai,gpt-5.4,output,batch,11.25,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18933openai,gpt-5.4-mini,input,batch,0.375,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18934openai,gpt-5.4-mini,cached_input,batch,0.0375,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18935openai,gpt-5.4-mini,output,batch,2.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18936openai,gpt-5.4-nano,input,batch,0.1,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18937openai,gpt-5.4-nano,cached_input,batch,0.01,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18938openai,gpt-5.4-nano,output,batch,0.625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18939openai,gpt-5.4-pro,input,batch,30.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18940openai,gpt-5.4-pro,output,batch,135.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18941openai,gpt-5.2,input,batch,0.875,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18942openai,gpt-5.2,cached_input,batch,0.0875,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18943openai,gpt-5.2,output,batch,7.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18944openai,gpt-5.2-pro,input,batch,10.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18945openai,gpt-5.2-pro,output,batch,84.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18946openai,gpt-5.1,input,batch,0.625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18947openai,gpt-5.1,cached_input,batch,0.0625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18948openai,gpt-5.1,output,batch,5.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18949openai,gpt-5,input,batch,0.625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18950openai,gpt-5,cached_input,batch,0.0625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18951openai,gpt-5,output,batch,5.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18952openai,gpt-5-mini,input,batch,0.125,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18953openai,gpt-5-mini,cached_input,batch,0.0125,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18954openai,gpt-5-mini,output,batch,1.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18955openai,gpt-5-nano,input,batch,0.025,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18956openai,gpt-5-nano,cached_input,batch,0.0025,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18957openai,gpt-5-nano,output,batch,0.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18958openai,gpt-5-pro,input,batch,7.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18959openai,gpt-5-pro,output,batch,60.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18960openai,gpt-4.1,input,batch,1.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18961openai,gpt-4.1,output,batch,4.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18962openai,gpt-4.1-mini,input,batch,0.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18963openai,gpt-4.1-mini,output,batch,0.8,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18964openai,gpt-4.1-nano,input,batch,0.05,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18965openai,gpt-4.1-nano,output,batch,0.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18966openai,gpt-4o,input,batch,1.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18967openai,gpt-4o,output,batch,5.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18968openai,gpt-4o-2024-05-13,input,batch,2.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18969openai,gpt-4o-2024-05-13,output,batch,7.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18970openai,gpt-4o-mini,input,batch,0.075,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18971openai,gpt-4o-mini,output,batch,0.3,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18972openai,o1,input,batch,7.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18973openai,o1,output,batch,30.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18974openai,o1-pro,input,batch,75.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18975openai,o1-pro,output,batch,300.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18976openai,o3-pro,input,batch,10.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18977openai,o3-pro,output,batch,40.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18978openai,o3,input,batch,1.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18979openai,o3,output,batch,4.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18980openai,o4-mini,input,batch,0.55,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18981openai,o4-mini,output,batch,2.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18982openai,o3-mini,input,batch,0.55,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18983openai,o3-mini,output,batch,2.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18984openai,gpt-4-turbo-2024-04-09,input,batch,5.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18985openai,gpt-4-turbo-2024-04-09,output,batch,15.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18986openai,gpt-4-0613,input,batch,15.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18987openai,gpt-4-0613,output,batch,30.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18988openai,gpt-3.5-turbo-0125,input,batch,0.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18989openai,gpt-3.5-turbo-0125,output,batch,0.75,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18990openai,gpt-3.5-turbo-1106,input,batch,1.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18991openai,gpt-3.5-turbo-1106,output,batch,2.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18992openai,davinci-002,input,batch,1.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18993openai,davinci-002,output,batch,1.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18994openai,babbage-002,input,batch,0.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18995openai,babbage-002,output,batch,0.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-18996openai,gpt-6-astra,input,flex,10.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18997openai,gpt-6-astra,cached_input,flex,1.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18998openai,gpt-6-astra,cache_write,flex,12.5,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-18999openai,gpt-6-astra,output,flex,37.5,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181000openai,gpt-5.6-sol,input,flex,4.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181001openai,gpt-5.6-sol,cached_input,flex,0.4,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181002openai,gpt-5.6-sol,cache_write,flex,5.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181003openai,gpt-5.6-sol,output,flex,15.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181004openai,gpt-5.6-terra,input,flex,2.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181005openai,gpt-5.6-terra,cached_input,flex,0.2,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181006openai,gpt-5.6-terra,cache_write,flex,2.5,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181007openai,gpt-5.6-terra,output,flex,9.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181008openai,gpt-5.6-luna,input,flex,0.2,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181009openai,gpt-5.6-luna,cached_input,flex,0.02,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181010openai,gpt-5.6-luna,cache_write,flex,0.25,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181011openai,gpt-5.6-luna,output,flex,0.9,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181012openai,gpt-5.5,input,flex,5.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181013openai,gpt-5.5,cached_input,flex,0.5,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181014openai,gpt-5.5,output,flex,22.5,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181015openai,gpt-5.5-pro,input,flex,15.0,USD,per 1M tokens,<272K context length; short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181016openai,gpt-5.5-pro,output,flex,90.0,USD,per 1M tokens,<272K context length; short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181017openai,gpt-5.4,input,flex,2.5,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181018openai,gpt-5.4,cached_input,flex,0.25,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181019openai,gpt-5.4,output,flex,11.25,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181020openai,gpt-5.4-mini,input,flex,0.375,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181021openai,gpt-5.4-mini,cached_input,flex,0.0375,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181022openai,gpt-5.4-mini,output,flex,2.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181023openai,gpt-5.4-nano,input,flex,0.1,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181024openai,gpt-5.4-nano,cached_input,flex,0.01,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181025openai,gpt-5.4-nano,output,flex,0.625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181026openai,gpt-5.4-pro,input,flex,30.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181027openai,gpt-5.4-pro,output,flex,135.0,USD,per 1M tokens,<272K context length; long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181028openai,gpt-5.2,input,flex,0.875,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181029openai,gpt-5.2,cached_input,flex,0.0875,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181030openai,gpt-5.2,output,flex,7.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181031openai,gpt-5.1,input,flex,0.625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181032openai,gpt-5.1,cached_input,flex,0.0625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181033openai,gpt-5.1,output,flex,5.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181034openai,gpt-5,input,flex,0.625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181035openai,gpt-5,cached_input,flex,0.0625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181036openai,gpt-5,output,flex,5.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181037openai,gpt-5-mini,input,flex,0.125,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181038openai,gpt-5-mini,cached_input,flex,0.0125,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181039openai,gpt-5-mini,output,flex,1.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181040openai,gpt-5-nano,input,flex,0.025,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181041openai,gpt-5-nano,cached_input,flex,0.0025,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181042openai,gpt-5-nano,output,flex,0.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181043openai,o3,input,flex,1.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181044openai,o3,cached_input,flex,0.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181045openai,o3,output,flex,4.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181046openai,o4-mini,input,flex,0.55,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181047openai,o4-mini,cached_input,flex,0.138,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181048openai,o4-mini,output,flex,2.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181049openai,gpt-6-astra,input,fast,40.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181050openai,gpt-6-astra,cached_input,fast,4.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181051openai,gpt-6-astra,cache_write,fast,50.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181052openai,gpt-6-astra,output,fast,150.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181053openai,gpt-5.6-sol,input,fast,16.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181054openai,gpt-5.6-sol,cached_input,fast,1.6,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181055openai,gpt-5.6-sol,cache_write,fast,20.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181056openai,gpt-5.6-sol,output,fast,60.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181057openai,gpt-5.6-terra,input,fast,8.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181058openai,gpt-5.6-terra,cached_input,fast,0.8,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181059openai,gpt-5.6-terra,cache_write,fast,10.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181060openai,gpt-5.6-terra,output,fast,36.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181061openai,gpt-5.6-luna,input,fast,0.8,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181062openai,gpt-5.6-luna,cached_input,fast,0.08,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181063openai,gpt-5.6-luna,cache_write,fast,1.0,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181064openai,gpt-5.6-luna,output,fast,3.6,USD,per 1M tokens,long context (>272K input tokens) rate,https://developers.openai.com/api/docs/pricing,2026-09-181065openai,gpt-5.5,input,fast,12.5,USD,per 1M tokens,<272K context length; short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181066openai,gpt-5.5,cached_input,fast,1.25,USD,per 1M tokens,<272K context length; short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181067openai,gpt-5.5,output,fast,75.0,USD,per 1M tokens,<272K context length; short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181068openai,gpt-5.4,input,fast,5.0,USD,per 1M tokens,<272K context length; short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181069openai,gpt-5.4,cached_input,fast,0.5,USD,per 1M tokens,<272K context length; short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181070openai,gpt-5.4,output,fast,30.0,USD,per 1M tokens,<272K context length; short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181071openai,gpt-5.4-mini,input,fast,1.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181072openai,gpt-5.4-mini,cached_input,fast,0.15,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181073openai,gpt-5.4-mini,output,fast,9.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181074openai,gpt-5.2,input,fast,3.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181075openai,gpt-5.2,cached_input,fast,0.35,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181076openai,gpt-5.2,output,fast,28.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181077openai,gpt-5.1,input,fast,2.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181078openai,gpt-5.1,cached_input,fast,0.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181079openai,gpt-5.1,output,fast,20.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181080openai,gpt-5,input,fast,2.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181081openai,gpt-5,cached_input,fast,0.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181082openai,gpt-5,output,fast,20.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181083openai,gpt-5-mini,input,fast,0.45,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181084openai,gpt-5-mini,cached_input,fast,0.045,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181085openai,gpt-5-mini,output,fast,3.6,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181086openai,gpt-4.1,input,fast,3.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181087openai,gpt-4.1,cached_input,fast,0.875,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181088openai,gpt-4.1,output,fast,14.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181089openai,gpt-4.1-mini,input,fast,0.7,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181090openai,gpt-4.1-mini,cached_input,fast,0.175,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181091openai,gpt-4.1-mini,output,fast,2.8,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181092openai,gpt-4.1-nano,input,fast,0.2,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181093openai,gpt-4.1-nano,cached_input,fast,0.05,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181094openai,gpt-4.1-nano,output,fast,0.8,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181095openai,gpt-4o,input,fast,4.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181096openai,gpt-4o,cached_input,fast,2.125,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181097openai,gpt-4o,output,fast,17.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181098openai,gpt-4o-2024-05-13,input,fast,8.75,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181099openai,gpt-4o-2024-05-13,output,fast,26.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181100openai,gpt-4o-mini,input,fast,0.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181101openai,gpt-4o-mini,cached_input,fast,0.125,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181102openai,gpt-4o-mini,output,fast,1.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181103openai,o3,input,fast,3.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181104openai,o3,cached_input,fast,0.875,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181105openai,o3,output,fast,14.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181106openai,o4-mini,input,fast,2.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181107openai,o4-mini,cached_input,fast,0.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181108openai,o4-mini,output,fast,8.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181109openai,gpt-5.6-cyber,input,standard,12.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181110openai,gpt-5.6-cyber,cached_input,standard,1.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181111openai,gpt-5.6-cyber,cache_write,standard,15.625,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181112openai,gpt-5.6-cyber,output,standard,75.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181113openai,gpt-5.5-cyber,input,standard,12.5,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181114openai,gpt-5.5-cyber,cached_input,standard,1.25,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181115openai,gpt-5.5-cyber,output,standard,75.0,USD,per 1M tokens,short context rate,https://developers.openai.com/api/docs/pricing,2026-09-181116openai,gpt-live-1,session_duration,standard,0.05,USD,per minute (billed per second),,https://developers.openai.com/api/docs/pricing,2026-09-181117openai,gpt-realtime-2.1,audio_input,standard,32.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181118openai,gpt-realtime-2.1,audio_cached_input,standard,0.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181119openai,gpt-realtime-2.1,audio_output,standard,64.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181120openai,gpt-realtime-2.1,text_input,standard,4.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181121openai,gpt-realtime-2.1,text_cached_input,standard,0.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181122openai,gpt-realtime-2.1,text_output,standard,24.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181123openai,gpt-realtime-2.1,image_input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181124openai,gpt-realtime-2.1,image_cached_input,standard,0.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181125openai,gpt-realtime-2.1-mini,audio_input,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181126openai,gpt-realtime-2.1-mini,audio_cached_input,standard,0.3,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181127openai,gpt-realtime-2.1-mini,audio_output,standard,20.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181128openai,gpt-realtime-2.1-mini,text_input,standard,0.6,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181129openai,gpt-realtime-2.1-mini,text_cached_input,standard,0.06,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181130openai,gpt-realtime-2.1-mini,text_output,standard,2.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181131openai,gpt-realtime-2.1-mini,image_input,standard,0.8,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181132openai,gpt-realtime-2.1-mini,image_cached_input,standard,0.08,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181133openai,gpt-realtime-2,audio_input,standard,32.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181134openai,gpt-realtime-2,audio_cached_input,standard,0.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181135openai,gpt-realtime-2,audio_output,standard,64.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181136openai,gpt-realtime-2,text_input,standard,4.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181137openai,gpt-realtime-2,text_cached_input,standard,0.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181138openai,gpt-realtime-2,text_output,standard,24.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181139openai,gpt-realtime-2,image_input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181140openai,gpt-realtime-2,image_cached_input,standard,0.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181141openai,gpt-realtime-1.5,audio_input,standard,32.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181142openai,gpt-realtime-1.5,audio_cached_input,standard,0.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181143openai,gpt-realtime-1.5,audio_output,standard,64.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181144openai,gpt-realtime-1.5,text_input,standard,4.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181145openai,gpt-realtime-1.5,text_cached_input,standard,0.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181146openai,gpt-realtime-1.5,text_output,standard,16.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181147openai,gpt-realtime-1.5,image_input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181148openai,gpt-realtime-1.5,image_cached_input,standard,0.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181149openai,gpt-realtime-mini,audio_input,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181150openai,gpt-realtime-mini,audio_cached_input,standard,0.3,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181151openai,gpt-realtime-mini,audio_output,standard,20.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181152openai,gpt-realtime-mini,text_input,standard,0.6,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181153openai,gpt-realtime-mini,text_cached_input,standard,0.06,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181154openai,gpt-realtime-mini,text_output,standard,2.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181155openai,gpt-realtime-mini,image_input,standard,0.8,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181156openai,gpt-realtime-mini,image_cached_input,standard,0.08,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181157openai,gpt-realtime,audio_input,standard,32.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181158openai,gpt-realtime,audio_cached_input,standard,0.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181159openai,gpt-realtime,audio_output,standard,64.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181160openai,gpt-realtime,text_input,standard,4.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181161openai,gpt-realtime,text_cached_input,standard,0.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181162openai,gpt-realtime,text_output,standard,16.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181163openai,gpt-realtime,image_input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181164openai,gpt-realtime,image_cached_input,standard,0.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181165openai,gpt-audio-1.5,audio_input,standard,32.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181166openai,gpt-audio-1.5,audio_output,standard,64.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181167openai,gpt-audio-1.5,text_input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181168openai,gpt-audio-1.5,text_output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181169openai,gpt-audio-mini,audio_input,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181170openai,gpt-audio-mini,audio_output,standard,20.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181171openai,gpt-audio-mini,text_input,standard,0.6,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181172openai,gpt-audio-mini,text_output,standard,2.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181173openai,gpt-audio,audio_input,standard,32.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181174openai,gpt-audio,audio_output,standard,64.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181175openai,gpt-audio,text_input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181176openai,gpt-audio,text_output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181177openai,gpt-4o-mini-tts,audio_output,standard,12.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181178openai,gpt-4o-mini-tts,text_input,standard,0.6,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181179openai,tts-1,text_input,standard,15.0,USD,per 1M characters,,https://developers.openai.com/api/docs/pricing,2026-09-181180openai,tts-1-hd,text_input,standard,30.0,USD,per 1M characters,,https://developers.openai.com/api/docs/pricing,2026-09-181181openai,gpt-image-2.5-sunburst,image_cached_input,standard,2.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181182openai,gpt-image-2.5-sunburst,text_cached_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181183openai,gpt-image-2.5-flare,image_cached_input,standard,2.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181184openai,gpt-image-2.5-flare,text_cached_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181185openai,gpt-image-2,image_cached_input,standard,2.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181186openai,gpt-image-2,text_cached_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181187openai,gpt-image-1.5,image_cached_input,standard,2.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181188openai,gpt-image-1.5,text_cached_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181189openai,gpt-image-1-mini,image_cached_input,standard,0.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181190openai,gpt-image-1-mini,text_cached_input,standard,0.2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181191openai,gpt-image-1,image_cached_input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181192openai,gpt-image-1,text_cached_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181193openai,chatgpt-image-latest,image_cached_input,standard,2.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181194openai,chatgpt-image-latest,text_cached_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181195openai,gpt-image-2,image_cached_input,batch,1.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181196openai,gpt-image-2,text_cached_input,batch,0.625,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181197openai,gpt-image-1.5,image_cached_input,batch,1.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181198openai,gpt-image-1.5,text_cached_input,batch,0.63,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181199openai,gpt-image-1-mini,image_cached_input,batch,0.13,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181200openai,gpt-image-1-mini,text_cached_input,batch,0.1,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181201openai,gpt-image-1,image_cached_input,batch,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181202openai,gpt-image-1,text_cached_input,batch,0.63,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181203openai,chatgpt-image-latest,image_cached_input,batch,1.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181204openai,chatgpt-image-latest,text_cached_input,batch,0.63,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181205openai,sora-2,video_output,standard,0.1,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-181206openai,sora-2-pro,video_output,standard,0.7,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-181207openai,sora-2,video_output,batch,0.05,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-181208openai,sora-2-pro,video_output,batch,0.35,USD,per second,,https://developers.openai.com/api/docs/pricing,2026-09-181209openai,gpt-realtime-translate,audio_duration,standard,0.034,USD,per minute,estimated cost per minute of audio,https://developers.openai.com/api/docs/pricing,2026-09-181210openai,gpt-live-transcribe,audio_duration,standard,0.017,USD,per minute,estimated cost per minute of audio,https://developers.openai.com/api/docs/pricing,2026-09-181211openai,gpt-realtime-whisper,audio_duration,standard,0.017,USD,per minute,estimated cost per minute of audio,https://developers.openai.com/api/docs/pricing,2026-09-181212openai,gpt-transcribe,audio_duration,standard,0.0045,USD,per minute,estimated cost per minute of audio,https://developers.openai.com/api/docs/pricing,2026-09-181213openai,gpt-4o-transcribe,audio_input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181214openai,gpt-4o-transcribe,text_output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181215openai,gpt-4o-transcribe,audio_duration,standard,0.006,USD,per minute,estimated cost per minute of audio,https://developers.openai.com/api/docs/pricing,2026-09-181216openai,gpt-4o-mini-transcribe,audio_input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181217openai,gpt-4o-mini-transcribe,text_output,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181218openai,gpt-4o-mini-transcribe,audio_duration,standard,0.003,USD,per minute,estimated cost per minute of audio,https://developers.openai.com/api/docs/pricing,2026-09-181219openai,gpt-4o-transcribe-diarize,audio_input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181220openai,gpt-4o-transcribe-diarize,text_output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181221openai,gpt-4o-transcribe-diarize,audio_duration,standard,0.006,USD,per minute,estimated cost per minute of audio,https://developers.openai.com/api/docs/pricing,2026-09-181222openai,whisper-1,audio_duration,standard,0.006,USD,per minute,estimated cost per minute of audio,https://developers.openai.com/api/docs/pricing,2026-09-181223openai,tool:Web search,Web search (all models),standard,10.0,USD,per 1k calls,$10.00 / 1k calls + Search content tokens billed at model rates.,https://developers.openai.com/api/docs/pricing,2026-09-181224openai,tool:Web search,Image Web search (all models),standard,10.0,USD,per 1k calls,$10.00 / 1k calls + Search content tokens billed at model rates.,https://developers.openai.com/api/docs/pricing,2026-09-181225openai,tool:Web search,"Web search preview (reasoning models, including `gpt-5`, `o-series`)",standard,10.0,USD,per 1k calls,$10.00 / 1k calls + Search content tokens billed at model rates.,https://developers.openai.com/api/docs/pricing,2026-09-181226openai,tool:Web search,Web search preview (non-reasoning models),standard,25.0,USD,per 1k calls,$25.00 / 1k calls + Search content tokens are free.,https://developers.openai.com/api/docs/pricing,2026-09-181227openai,tool:Containers,Hosted Shell and Code Interpreter,standard,0.03,USD,per 20-minute session per container (by size),"1 GB $0.03, 4 GB $0.12, 16 GB $0.48, 64 GB $1.92 per 20-minute session per container.",https://developers.openai.com/api/docs/pricing,2026-09-181228openai,tool:File search,Storage,standard,0.1,USD,per GB per day,$0.10 / GB per day (1 GB free),https://developers.openai.com/api/docs/pricing,2026-09-181229openai,tool:File search,Tool call,standard,2.5,USD,per 1k calls,$2.50 / 1k calls,https://developers.openai.com/api/docs/pricing,2026-09-181230openai,tool:Agent Kit,ChatKit file and image upload storage,standard,0.1,USD,per GB per day,$0.10 / GB-day after 1 GB free per account per month,https://developers.openai.com/api/docs/pricing,2026-09-181231openai,chat-latest,input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181232openai,chat-latest,cached_input,standard,0.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181233openai,chat-latest,output,standard,30.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181234openai,gpt-5.3-codex,input,standard,1.75,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181235openai,gpt-5.3-codex,cached_input,standard,0.175,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181236openai,gpt-5.3-codex,output,standard,14.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181237openai,gpt-rosalind-research,input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181238openai,gpt-rosalind-research,cached_input,standard,0.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181239openai,gpt-rosalind-research,output,standard,25.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181240openai,gpt-5-search-api,input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181241openai,gpt-5-search-api,cached_input,standard,0.125,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181242openai,gpt-5-search-api,output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181243openai,omni-moderation-latest,input,standard,0.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181244openai,gpt-5.3-codex,input,fast,3.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181245openai,gpt-5.3-codex,cached_input,fast,0.35,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181246openai,gpt-5.3-codex,output,fast,28.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181247openai,o4-mini-2025-04-16,fine_tuning_training,standard,100.0,USD,per hour,data sharing,https://developers.openai.com/api/docs/pricing,2026-09-181248openai,o4-mini-2025-04-16,fine_tuned_input,standard,2.0,USD,per 1M tokens,data sharing,https://developers.openai.com/api/docs/pricing,2026-09-181249openai,o4-mini-2025-04-16,fine_tuned_cached_input,standard,0.5,USD,per 1M tokens,data sharing,https://developers.openai.com/api/docs/pricing,2026-09-181250openai,o4-mini-2025-04-16,fine_tuned_output,standard,8.0,USD,per 1M tokens,data sharing,https://developers.openai.com/api/docs/pricing,2026-09-181251openai,gpt-4.1-2025-04-14,fine_tuning_training,standard,25.0,USD,per 1M training tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181252openai,gpt-4.1-2025-04-14,fine_tuned_input,standard,3.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181253openai,gpt-4.1-2025-04-14,fine_tuned_cached_input,standard,0.75,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181254openai,gpt-4.1-2025-04-14,fine_tuned_output,standard,12.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181255openai,gpt-4.1-mini-2025-04-14,fine_tuning_training,standard,5.0,USD,per 1M training tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181256openai,gpt-4.1-mini-2025-04-14,fine_tuned_input,standard,0.8,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181257openai,gpt-4.1-mini-2025-04-14,fine_tuned_cached_input,standard,0.2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181258openai,gpt-4.1-mini-2025-04-14,fine_tuned_output,standard,3.2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181259openai,gpt-4.1-nano-2025-04-14,fine_tuning_training,standard,1.5,USD,per 1M training tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181260openai,gpt-4.1-nano-2025-04-14,fine_tuned_input,standard,0.2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181261openai,gpt-4.1-nano-2025-04-14,fine_tuned_cached_input,standard,0.05,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181262openai,gpt-4.1-nano-2025-04-14,fine_tuned_output,standard,0.8,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181263openai,gpt-4o-2024-08-06,fine_tuning_training,standard,25.0,USD,per 1M training tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181264openai,gpt-4o-2024-08-06,fine_tuned_input,standard,3.75,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181265openai,gpt-4o-2024-08-06,fine_tuned_cached_input,standard,1.875,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181266openai,gpt-4o-2024-08-06,fine_tuned_output,standard,15.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181267openai,gpt-4o-mini-2024-07-18,fine_tuning_training,standard,3.0,USD,per 1M training tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181268openai,gpt-4o-mini-2024-07-18,fine_tuned_input,standard,0.3,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181269openai,gpt-4o-mini-2024-07-18,fine_tuned_cached_input,standard,0.15,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181270openai,gpt-4o-mini-2024-07-18,fine_tuned_output,standard,1.2,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181271openai,gpt-3.5-turbo,fine_tuning_training,standard,8.0,USD,per 1M training tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181272openai,gpt-3.5-turbo,fine_tuned_input,standard,3.0,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181273openai,gpt-3.5-turbo,fine_tuned_output,standard,6.0,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181274openai,davinci-002,fine_tuning_training,standard,6.0,USD,per 1M training tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181275openai,davinci-002,fine_tuned_input,standard,12.0,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181276openai,davinci-002,fine_tuned_output,standard,12.0,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181277openai,babbage-002,fine_tuning_training,standard,0.4,USD,per 1M training tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181278openai,babbage-002,fine_tuned_input,standard,1.6,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181279openai,babbage-002,fine_tuned_output,standard,1.6,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181280openai,o4-mini-2025-04-16,fine_tuning_training,batch,100.0,USD,per hour,data sharing,https://developers.openai.com/api/docs/pricing,2026-09-181281openai,o4-mini-2025-04-16,fine_tuned_input,batch,1.0,USD,per 1M tokens,data sharing,https://developers.openai.com/api/docs/pricing,2026-09-181282openai,o4-mini-2025-04-16,fine_tuned_cached_input,batch,0.25,USD,per 1M tokens,data sharing,https://developers.openai.com/api/docs/pricing,2026-09-181283openai,o4-mini-2025-04-16,fine_tuned_output,batch,4.0,USD,per 1M tokens,data sharing,https://developers.openai.com/api/docs/pricing,2026-09-181284openai,gpt-4.1-2025-04-14,fine_tuning_training,batch,25.0,USD,per 1M training tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181285openai,gpt-4.1-2025-04-14,fine_tuned_input,batch,1.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181286openai,gpt-4.1-2025-04-14,fine_tuned_cached_input,batch,0.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181287openai,gpt-4.1-2025-04-14,fine_tuned_output,batch,6.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181288openai,gpt-4.1-mini-2025-04-14,fine_tuning_training,batch,5.0,USD,per 1M training tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181289openai,gpt-4.1-mini-2025-04-14,fine_tuned_input,batch,0.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181290openai,gpt-4.1-mini-2025-04-14,fine_tuned_cached_input,batch,0.1,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181291openai,gpt-4.1-mini-2025-04-14,fine_tuned_output,batch,1.6,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181292openai,gpt-4.1-nano-2025-04-14,fine_tuning_training,batch,1.5,USD,per 1M training tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181293openai,gpt-4.1-nano-2025-04-14,fine_tuned_input,batch,0.1,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181294openai,gpt-4.1-nano-2025-04-14,fine_tuned_cached_input,batch,0.025,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181295openai,gpt-4.1-nano-2025-04-14,fine_tuned_output,batch,0.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181296openai,gpt-4o-2024-08-06,fine_tuning_training,batch,25.0,USD,per 1M training tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181297openai,gpt-4o-2024-08-06,fine_tuned_input,batch,2.225,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181298openai,gpt-4o-2024-08-06,fine_tuned_cached_input,batch,0.9,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181299openai,gpt-4o-2024-08-06,fine_tuned_output,batch,12.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181300openai,gpt-4o-mini-2024-07-18,fine_tuning_training,batch,3.0,USD,per 1M training tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181301openai,gpt-4o-mini-2024-07-18,fine_tuned_input,batch,0.15,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181302openai,gpt-4o-mini-2024-07-18,fine_tuned_cached_input,batch,0.075,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181303openai,gpt-4o-mini-2024-07-18,fine_tuned_output,batch,0.6,USD,per 1M tokens,,https://developers.openai.com/api/docs/pricing,2026-09-181304openai,gpt-3.5-turbo,fine_tuning_training,batch,8.0,USD,per 1M training tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181305openai,gpt-3.5-turbo,fine_tuned_input,batch,1.5,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181306openai,gpt-3.5-turbo,fine_tuned_output,batch,3.0,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181307openai,davinci-002,fine_tuning_training,batch,6.0,USD,per 1M training tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181308openai,davinci-002,fine_tuned_input,batch,6.0,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181309openai,davinci-002,fine_tuned_output,batch,6.0,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181310openai,babbage-002,fine_tuning_training,batch,0.4,USD,per 1M training tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181311openai,babbage-002,fine_tuned_input,batch,0.8,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181312openai,babbage-002,fine_tuned_output,batch,0.9,USD,per 1M tokens,legacy,https://developers.openai.com/api/docs/pricing,2026-09-181313openai,chatgpt-4o-latest,input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/chatgpt-4o-latest,2026-09-181314openai,chatgpt-4o-latest,output,standard,15.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/chatgpt-4o-latest,2026-09-181315openai,codex-mini-latest,input,standard,1.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/codex-mini-latest,2026-09-181316openai,codex-mini-latest,cached_input,standard,0.375,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/codex-mini-latest,2026-09-181317openai,codex-mini-latest,output,standard,6.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/codex-mini-latest,2026-09-181318openai,computer-use-preview,input,standard,3.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/computer-use-preview,2026-09-181319openai,computer-use-preview,output,standard,12.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/computer-use-preview,2026-09-181320openai,gpt-4-turbo-preview,input,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4-turbo-preview,2026-09-181321openai,gpt-4-turbo-preview,output,standard,30.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4-turbo-preview,2026-09-181322openai,gpt-4-turbo,input,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4-turbo,2026-09-181323openai,gpt-4-turbo,output,standard,30.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4-turbo,2026-09-181324openai,gpt-4.5-preview,input,standard,75.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4.5-preview,2026-09-181325openai,gpt-4.5-preview,cached_input,standard,37.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4.5-preview,2026-09-181326openai,gpt-4.5-preview,output,standard,150.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4.5-preview,2026-09-181327openai,gpt-4,input,standard,30.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4,2026-09-181328openai,gpt-4,output,standard,60.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4,2026-09-181329openai,gpt-4o-audio-preview,input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-audio-preview,2026-09-181330openai,gpt-4o-audio-preview,output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-audio-preview,2026-09-181331openai,gpt-4o-audio-preview,audio_input,standard,40.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-audio-preview,2026-09-181332openai,gpt-4o-audio-preview,audio_output,standard,80.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-audio-preview,2026-09-181333openai,gpt-4o-mini-audio-preview,input,standard,0.15,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-audio-preview,2026-09-181334openai,gpt-4o-mini-audio-preview,output,standard,0.6,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-audio-preview,2026-09-181335openai,gpt-4o-mini-audio-preview,audio_input,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-audio-preview,2026-09-181336openai,gpt-4o-mini-audio-preview,audio_output,standard,20.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-audio-preview,2026-09-181337openai,gpt-4o-mini-realtime-preview,input,standard,0.6,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-realtime-preview,2026-09-181338openai,gpt-4o-mini-realtime-preview,cached_input,standard,0.3,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-realtime-preview,2026-09-181339openai,gpt-4o-mini-realtime-preview,output,standard,2.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-realtime-preview,2026-09-181340openai,gpt-4o-mini-realtime-preview,audio_input,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-realtime-preview,2026-09-181341openai,gpt-4o-mini-realtime-preview,audio_cached_input,standard,0.3,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-realtime-preview,2026-09-181342openai,gpt-4o-mini-realtime-preview,audio_output,standard,20.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-realtime-preview,2026-09-181343openai,gpt-4o-mini-search-preview,input,standard,0.15,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-search-preview,2026-09-181344openai,gpt-4o-mini-search-preview,output,standard,0.6,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-mini-search-preview,2026-09-181345openai,gpt-4o-realtime-preview,input,standard,5.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-realtime-preview,2026-09-181346openai,gpt-4o-realtime-preview,cached_input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-realtime-preview,2026-09-181347openai,gpt-4o-realtime-preview,output,standard,20.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-realtime-preview,2026-09-181348openai,gpt-4o-realtime-preview,audio_input,standard,40.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-realtime-preview,2026-09-181349openai,gpt-4o-realtime-preview,audio_cached_input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-realtime-preview,2026-09-181350openai,gpt-4o-realtime-preview,audio_output,standard,80.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-realtime-preview,2026-09-181351openai,gpt-4o-search-preview,input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-search-preview,2026-09-181352openai,gpt-4o-search-preview,output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-4o-search-preview,2026-09-181353openai,gpt-5-chat-latest,input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5-chat-latest,2026-09-181354openai,gpt-5-chat-latest,cached_input,standard,0.125,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5-chat-latest,2026-09-181355openai,gpt-5-chat-latest,output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5-chat-latest,2026-09-181356openai,gpt-5-codex,input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5-codex,2026-09-181357openai,gpt-5-codex,cached_input,standard,0.125,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5-codex,2026-09-181358openai,gpt-5-codex,output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5-codex,2026-09-181359openai,gpt-5.1-chat-latest,input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-chat-latest,2026-09-181360openai,gpt-5.1-chat-latest,cached_input,standard,0.125,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-chat-latest,2026-09-181361openai,gpt-5.1-chat-latest,output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-chat-latest,2026-09-181362openai,gpt-5.1-codex-max,input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-codex-max,2026-09-181363openai,gpt-5.1-codex-max,cached_input,standard,0.125,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-codex-max,2026-09-181364openai,gpt-5.1-codex-max,output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-codex-max,2026-09-181365openai,gpt-5.1-codex-mini,input,standard,0.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-codex-mini,2026-09-181366openai,gpt-5.1-codex-mini,cached_input,standard,0.025,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-codex-mini,2026-09-181367openai,gpt-5.1-codex-mini,output,standard,2.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-codex-mini,2026-09-181368openai,gpt-5.1-codex,input,standard,1.25,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-codex,2026-09-181369openai,gpt-5.1-codex,cached_input,standard,0.125,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-codex,2026-09-181370openai,gpt-5.1-codex,output,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.1-codex,2026-09-181371openai,gpt-5.2-chat-latest,input,standard,1.75,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.2-chat-latest,2026-09-181372openai,gpt-5.2-chat-latest,cached_input,standard,0.175,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.2-chat-latest,2026-09-181373openai,gpt-5.2-chat-latest,output,standard,14.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.2-chat-latest,2026-09-181374openai,gpt-5.2-codex,input,standard,1.75,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.2-codex,2026-09-181375openai,gpt-5.2-codex,cached_input,standard,0.175,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.2-codex,2026-09-181376openai,gpt-5.2-codex,output,standard,14.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.2-codex,2026-09-181377openai,gpt-5.3-chat-latest,input,standard,1.75,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.3-chat-latest,2026-09-181378openai,gpt-5.3-chat-latest,cached_input,standard,0.175,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.3-chat-latest,2026-09-181379openai,gpt-5.3-chat-latest,output,standard,14.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/gpt-5.3-chat-latest,2026-09-181380openai,o1-mini,input,standard,1.1,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o1-mini,2026-09-181381openai,o1-mini,cached_input,standard,0.55,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o1-mini,2026-09-181382openai,o1-mini,output,standard,4.4,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o1-mini,2026-09-181383openai,o1-preview,input,standard,15.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o1-preview,2026-09-181384openai,o1-preview,cached_input,standard,7.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o1-preview,2026-09-181385openai,o1-preview,output,standard,60.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o1-preview,2026-09-181386openai,o3-deep-research,input,standard,10.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o3-deep-research,2026-09-181387openai,o3-deep-research,cached_input,standard,2.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o3-deep-research,2026-09-181388openai,o3-deep-research,output,standard,40.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o3-deep-research,2026-09-181389openai,o4-mini-deep-research,input,standard,2.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o4-mini-deep-research,2026-09-181390openai,o4-mini-deep-research,cached_input,standard,0.5,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o4-mini-deep-research,2026-09-181391openai,o4-mini-deep-research,output,standard,8.0,USD,per 1M tokens,,https://developers.openai.com/api/docs/models/o4-mini-deep-research,2026-09-181392openai,rule:batch,discount,batch,-50,USD,percent vs standard,"Batch API: 50% lower cost, 24h completion window; per-model batch tables on the pricing page",https://developers.openai.com/api/docs/guides/batch,2026-09-181393openai,rule:flex,discount,flex,-50,USD,percent vs standard,"Flex processing (beta): tokens priced at Batch API rates; slower, may return 429 resource_unavailable",https://developers.openai.com/api/docs/guides/flex-processing,2026-09-181394openai,rule:fast,premium,fast,100,USD,percent vs standard,"Fast mode (ex-Priority processing, renamed 2026-07-30): 2x standard token rates for GPT-5.6 Sol / GPT-6 Astra; service_tier 'fast' or 'priority'",https://developers.openai.com/api/docs/guides/fast-mode,2026-09-181395openai,rule:cache_write,cache_write,standard,125,USD,percent of uncached input rate,GPT-5.6 and later: cache writes billed at 1.25x uncached input; earlier models: no cache-write charge,https://developers.openai.com/api/docs/guides/prompt-caching,2026-09-181396openai,rule:cache_read_gpt-5.6+,cached_input,standard,10,USD,percent of uncached input rate,GPT-5.6 and later: cache reads at 0.1x uncached input rate,https://developers.openai.com/api/docs/guides/prompt-caching,2026-09-181397openai,rule:long_context,multiplier,standard,,USD,x standard,"Prompts >272K input tokens: 2x input (and cache) rates, 1.5x output rate for the full request (GPT-5.4 / 5.5 / 5.6 / 6 Astra)",https://developers.openai.com/api/docs/pricing,2026-09-181398openai,rule:data_residency,uplift,standard,10,USD,percent,Regional processing endpoints (us./eu./ae. …api.openai.com): 10% uplift for models released on or after 2026-03-05 that are eligible for data residency,https://developers.openai.com/api/docs/pricing,2026-09-181399openai,rule:container_billing,session,standard,,USD,"per minute, 5-minute minimum",Since 2026-06-02 eligible container sessions (Code Interpreter / Hosted Shell) are billed per minute with a 5-minute minimum instead of the full 20-minute rate,https://developers.openai.com/api/docs/changelog,2026-09-181400openai,rule:web_search_content_tokens_mini,input,standard,,USD,"8,000 input tokens per call","gpt-4o-mini and gpt-4.1-mini with the non-preview web search tool: search content tokens billed as a fixed block of 8,000 input tokens per call",https://developers.openai.com/api/docs/pricing,2026-09-181401openai,rule:pro_mode,output,standard,,USD,standard token rates,reasoning.mode: pro (GPT-5.6) aggregates all model work and bills it at the model's standard token rates (more tokens than standard mode),https://developers.openai.com/api/docs/guides/reasoning,2026-09-181402openai,gpt-rosalind-research,billing_start,standard,,USD,date,Billing begins 2026-10-05; cache-write pricing does not apply,https://developers.openai.com/api/docs/pricing,2026-09-181403openai,gpt-5.6-sol,promotion,standard,,USD,note,Promotional pricing ($4 in / $20 out) available at least through 2026-11-21,https://developers.openai.com/api/docs/pricing,2026-09-181404xai,grok-4.6,input,standard,2.0,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191405xai,grok-4.6,cached_input,standard,0.5,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191406xai,grok-4.6,image_input,standard,2.0,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output (image tokens priced like text)",https://docs.x.ai/developers/pricing,2026-09-191407xai,grok-4.6,output,standard,6.0,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191408xai,grok-4.6,input,long_context,4.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191409xai,grok-4.6,cached_input,long_context,1.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191410xai,grok-4.6,output,long_context,12.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191411xai,grok-4.6,batch,batch,,USD,per 1M tokens,Batch API not supported for this model (model page),https://docs.x.ai/developers/pricing,2026-09-191412xai,grok-4.6,input,priority,4.0,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191413xai,grok-4.6,cached_input,priority,1.0,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191414xai,grok-4.6,output,priority,12.0,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191415xai,grok-4.6 @ https://us.api.x.ai/v1,input,us_regional,2.2,USD,per 1M tokens,US regional endpoint = 1.1x global token rates (live catalogue on us.api.x.ai shows 22000/5500/66000 ticks); long-context rates also x1.1,https://docs.x.ai/developers/advanced-api-usage/regions,2026-09-191416xai,grok-4.6 @ https://us.api.x.ai/v1,cached_input,us_regional,0.55,USD,per 1M tokens,US regional endpoint = 1.1x global token rates (live catalogue on us.api.x.ai shows 22000/5500/66000 ticks); long-context rates also x1.1,https://docs.x.ai/developers/advanced-api-usage/regions,2026-09-191417xai,grok-4.6 @ https://us.api.x.ai/v1,image_input,us_regional,2.2,USD,per 1M tokens,US regional endpoint = 1.1x global token rates (live catalogue on us.api.x.ai shows 22000/5500/66000 ticks); long-context rates also x1.1,https://docs.x.ai/developers/advanced-api-usage/regions,2026-09-191418xai,grok-4.6 @ https://us.api.x.ai/v1,output,us_regional,6.6,USD,per 1M tokens,US regional endpoint = 1.1x global token rates (live catalogue on us.api.x.ai shows 22000/5500/66000 ticks); long-context rates also x1.1,https://docs.x.ai/developers/advanced-api-usage/regions,2026-09-191419xai,grok-4.5,input,standard,2.0,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191420xai,grok-4.5,cached_input,standard,0.3,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191421xai,grok-4.5,image_input,standard,2.0,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output (image tokens priced like text)",https://docs.x.ai/developers/pricing,2026-09-191422xai,grok-4.5,output,standard,6.0,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191423xai,grok-4.5,input,long_context,4.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191424xai,grok-4.5,cached_input,long_context,0.6,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191425xai,grok-4.5,output,long_context,12.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191426xai,grok-4.5,batch,batch,,USD,per 1M tokens,Batch API not supported for this model (model page),https://docs.x.ai/developers/pricing,2026-09-191427xai,grok-4.5,input,priority,4.0,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191428xai,grok-4.5,cached_input,priority,0.6,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191429xai,grok-4.5,output,priority,12.0,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191430xai,grok-4.3,input,standard,1.25,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191431xai,grok-4.3,cached_input,standard,0.2,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191432xai,grok-4.3,image_input,standard,1.25,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output (image tokens priced like text)",https://docs.x.ai/developers/pricing,2026-09-191433xai,grok-4.3,output,standard,2.5,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191434xai,grok-4.3,input,long_context,2.5,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191435xai,grok-4.3,cached_input,long_context,0.4,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191436xai,grok-4.3,output,long_context,5.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191437xai,grok-4.3,input,batch,1.0,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191438xai,grok-4.3,cached_input,batch,0.16,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191439xai,grok-4.3,output,batch,2.0,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191440xai,grok-4.3,input,priority,2.5,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191441xai,grok-4.3,cached_input,priority,0.4,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191442xai,grok-4.3,output,priority,5.0,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191443xai,grok-4.20-0309-reasoning,input,standard,1.25,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191444xai,grok-4.20-0309-reasoning,cached_input,standard,0.2,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191445xai,grok-4.20-0309-reasoning,image_input,standard,1.25,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output (image tokens priced like text)",https://docs.x.ai/developers/pricing,2026-09-191446xai,grok-4.20-0309-reasoning,output,standard,2.5,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191447xai,grok-4.20-0309-reasoning,input,long_context,2.5,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191448xai,grok-4.20-0309-reasoning,cached_input,long_context,0.4,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191449xai,grok-4.20-0309-reasoning,output,long_context,5.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191450xai,grok-4.20-0309-reasoning,input,batch,1.0,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191451xai,grok-4.20-0309-reasoning,cached_input,batch,0.16,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191452xai,grok-4.20-0309-reasoning,output,batch,2.0,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191453xai,grok-4.20-0309-reasoning,input,priority,2.5,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191454xai,grok-4.20-0309-reasoning,cached_input,priority,0.4,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191455xai,grok-4.20-0309-reasoning,output,priority,5.0,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191456xai,grok-4.20-0309-non-reasoning,input,standard,1.25,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191457xai,grok-4.20-0309-non-reasoning,cached_input,standard,0.2,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191458xai,grok-4.20-0309-non-reasoning,image_input,standard,1.25,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output (image tokens priced like text)",https://docs.x.ai/developers/pricing,2026-09-191459xai,grok-4.20-0309-non-reasoning,output,standard,2.5,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191460xai,grok-4.20-0309-non-reasoning,input,long_context,2.5,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191461xai,grok-4.20-0309-non-reasoning,cached_input,long_context,0.4,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191462xai,grok-4.20-0309-non-reasoning,output,long_context,5.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191463xai,grok-4.20-0309-non-reasoning,input,batch,1.0,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191464xai,grok-4.20-0309-non-reasoning,cached_input,batch,0.16,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191465xai,grok-4.20-0309-non-reasoning,output,batch,2.0,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191466xai,grok-4.20-0309-non-reasoning,input,priority,2.5,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191467xai,grok-4.20-0309-non-reasoning,cached_input,priority,0.4,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191468xai,grok-4.20-0309-non-reasoning,output,priority,5.0,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191469xai,grok-4.20-multi-agent-0309,input,standard,1.25,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191470xai,grok-4.20-multi-agent-0309,cached_input,standard,0.2,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191471xai,grok-4.20-multi-agent-0309,image_input,standard,1.25,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output (image tokens priced like text)",https://docs.x.ai/developers/pricing,2026-09-191472xai,grok-4.20-multi-agent-0309,output,standard,2.5,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191473xai,grok-4.20-multi-agent-0309,input,long_context,2.5,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191474xai,grok-4.20-multi-agent-0309,cached_input,long_context,0.4,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191475xai,grok-4.20-multi-agent-0309,output,long_context,5.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191476xai,grok-4.20-multi-agent-0309,input,batch,1.0,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191477xai,grok-4.20-multi-agent-0309,cached_input,batch,0.16,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191478xai,grok-4.20-multi-agent-0309,output,batch,2.0,USD,per 1M tokens,"Batch API 20% off standard (< 200,000 prompt tokens); applies to input, output, cached and reasoning tokens",https://docs.x.ai/developers/pricing,2026-09-191479xai,grok-build-0.1,input,standard,1.0,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191480xai,grok-build-0.1,cached_input,standard,0.2,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191481xai,grok-build-0.1,image_input,standard,1.0,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output (image tokens priced like text)",https://docs.x.ai/developers/pricing,2026-09-191482xai,grok-build-0.1,output,standard,2.0,USD,per 1M tokens,"prompt < 200,000 tokens; reasoning tokens billed as output",https://docs.x.ai/developers/pricing,2026-09-191483xai,grok-build-0.1,input,long_context,2.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191484xai,grok-build-0.1,cached_input,long_context,0.4,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191485xai,grok-build-0.1,output,long_context,4.0,USD,per 1M tokens,"prompt >= 200,000 tokens -> higher rate for ALL tokens of the request",https://docs.x.ai/developers/pricing,2026-09-191486xai,grok-build-0.1,batch,batch,,USD,per 1M tokens,Batch API not supported for this model (model page),https://docs.x.ai/developers/pricing,2026-09-191487xai,grok-build-0.1,input,priority,2.0,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191488xai,grok-build-0.1,cached_input,priority,0.4,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191489xai,grok-build-0.1,output,priority,4.0,USD,per 1M tokens,service_tier=priority -> 2x standard on all token types (caching discount applied before multiplier); billed only when response service_tier == 'priority',https://docs.x.ai/developers/advanced-api-usage/priority-processing,2026-09-191490xai,grok-imagine-image,image_output,standard,0.02,USD,per image,default tier (image_price); Batch API accepted where supported but no discount; also via image_generation tool,https://docs.x.ai/developers/pricing,2026-09-191491xai,grok-imagine-image-2.0,image_output,standard,0.06,USD,per image,default tier (image_price); Batch API accepted where supported but no discount; also via image_generation tool,https://docs.x.ai/developers/pricing,2026-09-191492xai,grok-imagine-image-2.0,image_output,quality=low resolution=1k,0.04,USD,per image,"quality auto (default) bills at the quality actually served (low for generation, medium for editing)",https://docs.x.ai/developers/pricing,2026-09-191493xai,grok-imagine-image-2.0,image_output,quality=low resolution=2k,0.06,USD,per image,"quality auto (default) bills at the quality actually served (low for generation, medium for editing)",https://docs.x.ai/developers/pricing,2026-09-191494xai,grok-imagine-image-2.0,image_output,quality=low resolution=1.5k,0.05,USD,per image,"quality auto (default) bills at the quality actually served (low for generation, medium for editing)",https://docs.x.ai/developers/pricing,2026-09-191495xai,grok-imagine-image-2.0,image_output,quality=medium resolution=1k,0.06,USD,per image,"quality auto (default) bills at the quality actually served (low for generation, medium for editing)",https://docs.x.ai/developers/pricing,2026-09-191496xai,grok-imagine-image-2.0,image_output,quality=medium resolution=2k,0.08,USD,per image,"quality auto (default) bills at the quality actually served (low for generation, medium for editing)",https://docs.x.ai/developers/pricing,2026-09-191497xai,grok-imagine-image-2.0,image_output,quality=medium resolution=1.5k,0.07,USD,per image,"quality auto (default) bills at the quality actually served (low for generation, medium for editing)",https://docs.x.ai/developers/pricing,2026-09-191498xai,grok-imagine-image-quality,image_output,standard,0.05,USD,per image,default tier (image_price); Batch API accepted where supported but no discount; also via image_generation tool,https://docs.x.ai/developers/pricing,2026-09-191499xai,grok-imagine-video,video_output,standard,0.05,USD,per second,billed per second of generated video; batch at standard rates,https://docs.x.ai/developers/pricing,2026-09-191500xai,grok-imagine-video-1.5,video_output,standard,0.08,USD,per second,billed per second of generated video; batch at standard rates,https://docs.x.ai/developers/pricing,2026-09-191501xai,grok-voice-think-fast-2.0 (speech-to-speech),audio_input_output,standard,0.08,USD,per minute,$4.80 / hour of audio sent or received,https://docs.x.ai/developers/pricing,2026-09-191502xai,grok-voice-think-fast-2.0 (speech-to-speech),text_input_message,standard,0.004,USD,per message,per conversation.item.create text item (function_call_output and audio items excluded),https://docs.x.ai/developers/pricing,2026-09-191503xai,speech-to-text (grok-voice-transcribe-*),audio_input,rest,0.1,USD,per hour,POST /v1/stt,https://docs.x.ai/developers/pricing,2026-09-191504xai,speech-to-text (grok-voice-transcribe-*),audio_input,streaming,0.2,USD,per hour,wss://api.x.ai/v1/stt,https://docs.x.ai/developers/pricing,2026-09-191505xai,text-to-speech,text_input,standard,15.0,USD,per 1M characters,POST /v1/tts and streaming,https://docs.x.ai/developers/pricing,2026-09-191506xai,tool:web_search,per_call,standard,5.0,USD,per 1K calls,only successful server-side tool executions are billed; includes image search; view_image results token-billed only,https://docs.x.ai/developers/pricing,2026-09-191507xai,tool:x_search,per_call,standard,5.0,USD,per 1K calls,only successful server-side tool executions are billed; UNTIL 2026-09-21 12:00 PT: per 1k calls. FROM 2026-09-21: $5 per 1k posts fetched + $10 per 1k user profiles fetched (every post returned incl. parent/quoted counts),https://docs.x.ai/developers/pricing,2026-09-191508xai,tool:code_execution / code_interpreter,per_call,standard,5.0,USD,per 1K calls,only successful server-side tool executions are billed; Python sandbox; code_interpreter alias not supported in gRPC/xai-sdk,https://docs.x.ai/developers/pricing,2026-09-191509xai,tool:attachment_search,per_call,standard,10.0,USD,per 1K calls,only successful server-side tool executions are billed; search files attached to messages,https://docs.x.ai/developers/pricing,2026-09-191510xai,tool:collections_search / file_search,per_call,standard,2.5,USD,per 1K calls,only successful server-side tool executions are billed; RAG over collections; file_search alias not supported in gRPC/xai-sdk,https://docs.x.ai/developers/pricing,2026-09-191511xai,tool:x_search (posts),per_post_fetched,from 2026-09-21,5.0,USD,per 1K posts,replaces per-call billing on 2026-09-21 12:00 PT,https://docs.x.ai/developers/pricing,2026-09-191512xai,tool:x_search (profiles),per_profile_fetched,from 2026-09-21,10.0,USD,per 1K profiles,user search results,https://docs.x.ai/developers/pricing,2026-09-191513xai,tool:image_generation,per_call,standard,0.0,USD,per call,no invocation fee: image_generation billed at Imagine per-image rates; view_* and MCP billed through tokens only,https://docs.x.ai/developers/pricing,2026-09-191514xai,tool:view_image,per_call,standard,0.0,USD,per call,no invocation fee: image_generation billed at Imagine per-image rates; view_* and MCP billed through tokens only,https://docs.x.ai/developers/pricing,2026-09-191515xai,tool:view_x_video,per_call,standard,0.0,USD,per call,no invocation fee: image_generation billed at Imagine per-image rates; view_* and MCP billed through tokens only,https://docs.x.ai/developers/pricing,2026-09-191516xai,tool:mcp (remote MCP tools),per_call,standard,0.0,USD,per call,no invocation fee: image_generation billed at Imagine per-image rates; view_* and MCP billed through tokens only,https://docs.x.ai/developers/pricing,2026-09-191517xai,files,storage_gb_day,standard,0.025,USD,per GiB per day,file storage,https://docs.x.ai/developers/pricing,2026-09-191518xai,collections,storage_gb_day,standard,0.1,USD,per GiB per day,collection storage,https://docs.x.ai/developers/pricing,2026-09-191519xai,files,download_gb,standard,0.2,USD,per GiB,downloads,https://docs.x.ai/developers/pricing,2026-09-191520xai,collections,download_gb,standard,0.2,USD,per GiB,downloads,https://docs.x.ai/developers/pricing,2026-09-191521xai,usage-guideline-violation (Responses API),per_request_fee,standard,0.05,USD,per request,charged when a violation is caught before generation; generations that violate are still charged,https://docs.x.ai/developers/pricing,2026-09-191522xai,management-api (https://management-api.x.ai),per_call,standard,0.0,USD,per call,no pricing documented; requires a Management key (not available to this atlas -> ACCOUNT_RESTRICTED),https://docs.x.ai/developers/management-api-guide,2026-09-191523xai,"GET /v1/models, /v1/language-models, /v1/api-key, /v1/me, POST /v1/tokenize-text",per_call,standard,0.0,USD,per call,"no usage returned; free (not documented explicitly, observed: no cost_in_usd_ticks)",https://docs.x.ai/developers/rest-api-reference/inference/models,2026-09-191524