Forge is available: build a website with AI from your RodiumAi account.

Try Forge
Back to all models
Google

Google DeepMind

Gemini family — multimodal models with massive context windows and hybrid reasoning.

Available models

29

Starting rate

7.6 RODI / 1M

Max context

2M

Google
Gemini 3.8 Flashgoogle/gemini-3.8-flash
chatvisionreasoninglong-contextcodingagentscomputer-use

Gemini 3.8 Flash is Google's most intelligent Flash workhorse yet, with major gains over 3.7 Flash in software engineering, agentic workflows, and multi-step reasoning in specialized domains—at Flash speed and cost.

Price

  • In565.2RODI/M~0.750 USD/M
  • Out2825.8RODI/M~3.75 USD/M
  • Cached56.6RODI/M~0.0750 USD/M
Context1.0MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 3.7 Flashgoogle/gemini-3.7-flash
chatvisionreasoninglong-contextcodingagents

Gemini 3.7 Flash is Google's most capable Flash model for agentic workflows, coding, and multimodal reasoning. Algorithmic upgrade over 3.6 Flash with the same 1M context and thinking levels (low, medium, high).

Price

  • In565.2RODI/M~0.750 USD/M
  • Out2825.8RODI/M~3.75 USD/M
  • Cached56.6RODI/M~0.0750 USD/M
Context1.0MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 3.6 Flashgoogle/gemini-3.6-flash
chatvisionreasoninglong-contextcodingagents

Gemini 3.6 Flash balances speed with intelligence for agentic and multimodal tasks. It excels at code generation, agentic execution, and spatial reasoning, with 1M context and built-in thinking.

Price

  • In565.2RODI/M~0.750 USD/M
  • Out2825.8RODI/M~3.75 USD/M
  • Cached56.6RODI/M~0.0750 USD/M
Context1.0MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 3.5 Flashgoogle/gemini-3.5-flash
chatvisionreasoninglong-context

Gemini 3.5 Flash is Google's high-efficiency multimodal model, bringing near-Pro level coding and reasoning at Flash-tier cost and speed. It is highly optimized for coding proficiency and parallel agentic execution...

Price

  • In1130.4RODI/M~1.50 USD/M
  • Out6781.9RODI/M~9.00 USD/M
  • Cached113.1RODI/M~0.150 USD/M
Context1.0MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 3.1 Pro PreviewNewgoogle/gemini-3.1-pro-preview
chatvisionreasoningpreviewcoding

Most capable model in Gemini lineup. 2M token context window — largest in industry. Tiered pricing: input/output roughly doubles above 200K tokens. Paid tier only, no free access. Preview status: may change before GA, more restrictive rate limits. Supports multimodal understanding, agentic capabilities, and coding.

Price

  • In1507.1RODI/M~2.00 USD/M
  • Out9042.5RODI/M~12.00 USD/M
  • Cached150.8RODI/M~0.200 USD/M
Context2MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 3.1 Flash Litegoogle/gemini-3.1-flash-lite
chatvisionaffordablemultimodal

Most cost-efficient model in Gemini API. Moved from preview to GA on May 7, 2026. Optimized for high-volume agentic tasks, translation, and simple data processing. Audio input priced 2x higher than text/image/video. Flat pricing regardless of context length.

Price

  • In188.4RODI/M~0.250 USD/M
  • Out1130.4RODI/M~1.50 USD/M
  • Cached18.9RODI/M~0.0250 USD/M
View all rates
Context1.0MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 3.1 Flash Lite PreviewNewgoogle/gemini-3.1-flash-lite-preview
chatvisionpreviewaffordable

Gemini 3.1 Flash Lite Preview is Google's high-efficiency model optimized for high-volume use cases. It outperforms Gemini 2.5 Flash Lite on overall quality and approaches Gemini 2.5 Flash performance across...

Price

  • In188.4RODI/M~0.250 USD/M
  • Out1130.4RODI/M~1.50 USD/M
  • Cached18.9RODI/M~0.0250 USD/M
View all rates
Context1.0MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 2.5 Progoogle/gemini-2.5-pro
chatvisionreasoningmultimodal

Gemini 2.5 Pro is Google’s state-of-the-art AI model designed for advanced reasoning, coding, mathematics, and scientific tasks. It employs “thinking” capabilities, enabling it to reason through responses with enhanced accuracy...

Price

  • In942.0RODI/M~1.25 USD/M
  • Out7535.4RODI/M~10.00 USD/M
  • Cached233.6RODI/M~0.310 USD/M
Context1.0MSpeedDeepInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 2.5 Flash Litegoogle/gemini-2.5-flash-lite
chatvisionaffordablemultimodal

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...

Price

  • In75.4RODI/M~0.100 USD/M
  • Out301.5RODI/M~0.400 USD/M
  • Cached18.9RODI/M~0.0250 USD/M
View all rates
Context1.0MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 2.5 Flashgoogle/gemini-2.5-flash
chatvisionreasoningmultimodal

Gemini 2.5 Flash is Google's state-of-the-art workhorse model, specifically designed for advanced reasoning, coding, mathematics, and scientific tasks. It includes built-in "thinking" capabilities, enabling it to provide responses with greater...

Price

  • In226.1RODI/M~0.300 USD/M
  • Out1883.9RODI/M~2.50 USD/M
  • Cached226.1RODI/M~0.300 USD/M
View all rates
Context1.0MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Text Embedding 004EmbeddingTemporarily unavailablegoogle/text-embedding-004

Temporarily unavailable

This model is temporarily unavailable on RodiumAi. Please try another model or check back later.

chataffordable

Standard embedding model for vector generation. Free tier available. Used for semantic search, RAG, and similarity tasks. Grounding with Google Search available on top: $0.15/MTok embedding tokens plus standard retrieval costs. via Google Gemini API (direct).

Price

  • In89.9RODI/M~0.150 USD/M
Context2KSpeedDeepInput:textOutput:embeddingModel details
Google
Text Multilingual Embedding 002google/text-multilingual-embedding-002
embeddingsemantic-searchragmultilingual

Google multilingual text embedding model for semantic search, RAG, clustering, and similarity across 100+ languages.

Price

  • In7.6RODI/M~0.0100 USD/M
Context2KSpeedFastInput:textOutput:embeddingModel details
Google
Gemini Embedding 001google/gemini-embedding-001
embeddingsemantic-searchraggemini

Google Gemini embedding model for high-quality vector representations, semantic search, and RAG.

Price

  • In18.9RODI/M~0.0250 USD/M
Context2KSpeedBalancedInput:textOutput:embeddingModel details
Google
Gemini 3 Flash Previewgoogle/gemini-3-flash-preview
chatvisionreasoningpreview

Gemini 3 Flash Preview is a high speed, high value thinking model designed for agentic workflows, multi turn chat, and coding assistance. It delivers near Pro level reasoning and tool...

Price

  • In376.8RODI/M~0.500 USD/M
  • Out2260.7RODI/M~3.00 USD/M
Context1.0MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 2.5 Flash Lite Preview 09-2025google/gemini-2.5-flash-lite-preview-09-2025
chatvisionpreviewaffordable

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...

Price

  • In75.4RODI/M~0.100 USD/M
  • Out301.5RODI/M~0.400 USD/M
  • Cached18.9RODI/M~0.0250 USD/M
View all rates
Context1.0MSpeedFastInput:textimagedocumentaudiovideoOutput:textModel details
Google
Gemini 3.1 Pro Preview Custom Toolsgoogle/gemini-3.1-pro-preview-customtools
chatvisionreasoningtoolspreview

Variant of Gemini 3.1 Pro Preview optimized for custom tool selection and multi-turn tool calling. Most capable model in Gemini lineup. 2M token context window — largest in industry. Tiered pricing: input/output roughly doubles above 200K tokens. Paid tier only, no free access. Preview status: may change before GA, more restrictive rate limits. Supports multimodal understanding, agentic capabilities, and coding.

Price

  • In1507.1RODI/M~2.00 USD/M
  • Out9042.5RODI/M~12.00 USD/M
  • Cached150.8RODI/M~0.200 USD/M
Context2MSpeedDeepInput:textimagedocumentaudiovideoOutput:textModel details
Google
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)google/gemini-3.1-flash-lite-image
image-gennano-bananamultimodal

Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) is Google's fastest, most cost-efficient Gemini image model, built for high-velocity developer pipelines and rapid-fire visual exploration. It delivers text-to-image generation...

Price

  • In188.4RODI/M~0.250 USD/M
  • Out1130.4RODI/M~1.50 USD/M
Context66KSpeedFastInput:textimageOutput:textimageModel details
Google
Nano Banana Pro (Gemini 3 Pro Image)google/gemini-3-pro-image
image-gennano-banana

Nano Banana Pro is Google’s most advanced image-generation and editing model, built on Gemini 3 Pro. It extends the original Nano Banana with significantly improved multimodal reasoning, real-world grounding, and...

Price

  • In1507.1RODI/M~2.00 USD/M
  • Out9042.5RODI/M~12.00 USD/M
Context66KSpeedDeepInput:textimageOutput:textimageModel details
Google
Nano Banana Pro (Gemini 3 Pro Image Preview)google/gemini-3-pro-image-preview
image-gennano-bananapreview

Nano Banana Pro is Google’s most advanced image-generation and editing model, built on Gemini 3 Pro. It extends the original Nano Banana with significantly improved multimodal reasoning, real-world grounding, and...

Price

  • In1507.1RODI/M~2.00 USD/M
  • Out9042.5RODI/M~12.00 USD/M
Context66KSpeedDeepInput:textimageOutput:textimageModel details
Google
Nano Banana 2 (Gemini 3.1 Flash Image)google/gemini-3.1-flash-image
image-gennano-banana

Gemini 3.1 Flash Image, a.k.a. "Nano Banana 2," is Google’s latest state of the art image generation and editing model, delivering Pro-level visual quality at Flash speed. It combines advanced...

Price

  • In376.8RODI/M~0.500 USD/M
  • Out2260.7RODI/M~3.00 USD/M
Context131KSpeedBalancedInput:textimageOutput:textimageModel details
Google
Nano Banana 2 (Gemini 3.1 Flash Image Preview)google/gemini-3.1-flash-image-preview
image-gennano-bananapreview

Gemini 3.1 Flash Image Preview, a.k.a. "Nano Banana 2," is Google’s latest state of the art image generation and editing model, delivering Pro-level visual quality at Flash speed. It combines...

Price

  • In376.8RODI/M~0.500 USD/M
  • Out2260.7RODI/M~3.00 USD/M
Context131KSpeedBalancedInput:textimageOutput:textimageModel details
Google
Gemini Omni Flash Previewgoogle/gemini-omni-flash-preview
videoomnipreviewmultimodal

Gemini Omni Flash is a preview multimodal model for fast conversational video generation and editing. It turns text, images, audio, and video into short 720p clips and lets you refine them in natural language via the Interactions API.

Price

  • In1130.4RODI/M~1.50 USD/M
  • Out13186.9RODI/M~17.50 USD/M
Context1.0MSpeedFastInput:textimageaudiovideoOutput:videoModel details
Google
Veo 3.1google/veo-3.1
videoveomultimodal

Google Veo 3.1 — high-quality text/image-to-video with synchronized audio. GA on Vertex AI (us-central1). Default output 4/6/8 seconds at 720p or 1080p.

Price

  • Per second301.5RODI/s~0.400 USD/s
  • With audio / s301.5RODI/s~0.400 USD/s
  • No audio / s150.8RODI/s~0.200 USD/s
View all rates
Context—SpeedDeepInput:textimageOutput:videoModel details
Google
Veo 3.1 Fastgoogle/veo-3.1-fast
videoveomultimodal

Google Veo 3.1 Fast — lower-latency text/image-to-video with synchronized audio. GA on Vertex AI (us-central1). Optimized for faster iteration at 720p, 1080p, or 4K.

Price

  • Per second75.4RODI/s~0.100 USD/s
  • With audio / s75.4RODI/s~0.100 USD/s
  • No audio / s60.3RODI/s~0.0800 USD/s
View all rates
Context—SpeedFastInput:textimageOutput:videoModel details
Google
Veo 3.1 Litegoogle/veo-3.1-lite
videoveomultimodalaffordable

Google Veo 3.1 Lite — fastest, most cost-efficient Veo tier for text/image-to-video. GA on Vertex AI (us-central1). Best for rapid prototyping at 720p or 1080p.

Price

  • Per second60.3RODI/s~0.0800 USD/s
  • With audio / s37.7RODI/s~0.0500 USD/s
  • No audio / s22.7RODI/s~0.0300 USD/s
View all rates
Context0KSpeedFastInput:textimageOutput:videoModel details
Google
Gemini 2.5 Flash TTSgoogle/gemini-2.5-flash-tts
speechttsaudio

Gemini 2.5 Flash TTS is Google's fast text-to-speech model for low-latency, high-fidelity narration. It converts text into spoken audio via generateContent (response modalities AUDIO) or POST /v1/audio/speech, with controllable prebuilt voices.

Price

  • In376.8RODI/M~0.500 USD/M
  • Audio out—USD/s~10.00 USD/s
Context33KSpeedFastInput:textOutput:audioModel details
Google
Gemini 2.5 Pro TTSgoogle/gemini-2.5-pro-tts
speechttsaudio

Gemini 2.5 Pro TTS is Google's higher-quality text-to-speech model for expressive, natural narration. It converts text into spoken audio via generateContent (response modalities AUDIO) or POST /v1/audio/speech, with controllable prebuilt voices.

Price

  • In376.8RODI/M~0.500 USD/M
  • Audio out—USD/s~10.00 USD/s
Context33KSpeedBalancedInput:textOutput:audioModel details
Google
Gemini 3.5 Transcribegoogle/gemini-3.5-transcribe
transcriptionsttaudiopreviewdiarization

Google dedicated speech-to-text model for pre-recorded audio via POST /v1/audio/transcriptions (generateContent + audioTranscriptionConfig). Supports 85+ languages, speaker diarization, word timestamps, Smart transcription, and custom vocabulary.

Price

  • In1507.1RODI/M~2.00 USD/M
  • Out9042.5RODI/M~12.00 USD/M
  • Audio in—USD/s~2.00 USD/s
Context—SpeedBalancedInput:audioOutput:textModel details
Google
Gemini 3.5 Transcribe Livegoogle/gemini-3.5-transcribe-live
transcriptionsttaudioliverealtimepreview

Google real-time streaming speech-to-text via Gemini Live API (WebSocket BidiGenerateContent). Low-latency interim + final transcripts for microphone / streaming audio up to ~10 minutes per session.

Price

  • In2637.4RODI/M~3.50 USD/M
  • Out15824.3RODI/M~21.00 USD/M
  • Audio in—USD/s~3.50 USD/s
Context—SpeedFastInput:audioOutput:textModel details