From 59643cbcadcb2381d32a296d70c0242941b68556 Mon Sep 17 00:00:00 2001 From: Sameer Kankute Date: Thu, 12 Mar 2026 10:20:52 +0530 Subject: [PATCH] Fix model cost for gemini-embedding-2-preview --- .../model_prices_and_context_window_backup.json | 16 +++++++++++----- model_prices_and_context_window.json | 16 +++++++++++----- 2 files changed, 22 insertions(+), 10 deletions(-) diff --git a/litellm/model_prices_and_context_window_backup.json b/litellm/model_prices_and_context_window_backup.json index 83729a16eb..99a644c164 100644 --- a/litellm/model_prices_and_context_window_backup.json +++ b/litellm/model_prices_and_context_window_backup.json @@ -16040,7 +16040,7 @@ "input_cost_per_audio_per_second": 0.00016, "input_cost_per_image": 0.00012, "input_cost_per_token": 2e-07, - "input_cost_per_video_per_second": 0.0237, + "input_cost_per_video_per_second": 0.00079, "litellm_provider": "vertex_ai-embedding-models", "max_input_tokens": 8192, "max_tokens": 8192, @@ -16051,14 +16051,17 @@ "uses_embed_content": true }, "vertex_ai/gemini-embedding-2-preview": { - "input_cost_per_token": 1.5e-07, + "input_cost_per_audio_per_second": 0.00016, + "input_cost_per_image": 0.00012, + "input_cost_per_token": 2e-07, + "input_cost_per_video_per_second": 0.00079, "litellm_provider": "vertex_ai", "max_input_tokens": 8192, "max_tokens": 8192, "mode": "embedding", "output_cost_per_token": 0, "output_vector_size": 3072, - "source": "https://ai.google.dev/gemini-api/docs/embeddings#multimodal", + "source": "https://cloud.google.com/vertex-ai/generative-ai/pricing", "supports_multimodal": true, "uses_embed_content": true }, @@ -16140,7 +16143,10 @@ "tpm": 10000000 }, "gemini/gemini-embedding-2-preview": { - "input_cost_per_token": 1.5e-07, + "input_cost_per_audio_per_second": 0.00016, + "input_cost_per_image": 0.00012, + "input_cost_per_token": 2e-07, + "input_cost_per_video_per_second": 0.0237, "litellm_provider": "gemini", "max_input_tokens": 8192, "max_tokens": 8192, @@ -16148,7 +16154,7 @@ "output_cost_per_token": 0, "output_vector_size": 3072, "rpm": 10000, - "source": "https://ai.google.dev/gemini-api/docs/embeddings#multimodal", + "source": "https://ai.google.dev/gemini-api/docs/pricing", "supports_multimodal": true, "tpm": 10000000 }, diff --git a/model_prices_and_context_window.json b/model_prices_and_context_window.json index 83729a16eb..99a644c164 100644 --- a/model_prices_and_context_window.json +++ b/model_prices_and_context_window.json @@ -16040,7 +16040,7 @@ "input_cost_per_audio_per_second": 0.00016, "input_cost_per_image": 0.00012, "input_cost_per_token": 2e-07, - "input_cost_per_video_per_second": 0.0237, + "input_cost_per_video_per_second": 0.00079, "litellm_provider": "vertex_ai-embedding-models", "max_input_tokens": 8192, "max_tokens": 8192, @@ -16051,14 +16051,17 @@ "uses_embed_content": true }, "vertex_ai/gemini-embedding-2-preview": { - "input_cost_per_token": 1.5e-07, + "input_cost_per_audio_per_second": 0.00016, + "input_cost_per_image": 0.00012, + "input_cost_per_token": 2e-07, + "input_cost_per_video_per_second": 0.00079, "litellm_provider": "vertex_ai", "max_input_tokens": 8192, "max_tokens": 8192, "mode": "embedding", "output_cost_per_token": 0, "output_vector_size": 3072, - "source": "https://ai.google.dev/gemini-api/docs/embeddings#multimodal", + "source": "https://cloud.google.com/vertex-ai/generative-ai/pricing", "supports_multimodal": true, "uses_embed_content": true }, @@ -16140,7 +16143,10 @@ "tpm": 10000000 }, "gemini/gemini-embedding-2-preview": { - "input_cost_per_token": 1.5e-07, + "input_cost_per_audio_per_second": 0.00016, + "input_cost_per_image": 0.00012, + "input_cost_per_token": 2e-07, + "input_cost_per_video_per_second": 0.0237, "litellm_provider": "gemini", "max_input_tokens": 8192, "max_tokens": 8192, @@ -16148,7 +16154,7 @@ "output_cost_per_token": 0, "output_vector_size": 3072, "rpm": 10000, - "source": "https://ai.google.dev/gemini-api/docs/embeddings#multimodal", + "source": "https://ai.google.dev/gemini-api/docs/pricing", "supports_multimodal": true, "tpm": 10000000 },