mirror of
https://github.com/tiennm99/litellm.git
synced 2026-08-09 02:24:40 +00:00
add chat-bison-32k@002
This commit is contained in:
@@ -1107,6 +1107,8 @@
|
||||
"max_output_tokens": 4096,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1117,6 +1119,8 @@
|
||||
"max_output_tokens": 4096,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1127,6 +1131,8 @@
|
||||
"max_output_tokens": 4096,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1137,6 +1143,20 @@
|
||||
"max_output_tokens": 8192,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
},
|
||||
"chat-bison-32k@002": {
|
||||
"max_tokens": 8192,
|
||||
"max_input_tokens": 32000,
|
||||
"max_output_tokens": 8192,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1147,6 +1167,8 @@
|
||||
"max_output_tokens": 1024,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-code-text-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1157,6 +1179,8 @@
|
||||
"max_output_tokens": 1024,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-code-text-models",
|
||||
"mode": "completion",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1197,6 +1221,8 @@
|
||||
"max_output_tokens": 1024,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-code-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1207,6 +1233,8 @@
|
||||
"max_output_tokens": 1024,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-code-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1217,6 +1245,8 @@
|
||||
"max_output_tokens": 8192,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-code-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
|
||||
@@ -1107,6 +1107,8 @@
|
||||
"max_output_tokens": 4096,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1117,6 +1119,8 @@
|
||||
"max_output_tokens": 4096,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1127,6 +1131,8 @@
|
||||
"max_output_tokens": 4096,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1137,6 +1143,20 @@
|
||||
"max_output_tokens": 8192,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
},
|
||||
"chat-bison-32k@002": {
|
||||
"max_tokens": 8192,
|
||||
"max_input_tokens": 32000,
|
||||
"max_output_tokens": 8192,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1147,6 +1167,8 @@
|
||||
"max_output_tokens": 1024,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-code-text-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1157,6 +1179,8 @@
|
||||
"max_output_tokens": 1024,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-code-text-models",
|
||||
"mode": "completion",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1197,6 +1221,8 @@
|
||||
"max_output_tokens": 1024,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-code-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1207,6 +1233,8 @@
|
||||
"max_output_tokens": 1024,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-code-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
@@ -1217,6 +1245,8 @@
|
||||
"max_output_tokens": 8192,
|
||||
"input_cost_per_token": 0.000000125,
|
||||
"output_cost_per_token": 0.000000125,
|
||||
"input_cost_per_character": 0.00000025,
|
||||
"output_cost_per_character": 0.0000005,
|
||||
"litellm_provider": "vertex_ai-code-chat-models",
|
||||
"mode": "chat",
|
||||
"source": "https://cloud.google.com/vertex-ai/generative-ai/docs/learn/models#foundation_models"
|
||||
|
||||
Reference in New Issue
Block a user