mirror of
https://github.com/infiniflow/ragflow.git
synced 2026-08-10 17:31:29 +08:00
## Summary Add a `batch_size` field to every embedding model entry in `conf/models/*.json`. The field represents the maximum number of text inputs that can be submitted to the embedding API in a single request. **75 embedding models across 30 config files** now carry a `batch_size`. Values were verified against each provider's official documentation (see the verification table at `Desktop/embedding_models_verified.md`). ## Distribution | batch_size | # models | Provider / Model | |---|---|---| | 1 | 2 | AWS Bedrock `amazon.titan-embed-text-v1/v2:0` — Bedrock `invoke` accepts a single input per call | | 10 | 3 | Aliyun `text-embedding-v3/v4`, Volcengine `doubao-embedding-vision-251215` | | 16 | 5 | BaiChuan `Baichuan-Text-Embedding`, Baidu Qianfan `embedding-v1`, Mistral `mistral-embed`, Replicate (x2) | | 32 | 10 | NVIDIA NIM (x3), SILICONFLOW (x2), PPIO (x3), GiteeAI `bge-m3`, HuaweiCloud `bge-m3` | | 50 | 4 | Tencent Hunyuan `kinfra` embeddings (x4) — `InputList.N` max 50 | | 96 | 8 | Cohere embed-v3/v4 (x5), Bedrock Cohere (x3) | | 100 | 3 | Google Gemini `text-embedding-004`, Upstage (x2) | | 512 | 5 | Zhipu GLM `embedding-2/3` (x2), Perplexity `pplx-embed` (x2), Astraflow `text-embedding-3-large` | | 1000 | 9 | Voyage AI (x9) — API reference max | | 1024 | 1 | DeepInfra `Qwen/Qwen3-Embedding-4B` | | 2048 | 15 | OpenAI (x3) + OpenAI-API-compatible proxies (CometAPI, n1n, Jiekou.AI, GreenPT, TogetherAI, NovitaAI) — OpenAI contract limit | | 16384 | 10 | Jina (x8), 302.AI, GiteeAI `jina-clip-v2` — no documented Jina batch limit, safe high cap | --------- Co-authored-by: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
396 lines
7.2 KiB
JSON
396 lines
7.2 KiB
JSON
{
|
|
"name": "Tencent Hunyuan",
|
|
"url": {
|
|
"default": "https://tokenhub.tencentmaas.com/v1",
|
|
"default-backup": "https://tokenhub.tencentmaas.cn/v1",
|
|
"intl": "https://tokenhub-intl.tencentmaas.com/v1",
|
|
"intl-backup": "https://tokenhub-intl.tencentmaas.cn/v1"
|
|
},
|
|
"url_suffix": {
|
|
"chat": "chat/completions",
|
|
"models": "models",
|
|
"embedding": "embeddings"
|
|
},
|
|
"class": "hunyuan",
|
|
"models": [
|
|
{
|
|
"name": "hy3",
|
|
"content_length": 131072,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "hy3-preview",
|
|
"content_length": 262144,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "kimi-k3",
|
|
"content_length": 1000000,
|
|
"max_output": 131072,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "kimi-k2.7-code-highspeed",
|
|
"content_length": 262144,
|
|
"max_output": 131072,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "kimi-k2.7-code",
|
|
"content_length": 262144,
|
|
"max_output": 131072,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "glm-5.2",
|
|
"content_length": 1000000,
|
|
"max_output": 128000,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "minimax-m3",
|
|
"content_length": 1024000,
|
|
"max_output": 131072,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "deepseek-v4-flash-202605",
|
|
"content_length": 1048576,
|
|
"max_output": 393216,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "deepseek-v4-pro-202606",
|
|
"content_length": 1048576,
|
|
"max_output": 393216,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "deepseek-v4-pro",
|
|
"content_length": 1048576,
|
|
"max_output": 393216,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "deepseek-v4-flash",
|
|
"content_length": 1048576,
|
|
"max_output": 393216,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "hy-mt2-pro",
|
|
"content_length": 8192,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "hy-mt2-plus",
|
|
"content_length": 8192,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "hy-mt2-lite",
|
|
"content_length": 8192,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "hy-role",
|
|
"content_length": 32768,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "hunyuan-role-latest",
|
|
"content_length": 32768,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "qwen3.5-flash",
|
|
"content_length": 1048576,
|
|
"max_output": 65536,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "qwen3.5-plus",
|
|
"content_length": 1048576,
|
|
"max_output": 65536,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "glm-5.1",
|
|
"content_length": 200000,
|
|
"max_output": 128000,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "glm-5",
|
|
"content_length": 200000,
|
|
"max_output": 128000,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "glm-5-turbo",
|
|
"content_length": 200000,
|
|
"max_output": 128000,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "kimi-k2.6",
|
|
"content_length": 262144,
|
|
"max_output": 131072,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "kimi-k2.5",
|
|
"content_length": 262144,
|
|
"max_output": 131072,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "minimax-m2.7",
|
|
"content_length": 204800,
|
|
"max_output": 128000,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "minimax-m2.5",
|
|
"content_length": 204800,
|
|
"max_output": 128000,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "deepseek-v3.2",
|
|
"content_length": 131072,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "glm-5v-turbo",
|
|
"content_length": 200000,
|
|
"max_output": 128000,
|
|
"model_types": [
|
|
"chat",
|
|
"vision"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "hy-vision-2.0-instruct",
|
|
"content_length": 32768,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat",
|
|
"vision"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "youtu-vita",
|
|
"content_length": 32768,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat",
|
|
"vision"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "hunyuan-t1-vision-20250916",
|
|
"content_length": 32768,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat",
|
|
"vision"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "hunyuan-turbos-vision-video-20250728",
|
|
"content_length": 32768,
|
|
"max_output": 8192,
|
|
"model_types": [
|
|
"chat",
|
|
"vision"
|
|
],
|
|
"tools": {
|
|
"support": true
|
|
}
|
|
},
|
|
{
|
|
"name": "kinfra-text-embedding-0.6b",
|
|
"max_tokens": 8192,
|
|
"model_types": [
|
|
"embedding"
|
|
],
|
|
"batch_size": 50
|
|
},
|
|
{
|
|
"name": "kinfra-text-embedding-4b",
|
|
"max_tokens": 8192,
|
|
"model_types": [
|
|
"embedding"
|
|
],
|
|
"batch_size": 50
|
|
},
|
|
{
|
|
"name": "kinfra-vl-embedding-2b",
|
|
"max_tokens": 8192,
|
|
"model_types": [
|
|
"embedding"
|
|
],
|
|
"batch_size": 50
|
|
},
|
|
{
|
|
"name": "kinfra-vl-embedding-8b",
|
|
"max_tokens": 8192,
|
|
"model_types": [
|
|
"embedding"
|
|
],
|
|
"batch_size": 50
|
|
}
|
|
]
|
|
}
|