diff --git a/conf/llm_factories.json b/conf/llm_factories.json index c7970ca634..921d4f7c91 100644 --- a/conf/llm_factories.json +++ b/conf/llm_factories.json @@ -1700,12 +1700,6 @@ ], "is_tools": false }, - { - "llm_name": "gte-rerank", - "tags": "RE-RANK,4k", - "max_tokens": 4000, - "model_type": "rerank" - }, { "llm_name": "qwen3-asr-flash", "tags": "SPEECH2TEXT,8k", diff --git a/rag/llm/rerank_model.py b/rag/llm/rerank_model.py index 2e4d1c43b0..0f7a0c5a9c 100644 --- a/rag/llm/rerank_model.py +++ b/rag/llm/rerank_model.py @@ -518,7 +518,7 @@ class VoyageRerank(Base): class QWenRerank(Base): _FACTORY_NAME = "Tongyi-Qianwen" - def __init__(self, key, model_name="gte-rerank", **kwargs): + def __init__(self, key, model_name="gte-rerank-v2", **kwargs): import dashscope self.api_key = key