diff --git a/astrbot/core/config/default.py b/astrbot/core/config/default.py index 780e070098..942bcda65f 100644 --- a/astrbot/core/config/default.py +++ b/astrbot/core/config/default.py @@ -1904,9 +1904,9 @@ "enable": True, "embedding_api_key": "", "embedding_api_base": "https://integrate.api.nvidia.com/v1", - "embedding_model": "nvidia/llama-nemotron-embed-1b-v2", + "embedding_model": "nvidia/nemotron-3-embed-1b", "input_type": "passage", - "embedding_dimensions": 1024, + "embedding_dimensions": 2048, "timeout": 20, "proxy": "", }, @@ -1982,7 +1982,7 @@ "enable": True, "nvidia_rerank_api_key": "", "nvidia_rerank_api_base": "https://ai.api.nvidia.com/v1/retrieval", - "nvidia_rerank_model": "nv-rerank-qa-mistral-4b:1", + "nvidia_rerank_model": "nvidia/llama-nemotron-rerank-vl-1b-v2", "nvidia_rerank_model_endpoint": "/reranking", "timeout": 20, "nvidia_rerank_truncate": "", diff --git a/astrbot/core/provider/sources/nvidia_embedding_source.py b/astrbot/core/provider/sources/nvidia_embedding_source.py index b13ee0d201..475fadeecc 100644 --- a/astrbot/core/provider/sources/nvidia_embedding_source.py +++ b/astrbot/core/provider/sources/nvidia_embedding_source.py @@ -28,7 +28,7 @@ def __init__(self, provider_config: dict, provider_settings: dict) -> None: ) self.timeout = int(provider_config.get("timeout", 20)) self.model = provider_config.get( - "embedding_model", "nvidia/llama-nemotron-embed-1b-v2" + "embedding_model", "nvidia/nemotron-3-embed-1b" ) self.input_type = provider_config.get("input_type", "passage") diff --git a/astrbot/core/provider/sources/nvidia_rerank_source.py b/astrbot/core/provider/sources/nvidia_rerank_source.py index c168da4a6e..6f3f92c1cd 100644 --- a/astrbot/core/provider/sources/nvidia_rerank_source.py +++ b/astrbot/core/provider/sources/nvidia_rerank_source.py @@ -19,7 +19,7 @@ def __init__(self, provider_config: dict, provider_settings: dict) -> None: ).rstrip("/") self.timeout = provider_config.get("timeout", 20) self.model = provider_config.get( - "nvidia_rerank_model", "nv-rerank-qa-mistral-4b:1" + "nvidia_rerank_model", "nvidia/llama-nemotron-rerank-vl-1b-v2" ) self.model_endpoint = provider_config.get( "nvidia_rerank_model_endpoint", "/reranking"