
Nexus ONE — Plataforma Unificada de Modelos
Un único plano para registrar, configurar, orquestar y observar todos tus modelos LLM — conectado nativamente a Nexus RAG.
Gestión centralizada
- Registro y versionado: GPT, Claude, Llama, Mistral, on-premise via vLLM
- Parámetros por modelo: temperature, top_p, max_tokens, system prompt
- Modelos Registrados y seting de parámetros (panel visual)
- Gestión de modelos: altas, bajas, activación y quotas por proyecto
Orquestación inteligente
- Routing por tarea, coste y latencia con fallback automático
- Tool calling unificado para RAG, memoria y graph
- Evaluación comparativa y A/B de respuestas
Observabilidad y Gobierno
- Logs, métricas de latencia y consumo de tokens
- Control de acceso por confidencialidad y proyecto
- Despliegue on-premise / cloud híbrido
