Precios
OpenRouter compara los enrutadores de modelos y enumera cuándo salen peor que usar un modelo a secas
OpenRouter publicó el 2 de octubre una página de comparativas para los enrutadores de modelos, los servicios que deciden a qué modelo va cada petición. Pasó cada uno por un conjunto de pruebas de dominios variados para puntuarlo en calidad, velocidad y coste, y enseña al lado modelos individuales como referencia. Resume los tres resultados en un Router Index de 0 a 10 que por defecto pesa la calidad un 60 %, el tiempo por tarea un 20 % y el coste otro 20 %, con un deslizador para cambiar esos pesos.
LanzamientoDisponibleSin confirmar si afecta al plan gratuito
Qué significa para ti
Lo que distingue a la página es que enumera cuándo enrutar sale mal, y admite que puede salir peor que usar un solo modelo: cambiar de modelo encarece la petición mientras se reconstruye la caché de entrada, el enrutador no suele tener información suficiente para juzgar la complejidad mirando el prompt, y cuanto más se procesa la decisión más latencia se añade. El tamaño del hueco que justifica todo esto, con su ejemplo: entre DeepSeek v4 Flash y GPT-6 Astra el precio medio por token se multiplica por más de 48. Avisan de que la comparativa representa tareas generales, no la tuya.
Fuentes
Todo lo anterior sale de estas páginas. Si alguna contradice lo que publicamos, gana la fuente y lo corregimos.
Seguir leyendo
- Local y open source
Ai2 abre AstaBrief 8B, un modelo pequeño que redacta informes científicos con sus citas
Ai2 publicó el 2 de octubre AstaBrief 8B, un modelo que convierte una pregunta de investigación y extractos de literatura recuperada en un informe con citas. Ya funciona dentro de Asta, su plataforma científica, como modo rápido junto a un modo de razonamiento basado en Claude, y además abren el modelo y los datos de entrenamiento para que otros los estudien y reproduzcan. Partieron de Qwen3-8B y pusieron el esfuerzo en los datos posteriores al entrenamiento y en el andamiaje que arma el informe.
LanzamientoDisponible
- Local y open source
NVIDIA pone a la venta el 23 de octubre un DGX Spark de 64 GB, y no dice a qué precio
NVIDIA anunció el 2 de octubre una configuración de 64 GB de memoria unificada para el DGX Spark, su ordenador compacto para ejecutar IA en local. Llegará el 23 de octubre de la mano de Acer, ASUS, Dell, Gigabyte, HP y MSI, con DGX OS y su pila de software lista desde el primer día. Mantiene el chip GB10 Grace Blackwell y el mismo software que el modelo de 128 GB, y la compañía sostiene que admite modelos de hasta 100.000 millones de parámetros ejecutados enteramente en el aparato.
AnuncioAnunciado
- Agentes
ComfyUI estrena un agente que monta y arregla los flujos de trabajo, en beta y de momento sólo en su nube
Comfy presentó el 1 de octubre Comfy Agent, un agente que vive dentro de ComfyUI: se le describe lo que se quiere y él construye, ejecuta e itera los flujos de trabajo a la vista del usuario. Está disponible para todo el mundo en Comfy Cloud y llegará a Comfy Desktop en unas semanas. Trabaja sobre el mismo lienzo mientras el usuario edita, admite skills públicas o privadas y hasta cinco conversaciones en paralelo, y la compañía insiste en que todos los controles de ComfyUI siguen ahí, nodo por nodo.
Preview o betaPreview