Cognition lanza SWE-2 y afirma que se queda a un punto de Fable 5.1 en programación con un coste un 64 % menor
Cognition presentó el 10 de septiembre SWE-2, su modelo de programación más avanzado, disponible desde ese día en Devin Desktop y en la CLI de Devin y en despliegue en Devin Web y Fusion. Según la compañía, logra un 50,0 % en FrontierCode 1.1 Main, a un punto de Fable 5.1, con un coste un 64 % inferior. SWE-2 parte de Kimi K3, un modelo de 2,8 billones de parámetros ya entrenado para programación agéntica, y añade un algoritmo de aprendizaje por refuerzo que entrena todos los niveles de esfuerzo de razonamiento en una sola ejecución.
Qué significa para ti
El argumento de Cognition es el coste: sostiene que en FrontierCode y DeepSWE iguala a GPT-5.6 Sol y a Fable 5/5.1 por una fracción de su precio y queda a pocos puntos de GPT-6 Astra por una cuarta parte. Su propia tabla marca el límite: en Terminal-Bench 4 obtiene un 27,3 %, frente al 55,8 % de Fable 5.1 y el 57,9 % de GPT-6 Astra. Parte de las cifras procede de evaluaciones internas de la compañía, a falta de resultados públicos.
Herramientas afectadas
Freemium decenteCuenta y algo de configuraciónPlan gratuito permanente pero recortado. Sirve para trabajar con límites.- Freemium decente
- Tarjeta sin verificar
Verificada
Pulsa «Avisarme» en cualquiera de estas fichas y te escribimos cuando su plan gratuito cambie otra vez.
Fuentes
Todo lo anterior sale de estas páginas. Si alguna contradice lo que publicamos, gana la fuente y lo corregimos.
Seguir leyendo
- ProgramaciónParcial
Accomplish detalla cómo un repositorio malicioso podía saltarse el sandbox de Claude Code y de la CLI de Cursor en macOS
Accomplish, que aísla agentes de IA en una máquina virtual, publicó el 11 y el 12 de septiembre, con demostraciones, dos ataques con los que, según describe, un repositorio o carpeta de proyecto preparados ejecutaban código en un Mac fuera del sandbox de Claude Code y de la CLI de Cursor, sin pedir permiso. Según la empresa, el sandbox sólo envolvía la terminal, mientras el propio programa lanzaba git fuera de él y obedecía la opción core.fsmonitor del repositorio. Accomplish da los dos fallos por corregidos.
AnuncioDisponibilidad sin confirmar
- Claude Code
- Cursor
- Agentes
Anthropic alerta de que el papel de la IA en los ciberataques es cada vez más autónomo
Anthropic publicó el 10 de septiembre un informe sobre las operaciones maliciosas con Claude que desarticuló entre diciembre de 2025 y agosto de 2026 en siete áreas, de las ciberoperaciones y la vigilancia al fraude y la destilación. Según la compañía, la mayoría de las operaciones descritas usaban la IA para ejecutar u orquestar el ataque, con marcos de varios agentes para el reconocimiento, la explotación y la extracción de datos. Los casos emplearon Claude Haiku, Sonnet y Opus; no halló actividad maliciosa en Fable ni en Mythos.
AnuncioDisponibilidad sin confirmar
- Local y open source
Introducing North Small Translate: A leading sovereign open-weight machine translation model
cohere.com publicó esto el 2026-09-10, según la fecha que declara su propia página. Sobre la disponibilidad, el anuncio dice: «Now available for research and non-commercial use under a CC BY-NC 4.0 license, North Small Translate advances Cohere’s mission to make sovereign AI a technological reality..». Sobre el precio: «For enterprises evaluating commercial licenses of North Small Translate, benefit from a strong 80.1 score at just $0.000676 per task, using only 661 tokens on…».
LanzamientoDisponible