Agentes

Anthropic publica tres métricas sobre su propio desarrollo: Claude ya «lidera» el 26 % de su investigación en IA

Anthropic publicó el 17 de septiembre tres mediciones con las que propone que el público pueda seguir el ritmo del desarrollo de la IA dentro de los laboratorios: cuánta investigación la hace ya la propia IA, cómo se supervisan las acciones de los agentes y cómo se reparte el cómputo. Según sus datos, en agosto Claude «lideraba» el 26 % del trabajo de investigación y desarrollo de la compañía y más del 90 % estaba al menos en el nivel de «la IA colabora». Añade que Claude no operaba de forma totalmente autónoma en ninguna parte medida.

AnuncioDisponibilidad sin confirmarSin confirmar si afecta al plan gratuitoVerificada

Qué significa para ti

Las cifras las calcula la propia Anthropic, y quien puntúa cada tarea es un juez que también es Claude, sobre una escala de Epoch AI. Aun así dan una referencia pública donde no había ninguna: unos 30.000 agentes trabajando a la vez en su plataforma interna y, en la semana examinada, un 6 % del cómputo de I+D dedicado a seguridad. La empresa dice que incorporará evaluadores externos con acceso comparable al de sus equipos de riesgo, y que estos números cambiarían si se coordinara frenar el ritmo, como pidió su consejero delegado.

Fuentes

Todo lo anterior sale de estas páginas. Si alguna contradice lo que publicamos, gana la fuente y lo corregimos.

Seguir leyendo

  • Agentes

    Anthropic alerta de que el papel de la IA en los ciberataques es cada vez más autónomo

    Anthropic publicó el 10 de septiembre un informe sobre las operaciones maliciosas con Claude que desarticuló entre diciembre de 2025 y agosto de 2026 en siete áreas, de las ciberoperaciones y la vigilancia al fraude y la destilación. Según la compañía, la mayoría de las operaciones descritas usaban la IA para ejecutar u orquestar el ataque, con marcos de varios agentes para el reconocimiento, la explotación y la extracción de datos. Los casos emplearon Claude Haiku, Sonnet y Opus; no halló actividad maliciosa en Fable ni en Mythos.

    AnuncioDisponibilidad sin confirmar

  • Agentes

    OpenAI lanza la Agents API y lleva la voz en tiempo real de GPT-Live-1 a su API

    OpenAI presentó el 10 de septiembre la Agents API, un servicio gestionado para crear y lanzar agentes en la nube que se apoya en el entorno de Codex para la orquestación, las sesiones de larga duración y el uso de herramientas. El mismo día incorporó a su API GPT-Live-1, que ofrece conversaciones de voz naturales en dúplex completo, con mejor seguimiento de instrucciones, voces personalizadas y soporte para telefonía.

    LanzamientoDisponible

  • AgentesAfecta al plan gratuito

    Ollama activa por defecto su experiencia de agente interactivo

    La versión 0.32.0 de Ollama, del 11 de julio de 2026, lanza por defecto una nueva experiencia de agente interactivo: según sus notas de versión, ejecutar `ollama` arranca ahora un agente que ayuda a programar y a delegar trabajo.

    ActualizaciónDisponible

    Herramientas:Ollama