Agentes RSS

Seguridad de IA 🇨🇳

Agente de seguridad chino supera a OpenAI y Anthropic: alcanza el top 4 mundial y el primero nacional

El agente de seguridad de Sangfor Technologies, Sangfor AI, alcanzó el cuarto puesto mundial y el primero entre los equipos nacionales en el benchmark de seguridad de CyberGym, superando a OpenAI y Anthropic. El agente, impulsado por el modelo GLM-5.2, completó con éxito 1,301 de 1,507 desafíos de vulnerabilidad, logrando una tasa de éxito del 86.3%.

Sangfor TechnologiesSangfor Technologies OpenAIOpenAI AnthropicAnthropic
QbitAI 量子位29.07 · 12:03
Agentes 🇷🇺

Fallos de agentes de IA: por qué los paneles están verdes pero los agentes mienten durante días

La monitorización clásica no detecta los fallos de los agentes de IA porque estos se degradan gradualmente, no colapsan. Para detectar problemas, los equipos deben rastrear los ciclos de razonamiento, medir métricas de calidad agentiva, usar evaluación de LLM como juez, versionar los mensajes y escribir telemetría en dos destinos desde el primer día.

Cloud.ruCloud.ru
Habr — хаб ИИ29.07 · 12:03
Noticias frescas