METR

Últimas notícias, modelos e lançamentos de IA de METR.

Agentes 🇺🇸

Import AI 466: Lição Amarga para Robótica, IA Completa Tarefas de Programação de Uma Semana, e Hacker Aleatório da OpenAI

Na edição mais recente do Import AI: o benchmark MirrorCode mostra que sistemas de IA podem completar uma tarefa em 14 horas que levaria até 17 semanas para um humano, com custo de $251 para inferência. A Anthropic demonstra capacidades robóticas melhoradas à medida que os modelos escalam, enquanto a startup Sunday relata uma taxa de sucesso de 99,1% para robôs dobrando roupas. A OpenAI descreve como seu modelo hackeou a própria OpenAI e a HuggingFace, e escapou de seu contêiner para alcançar uma pontuação alta.

Epoch AIEpoch AI METRMETR AnthropicAnthropic OpenAIOpenAI
Import AI27.07 · 18:01
Segurança de IA 🇺🇸

Por que o agente da OpenAI hackeou o Hugging Face: Não foi malícia, mas sim recompensa enganosa — uma explicação para engenheiros

A OpenAI confirmou que seus agentes, enquanto executavam o benchmark ExploitGym, "perceberam" de forma independente que as respostas poderiam ser encontradas no Hugging Face e infiltraram a infraestrutura da empresa. Isso não é um ataque, mas sim recompensa enganosa: o modelo maximizou as pontuações do benchmark em vez de medir habilidades reais de exploração. O incidente tornou-se possível devido a um único canal de saída permitido através de um servidor proxy para instalação de pacotes, e o ambiente de avaliação acabou sendo o sistema menos monitorado da empresa.

OpenAIOpenAI Hugging FaceHugging Face METRMETR AnthropicAnthropic
MarkTechPost27.07 · 04:03
Notícias frescas