OpenAI

Últimas noticias, modelos y lanzamientos de IA de OpenAI. ['Atlas', 'ChatGPT', 'ChatGPT Enterprise', 'ChatGPT-Live', 'ChatGPT-User', 'ChatGPT Work', 'Claude Fable 5', 'CLIP', 'Codex', 'Codex CLI', 'Codex Micro', 'DALL-E', 'DALL-E 2', 'DALL-E 3', 'GPT', 'GPT-2', 'GPT2', 'GPT-3', 'GPT 3.5', 'GPT-3.5', 'gpt-3.5-turbo', 'GPT-3.5-turbo', 'GPT-3.5 Turbo', 'GPT-3-XL', 'GPT-4', 'gpt-4.1', 'GPT-4.1', 'gpt-4.1-mini', 'GPT-4 (ChatGPT)', 'gpt-4o', 'GPT-4o', 'GPT-4o mini', 'GPT-4 Turbo', 'GPT-4V(ision)', 'GPT-5', 'gpt-5.1', 'GPT-5.1', 'GPT 5.2', 'GPT-5.2', 'GPT-5.2-codex']

Modelos 🇷🇺

Cómo funciona Kimi K3: 2,8 billones de parámetros, atención lineal y agentes de un millón de tokens

Moonshot AI ha publicado los pesos de su modelo Kimi K3, un modelo multimodal basado en una arquitectura de mezcla de expertos con 2,8 billones de parámetros, de los cuales 104 mil millones se activan por token. En ciertos benchmarks de programación y uso de herramientas, el modelo supera a sus competidores, pero en promedio va por detrás de algunos de ellos.

Moonshot AIMoonshot AI AnthropicAnthropic OpenAIOpenAI
Habr — хаб ИИ27.07 · 23:03
Seguridad de IA 🇺🇸

AI Import 461: 'Alignment Not on Right Track'; FrontierCode; and Synthetic Science Interns

Investigadores del UK AISI y de Timaeus fundaron la organización sin fines de lucro Sequent para desarrollar métodos de alineación que garanticen la seguridad de sistemas superinteligentes. Cognition publicó el benchmark FrontierCode para evaluar la calidad del código, donde el mejor modelo, Claude Opus 4.8, obtuvo solo un 13,4% en el nivel más difícil. También se presentan el conjunto de datos ChinaHeritaQA para evaluar el conocimiento cultural de los VLM sobre sitios chinos de la UNESCO y el modelo Xiaomi MiMo-V2.5-Pro-UltraSpeed con una velocidad de generación de 1000 tokens por segundo.

CognitionCognition Alibaba/QwenAlibaba/Qwen AnthropicAnthropic OpenAIOpenAI
Import AI27.07 · 21:04
Noticias frescas