Nunchaku Lite: Inferencia de modelos de difusión en 4 bits en Diffusers

Nunchaku es un método de cuantización SVDQuant (W4A4) para transformers de difusión. La nueva integración Nunchaku Lite permite cargar puntos de control cuantizados directamente mediante from_pretrained() en Diffusers, sin un motor separado. La velocidad de generación aumenta hasta 1.8 veces, y el consumo máximo de VRAM se reduce hasta un 50%.

Hugging FaceHugging Face BaiduBaidu
Hugging Face blog24.07 · 02:04
Código Abierto 🇨🇳

Alibaba publica como código abierto su pila de IA SAIL: más de 260 marcos listos para usar

La división de desarrollo de chips de Alibaba, Ping Tou Ge, ha anunciado la publicación como código abierto de su plataforma de software de IA propietaria, T-Head SAIL. Esta pila, utilizada en 560 000 chips de la serie Zhenwu, abarca desde controladores hasta herramientas de desarrollo y es compatible con más de 260 marcos populares, incluidos PyTorch y TensorFlow. La solución busca reducir la barrera de entrada para los desarrolladores y acelerar la migración desde CUDA.

Alibaba/QwenAlibaba/Qwen
QbitAI 量子位24.07 · 02:03
Robótica 🇨🇳

WAIC 2026: TARS con AWE 3.5 rompe las "aguas profundas" de la industria: robots trabajadores y simulador físico integrado

La empresa china TARS (它石智航) mostró en WAIC 2026 una nueva versión de su modelo integrado AWE 3.5, el primer modelo integrado que admite el ciclo completo desde el preentrenamiento hasta el postentrenamiento. La demostración incluye numerosas tareas (ensamblaje, empaquetado, clasificación) realizadas por un solo modelo sin cambiar parámetros, así como un simulador físico interactivo para aprendizaje por refuerzo en un entorno virtual.

QbitAI 量子位24.07 · 02:02
Seguridad de IA 🇺🇸

Anthropic lanza la versión beta del plugin de seguridad Claude Security para Claude Code, un escáner de vulnerabilidades multiagente para la terminal

Anthropic ha lanzado una versión beta del plugin de seguridad Claude Security para Claude Code. El plugin ejecuta un escaneo de vulnerabilidades multiagente de un repositorio directamente dentro de una sesión de Claude Code, y luego convierte los hallazgos seleccionados en parches que el usuario puede revisar y aplicar manualmente. El escaneo puede abarcar toda la base de código o los cambios antes de un commit.

AnthropicAnthropic
MarkTechPost24.07 · 01:04
Robótica 🇨🇳

1B Parámetros vs π0: Equipo Chino Encabeza Ranking de Inteligencia Corporal con Modelo Ligero

La empresa china Youibot (优艾智合) con su modelo FabriVLA de 1 mil millones de parámetros ocupó el primer lugar en el ranking global Evo-SOTA de inteligencia corporal, superando a π0. El modelo logró una tasa de éxito del 90% en el benchmark multitarea Meta-World MT50, demostrando que las arquitecturas ligeras pueden competir con las gigantes. La compañía luego presentó el sistema de IA industrial FabriX y el robot humanoide “隙锋” (Xifeng), diseñados para tareas reales en fábricas.

QbitAI 量子位24.07 · 01:03
Código Abierto 🇺🇸

Gigatoken: tokenizador BPE en Rust codifica texto a 24,53 GB/s, hasta 989 veces más rápido que HuggingFace Tokenizers

Marcel Roed, estudiante de doctorado en Stanford, lanzó Gigatoken, un tokenizador BPE en Rust con enlaces a Python, que alcanza velocidades de hasta 24,53 GB/s en un AMD EPYC de 144 núcleos, 989 veces más rápido que HuggingFace Tokenizers y 681 veces más rápido que tiktoken. La aceleración proviene de un pre-tokenizador SWAR escrito a mano y del almacenamiento en caché de pre-tokens.

OpenAIOpenAI Hugging FaceHugging Face Google/DeepMindGoogle/DeepMind MetaMeta Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek Moonshot AIMoonshot AI NVIDIANVIDIA MicrosoftMicrosoft Allen Institute for AIAllen Institute for AI Answer.AIAnswer.AI MistralMistral
MarkTechPost24.07 · 01:03
Investigación 🇨🇳

¿Por qué los robots se quedan en demos? La nueva empresa iFlytek responde: falta de 'autoconciencia'

Yao Fang Intelligence, una nueva empresa fundada por iFlytek, explica que el principal problema de los robots no es la velocidad sino la falta de 'autoconciencia' (本体认知). Proponen su propia arquitectura iFLYTEK-Embodied-Omni, que integra VLM, VGM y AGM para superar las limitaciones de VLA y compensar la escasez de datos reales. La arquitectura ya ha demostrado un alto rendimiento en benchmarks que incluyen LIBERO-Plus y RoboTwin 2.0.

科大讯飞科大讯飞 NVIDIANVIDIA
QbitAI 量子位24.07 · 01:02
Modelos 🇺🇸

Asesor de la Casa Blanca acusa a la china Moonshot de robar el modelo de Anthropic, expertos escépticos

El asesor científico de la Casa Blanca, Michael Kratsios, afirmó que la empresa china Moonshot copió el modelo Fable de Anthropic para crear su modelo Kimi K3, utilizando chips prohibidos para la exportación a China. Sin embargo, los expertos se muestran escépticos ante esta acusación, señalando que la destilación no podría producir resultados tan rápidos y sólidos.

Moonshot AIMoonshot AI AnthropicAnthropic
TechCrunch AI24.07 · 01:02
Noticias frescas