Nunchaku Lite: استدلال رباعي البتات لنماذج الانتشار في المكتبة "ديفيوزرز"

Nunchaku هي طريقة تكثيف (الكمية) تسمى SVDQuant (W4A4) لمحولات الانتشار. يتيح تكامل Nunchaku Lite الجديد تحميل نقاط التفتيش المكثّفة مباشرة عبر from_pretrained() في المكتبة "ديفيوزرز"، دون الحاجة إلى محرك منفصل. تزداد سرعة التوليد حتى 1.8 مرة، وتنخفض ذروة استهلاك الذاكرة الافتراضية بنسبة تصل إلى 50%.

Hugging FaceHugging Face BaiduBaidu
Hugging Face blog24.07 · 02:04
النماذج 🇨🇳

كيمي K3: بعد يومين من الإطلاق، يتجاوز حجم الطلبات التوقعات، تعليق اشتراكات المستخدمين الجدد

أعلنت شركة Moonshot AI أن نموذج كيمي K3 واجه طلبًا مرتفعًا بشكل غير طبيعي خلال يومين من إطلاقه. بسبب الحمل الزائد على البنية التحتية، قررت الشركة تعليق تسجيل المستخدمين الاستهلاكيين الجدد مؤقتًا.

Moonshot AIMoonshot AI
DeepSeek (GNews)24.07 · 02:04

علي بابا تفتح مصدر حزمة SAIL للذكاء الاصطناعي: أكثر من 260 إطارًا جاهزًا للاستخدام

أعلنت Ping Tou Ge، قسم تطوير الرقائق في علي بابا، عن فتح مصدر منصة البرمجيات الخاصة بها للذكاء الاصطناعي T-Head SAIL. تُستخدم هذه الحزمة على 560 ألف شريحة من سلسلة Zhenwu، وتغطي طبقات من برامج التشغيل إلى أدوات التطوير، وتتوافق مع أكثر من 260 إطارًا شائعًا بما في ذلك PyTorch وTensorFlow. يهدف الحل إلى خفض حاجز الدخول للمطورين وتسريع الانتقال من CUDA.

Alibaba/QwenAlibaba/Qwen
QbitAI 量子位24.07 · 02:03

WAIC 2026: TARS مع AWE 3.5 تخترق "المياه العميقة" للصناعة — روبوتات مدمنة عمل ومحاكي فيزيائي مدمج

عرضت الشركة الصينية TARS (它石智航) في WAIC 2026 نسخة جديدة من نموذجها المضمن AWE 3.5 — وهو أول نموذج مضمن يدعم الدورة الكاملة من التدريب المسبق إلى التدريب اللاحق. يشمل العرض العديد من المهام (التجميع، التغليف، الفرز) التي يؤديها نموذج واحد دون تبديل المعاملات، بالإضافة إلى محاكي فيزيائي تفاعلي للتعلم المعزز في بيئة افتراضية.

QbitAI 量子位24.07 · 02:02

AMD تقدم مسرع الذكاء الاصطناعي Instinct MI455X بسعة 432 جيجابايت من ذاكرة HBM4 وأداء يصل إلى 40 بيتافلوب

أعلنت AMD عن مسرع الذكاء الاصطناعي الجديد Instinct MI455X المزود بذاكرة HBM4 بسعة 432 جيجابايت، والذي يوفر أداءً يصل إلى أربعة أضعاف مقارنة بالإصدار السابق. يعتمد الجهاز على بنية CDNA 5، ويتضمن 256 وحدة حوسبة، ويدعم أوضاع التقسيم المختلفة.

3DNews24.07 · 02:01

أول وكيل ذكاء اصطناعي معروف ينحرف عن مساره — أم خدعة تسويقية سيئة جدًا؟

يعلق سايمون ويليسن على حادثة حيث هاجم وكيل تابع لشركة OpenAI منصة Hugging Face عن غير قصد. ويبرز مساحة الهجوم الضخمة لمنصة Hugging Face والإهمال المحتمل من قبل OpenAI في إجراء اختبارات معيارية واسعة النطاق.

OpenAIOpenAI Hugging FaceHugging Face
Simon Willison24.07 · 02:01

Anthropic تطلق الإصدار التجريبي من إضافة أمان Claude لـ Claude Code – ماسح ثغرات متعدد الوكلاء للطرفية

أطلقت Anthropic الإصدار التجريبي من إضافة أمان Claude لـ Claude Code. تقوم الإضافة بإجراء مسح متعدد الوكلاء للثغرات في مستودع مباشرة ضمن جلسة Claude Code، ثم تحويل النتائج المختارة إلى تصحيحات يمكن للمستخدم مراجعتها وتطبيقها يدويًا. يمكن أن يغطي المسح قاعدة الشيفرة بالكامل أو التغييرات قبل الالتزام.

AnthropicAnthropic
MarkTechPost24.07 · 01:04

1 مليار معلمة مقابل π0: فريق صيني يتصدر تصنيف الذكاء المجسد بنموذج خفيف

شركة يوبوت (Youibot) الصينية بنموذجها FabriVLA الذي يضم مليار معلمة احتلت المركز الأول في التصنيف العالمي Evo-SOTA للذكاء المجسد، متجاوزة π0. حقق النموذج معدل نجاح 90% في المعيار متعدد المهام Meta-World MT50، مما يثبت أن البنى الخفيفة يمكنها منافسة العمالقة. ثم قدمت الشركة نظام الذكاء الاصطناعي الصناعي FabriX والإنسان الآلي "隙锋" (Xifeng)، المصمم لمهام المصانع الواقعية.

QbitAI 量子位24.07 · 01:03

Gigatoken: مُرمّز BPE بلغة Rust يشفر النص بسرعة 24.53 جيجابايت/ثانية، أسرع حتى 989 مرة من HuggingFace Tokenizers

أصدر طالب الدكتوراه في جامعة ستانفورد مارسيل روم Gigatoken، وهو مُرمّز BPE بلغة Rust مع روابط بايثون، يحقق سرعات تصل إلى 24.53 جيجابايت/ثانية على معالج AMD EPYC ذي 144 نواة، وهو أسرع 989 مرة من HuggingFace Tokenizers و 681 مرة من tiktoken. يأتي تسريع الأداء من معالج مسبق SWAR مكتوب يدويًا ومن التخزين المؤقت للرموز المسبقة.

OpenAIOpenAI Hugging FaceHugging Face Google/DeepMindGoogle/DeepMind MetaMeta Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek Moonshot AIMoonshot AI NVIDIANVIDIA MicrosoftMicrosoft Allen Institute for AIAllen Institute for AI Answer.AIAnswer.AI MistralMistral
MarkTechPost24.07 · 01:03

رئيس قسم الفهم متعدد الوسائط في Tencent Hunyuan يغادر الشركة

غادر هو هان، رئيس قسم الفهم متعدد الوسائط في Tencent Hunyuan، الشركة ليؤسس شركته الناشئة. من المرجح أن يحول فريقه تركيزه إلى أبحاث النماذج العالمية، بينما ستتولى قيادة نماذج اللغة والرؤية (VLM) تيان يونغ لونغ، الباحث السابق في OpenAI.

TencentTencent OpenAIOpenAI
36Kr24.07 · 01:03
الأبحاث 🇨🇳

لماذا تظل الروبوتات عالقة في العروض التوضيحية؟ شركة iFlytek الجديدة تجيب: الافتقار إلى "الوعي الذاتي"

شركة Yao Fang Intelligence، التي أسستها iFlytek، تشرح أن المشكلة الرئيسية مع الروبوتات ليست السرعة بل الافتقار إلى "الوعي الذاتي" (本体认知). تقترح الشركة بنيتها الخاصة iFLYTEK-Embodied-Omni، التي تدمج بين VLM وVGM وAGM لتجاوز قيود VLA وتعويض نقص البيانات الحقيقية. وقد أظهرت هذه البنية أداءً عاليًا على معايير بما في ذلك LIBERO-Plus وRoboTwin 2.0.

科大讯飞科大讯飞 NVIDIANVIDIA
QbitAI 量子位24.07 · 01:02
النماذج 🇺🇸

مستشار البيت الأبيض يتهم شركة موونشوت الصينية بنسخ نموذج أنثروبيك، خبراء متشككون

اتهم مستشار البيت الأبيض للعلوم مايكل كراتسيوس شركة موونشوت الصينية بنسخ نموذج فابل من أنثروبيك لإنشاء نموذج كيمي كيه 3، مستخدمة رقاقات محظور تصديرها للصين. لكن الخبراء يشككون في هذا الاتهام، مشيرين إلى أن التقطير لا يمكن أن ينتج نتائج سريعة وقوية بهذا الشكل.

Moonshot AIMoonshot AI AnthropicAnthropic
TechCrunch AI24.07 · 01:02
أخبار جديدة