模型 🇺🇸

Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber

Google DeepMind 宣布推出三款新 AI 模型:Gemini 3.6 Flash、3.5 Flash-Lite 以及一款专门的 3.5 Flash Cyber。这些模型旨在提升效率、降低延迟,并改善在智能体工作流中的性能。Gemini 3.6 Flash 使用比前代少 17% 的输出 token,且成本更低。3.5 Flash-Lite 是 3.5 系列中最快的模型,而 3.5 Flash Cyber 专为网络安全设计。

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
Google DeepMind24.07 · 06:03
模型 🇺🇸

自蒸馏推理方法用于微调Amazon Nova模型

亚马逊推出了自蒸馏推理(SDR)方法,用于对Amazon Nova 2模型进行监督微调(SFT)。SDR利用模型自身为缺乏思维链(CoT)推理路径的数据集生成推理路径,从而解决推理抑制问题并减少灾难性遗忘,在提升目标任务性能的同时保持通用能力。

Amazon Web ServicesAmazon Web Services
AWS ML blog24.07 · 05:06
研究 🇺🇸

物理人工智能仿真:综述

在现实世界中收集物理人工智能的数据是一个缓慢、昂贵且有风险的过程。通过 GPU 并行性,仿真能够生成大量逼真的物理数据。本文综述了流行的仿真引擎:MuJoCo、MuJoCo Warp、NVIDIA Isaac Sim 和 Isaac Lab,以及由 NVIDIA、Google DeepMind 和 Disney Research 开发的新型物理引擎 Newton。

NVIDIANVIDIA Google DeepMindGoogle DeepMind MuJoCoMuJoCo
Hugging Face blog24.07 · 05:05
硬件与推理 🇷🇺

MSI推出基于NVIDIA DGX Spark的EdgeXpert MS-C931:紧凑型AI超级计算机详细评测

MSI推出了EdgeXpert MS-C931,这是NVIDIA DGX Spark(项目DIGITS)的紧凑版本,搭载Grace Blackwell GB10 SoC,FP4算力高达1000 TOPS。该设备配备128 GB LPDDR5x、4 TB NVMe SSD、10GbE网络,并可选配200GbE ConnectX-7用于集群。评测涵盖性能测试、功耗及对大语言模型的处理能力。

NVIDIANVIDIA Micro-Star International (MSI)Micro-Star International (MSI) RealtekRealtek MediaTekMediaTek
ServerNews24.07 · 05:05
商业与市场 🇺🇸

纬创在沃斯堡开设首家美国工厂,生产NVIDIA超级芯片

台湾纬创在德克萨斯州启用一座32.4万平方英尺的工厂,生产NVIDIA GB300 Grace Blackwell Ultra和Vera Rubin超级芯片。该项目投资7亿美元,已创造超过500个就业岗位,计划年底前招聘1000名员工。该项目是NVIDIA在美国建设人工智能基础设施承诺的一部分。

NVIDIANVIDIA
NVIDIA blog24.07 · 05:04
模型 🇺🇸

Poolside 发布 Laguna S 2.1:一款开源权重模型,专为智能体编码设计,在 SWE-Bench Multilingual 中以小博大

Poolside 发布了 Laguna S 2.1,这是一款开源权重模型,拥有 118 亿参数,每个 token 活跃参数为 80 亿,专为智能体编码设计。该模型基于混合专家(MoE)架构,支持高达 100 万 token 的上下文,并可在单个 NVIDIA DGX Spark 上运行。Laguna S 2.1 在 Terminal-Bench 2.1(70.2%)和 SWE-Bench Multilingual(78.5%)上,在已知规模的开源模型中排名第一,超越了众多更大的竞争对手。

PoolsidePoolside DeepSeekDeepSeek NVIDIANVIDIA TencentTencent Moonshot AIMoonshot AI Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
MarkTechPost24.07 · 05:04
最新新闻