NVIDIA

Laatste AI-nieuws, modellen en releases van NVIDIA. ['A100', 'AI Aerial', 'AI platform', 'Alpamayo', 'B200', 'B300', 'BioNeMo', 'BioNeMo Agent Toolkit', 'Blackwell', 'Blackwell NVL72', 'Blackwell Ultra', 'BlueField-4', 'BlueField-4 DPU', 'BlueField-4 STX', 'Boltz-2', 'Canary-Qwen-2.5B', 'CMX', 'ConnectX-9', 'ConnectX-9 SuperNIC', 'Cosmos', 'Cosmos 3 Edge', 'Cosmos 3 Edge Policy (DROID)', 'Cosmos 3 Nano', 'Cosmos 3 Super', 'Cosmos 3 Super 4-Step Distillation', 'Cosmos-Dreams', 'Cosmos-H Dreams', 'Cosmos-H-Dreams', 'Cosmos-H-Surgical-Simulator', 'Cosmos-Predict2.5-2B', 'Cosmos-Reason2-2B', 'CUDA', 'DeepSeek-R1', 'DeepSeek V4', 'DeepSeek V4 Pro', 'DGX GB300', 'DGX Spark', 'DGX SuperPOD', 'DGX Vera Rubin NVL72', 'DPU BlueField-4']

AMD Instinct MI300: Gedetailleerde Architectuur en Prestatieanalyse

AMD heeft gedetailleerde informatie vrijgegeven over zijn Instinct MI300X- en MI300A-versnellers. De nieuwe producten beschikken over een heterogene architectuur, maken gebruik van geavanceerde CoWoS-verpakking, bevatten tot 153 miljard transistoren en presteren aanzienlijk beter dan de NVIDIA H100 op verschillende gebieden, met name geheugencapaciteit en FP64-prestaties.

NVIDIANVIDIA Taiwan Semiconductor Manufacturing CompanyTaiwan Semiconductor Manufacturing Company
ServerNews27.07 · 18:05
Onderzoek 🇺🇸

Nieuw DeepSeek-V3 Technisch Rapport: Hoe Hardware-Software Co-design Goedkope Training van Grote Modellen Mogelijk Maakt

Een nieuw 14 pagina's tellend technisch rapport van het DeepSeek-V3 team, mede-auteur DeepSeek CEO Wenfeng Liang, is uitgebracht. Het document analyseert de schaalvergrotinguitdagingen van grote taalmodellen en de rol van hardware-infrastructuur, en stelt oplossingen voor op basis van gezamenlijk ontwerp van modellen en hardware voor kosteneffectieve training en inferentie.

DeepSeekDeepSeek NVIDIANVIDIA Alibaba/QwenAlibaba/Qwen MetaMeta
Synced27.07 · 18:04
Vers nieuws