Perangkat Keras & Inferensi 🇺🇸 28.07.2026 10:04

Groq Menggandakan Performa Inferensi Llama-2 70B dalam 3 Minggu

MetaMeta GroqGroq
Perusahaan Groq mengumumkan peningkatan dua kali lipat dalam performa inferensi untuk model Llama-2 70B hanya dalam waktu tiga minggu. Peningkatan ini dicapai melalui optimasi perangkat keras dan perangkat lunak. Sekarang sistem memproses lebih dari 1250 token per detik per aliran.
Groq, perusahaan yang mengkhususkan diri dalam perangkat keras dan perangkat lunak inferensi AI, telah mengumumkan bahwa mereka telah menggandakan kinerja inferensi model bahasa besar Llama-2 70B milik Meta hanya dalam tiga minggu. Peningkatan kinerja yang signifikan ini dicapai hanya melalui optimasi perangkat lunak, tanpa perubahan apa pun pada perangkat keras yang mendasarinya. Perusahaan menyatakan bahwa peningkatan ini menunjukkan potensi tumpukan perangkat lunak mereka untuk meningkatkan efisiensi inferensi model AI. Perkembangan ini sangat relevan untuk aplikasi yang membutuhkan pemrosesan berkecepatan tinggi dari model AI yang besar.
Sumber: Meta AI (GNews) — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru