FuriosaAI
FuriosaAI builds powerful and energy-efficient AI accelerators.
FuriosaAI has been building for this moments since 2017. - Two generations of silicon, ready as the inference era begins.
Furiosa RNGD (Renegade) : purpose-built for energy-efficient inference
- 512 TFLOPS (FP8)
- 2xHBM3 48 GB Memory Capacity (1.5 TB/s)
- 256MB SRAM (384 TB/s)
- 180W TDP targeting aired-cooled datacenters
RNGD is in mass production, ramping to 100K+ units in 2026-2027
NXT RNGD Server: 4 PFLOPS and 384 GB HBM3 in only 3kW
- 8x RNGD cards
- 4 PFLOPS total
- 384 GB HBM3 Capacity
- 12 TB/s Memory bandwidth
- 3kW Power consumption
Empfohlene Produkte
RNGD
RNGD ist FuriosaAIs KI-Beschleuniger der zweiten Generation und basiert auf der firmeneigenen Tensor-Contraction-Processor-Architektur (TCP) – einem Design, das Tensor-Kontraktionsoperationen direkt optimiert, anstatt auf klassische Matrixmultiplikation zu setzen. RNGD ist für den Einsatz von LLMs und multimodalen Modellen im großen Maßstab in Unternehmens- und Cloud-Umgebungen konzipiert und erfüllt die anspruchsvollen Durchsatz- und Latenzanforderungen produktiver KI-Dienste.
Ein zentrales Merkmal von RNGD ist seine Effizienz: Der Chip liefert leistungsstarke LLM- und Multimodal-Inferenz bei einer außerordentlich effizienten Leistungsaufnahme von 180 W. Unabhängige Benchmarks zeigen eine 1,8- bis 2-fach höhere Nebenläufigkeit pro Kilowatt im Vergleich zu Nvidias RTX PRO 6000 – bei gleichbleibend interaktiven Antwortzeiten – und ermöglichen so eine deutlich höhere Inferenzkapazität pro Rack für Rechenzentrumsbetreiber.
Ein zentrales Merkmal von RNGD ist seine Effizienz: Der Chip liefert leistungsstarke LLM- und Multimodal-Inferenz bei einer außerordentlich effizienten Leistungsaufnahme von 180 W. Unabhängige Benchmarks zeigen eine 1,8- bis 2-fach höhere Nebenläufigkeit pro Kilowatt im Vergleich zu Nvidias RTX PRO 6000 – bei gleichbleibend interaktiven Antwortzeiten – und ermöglichen so eine deutlich höhere Inferenzkapazität pro Rack für Rechenzentrumsbetreiber.