
Enterprise-ready 3kW inference appliance for agentic systems

RNGD enables 4x more inference capacity
Max. # of servers per rack
5x
2x
Server power consumption
3 kW
7.5 kW
Tokens/s per rack
26,400 tokens/s
6,600 tokens/s
Max. # of users per rack
880
220

Built for what's NXT

Multi-batch LLM generation demo

Start testing with Furiosa Access



See the specs
Blog

White Paper: Benchmarking RNGD on Backend.AI for 1.3–1.5x greater efficiency in enterprise AI inference
.png)
FuriosaAI and Samsung SDS Launch Korea’s First Domestic NPUaaS to Expand Enterprise AI Access
