Fastest · 처리량
공급 네트워크가 관측한 p50 출력 처리량 정렬입니다. API가 tok/s 수치를 제공하지 않으며 미측정 모델은 뒤에 배치됩니다.
- 1Relace: Relace Apply 3relace/relace-apply-3#1
- 2Morph: Morph V3 Fastmorph/morph-v3-fast#2
- 3OpenAI: gpt-oss-safeguard-20bopenai/gpt-oss-safeguard-20b#3
- 4SpaceXAI: Grok 4.20 Multi-Agentx-ai/grok-4.20-multi-agent#4
- 5NVIDIA: Nemotron 3.5 Lightningnvidia/nemotron-3.5-lightning#5
- 6Qwen: Qwen3 Next 80B A3B Thinkingqwen/qwen3-next-80b-a3b-thinking#6
- 7Meta: Llama 3.1 8B Instructmeta-llama/llama-3.1-8b-instruct#7
- 8Meta: Muse Spark 1.1meta/muse-spark-1.1#8