又一家AI對手出來了!
SubQ 推出了首款 frontier LLM,採用 fully sub-quadratic sparse-attention (SSA) 架構,context window 達 1,200 萬 tokens。
重點數據: •
計算量約為傳統 quadratic Transformer 的 1/1000 • 1M token prefill 比 FlashAttention 快 52 倍 • 成本不到 Claude Opus 的 5%
Benchmark:
• SWE-Bench Verified:81.8%
• RULER
@128K:95%
早期存取與 SubQ Code agent 已開放: