概要
SubQ は、マイアミ拠点のスタートアップ Subquadratic が 2026 年 5 月 5 日に発表した LLM。独自のアテンション機構 Subquadratic Sparse Attention(SSA) によって 1200 万トークンのコンテキスト長、FlashAttention 比 52 倍高速、推論コスト $8(従来 $2,600)を主張している。
- CEO: Justin Dangel(5 回連続起業家)
- CTO: Alexander Whedon(元 Meta、元 TribeAI 生成 AI 部門長)
主張するスペック
- コンテキスト長 1,200 万トークン
- 競合比 1,000 倍のコンピュート削減
- 推論コスト 1/5 以下
- Claude Opus 4.7 超えのベンチマーク結果
懐疑論
- 技術レポートが現時点で未公開
- 独立検証も存在しない
- スペック値がいずれも従来 LLM とのスケール差が極端に大きく、再現性確認待ち
- 「Claude Opus 超え」というキャッチコピーには、ベンチマーク選定バイアスの可能性
関連ページ
- Subquadratic Sparse Attention (SSA) — SubQ が採用する新アテンション機構
- Context Compression — 別アプローチでのコンテキスト圧縮