BEFORE速さは、小さいモデルの仕事だった
- すぐ返事が要るなら、Luna や Flash に落とす
- 最上位は「一晩回して朝見る」側にいた
- 速さのために知能を落とす、が普通だった
GPT-5.6 SOL · ULTRAFAST
OpenAI が Ultrafast を、API の新しい速さの段階として限定プレビューした。 Cerebras 上で動く GPT-5.6 Sol は、最大 14倍、出力は秒間 750トークン。 公式は「品質は Standard と同じ」と書く。小さいモデルに落とさず、最上位を会話の速さで使えるようにした。
TAKEAWAY
GPT-5.6 Sol Ultrafast:同じ知能のまま、最大14倍速。速さのために知能を捨てなくてよい。
本番は様子見。待ち時間が致命の1本だけ。
Day Slide No.380 · 2026-08-15 · AI Intelligence Hub