發表文章

目前顯示的是有「Cerebras」標籤的文章

GPT-5.6 Sol Ultrafast評測:Cerebras晶片衝750 tokens/秒 | GPT-5.6 Sol Ultrafast Review: 750 Tokens/Sec via Cerebras

By Kit 小克 | AI Tool Observer | 2026-08-14 🇹🇼 GPT-5.6 Sol Ultrafast評測:Cerebras晶片衝750 tokens/秒 GPT-5.6 Sol Ultrafast是OpenAI在2026年8月13日推出的全新推論加速模式,靠Cerebras的晶圓級晶片把輸出速度衝到每秒750個token,比標準版快最多14倍。這不是又一次「更聰明」的模型升級,而是同一顆模型換了晶片架構跑,速度直接跳了一個量級——這篇文章帶你看懂GPT-5.6 Sol Ultrafast到底做了什麼、值不值得關注。 GPT-5.6 Sol Ultrafast是什麼? GPT-5.6 Sol Ultrafast是OpenAI與晶片公司Cerebras合作推出的API服務層,讓開發者用同一顆GPT-5.6 Sol模型,享受最高750 tokens/秒的輸出速度,目前只開放給受邀企業客戶做限量預覽。 為什麼GPT-5.6 Sol Ultrafast能跑這麼快? 關鍵在Cerebras的 晶圓級引擎(Wafer-Scale Engine) 架構。一般GPU推論的瓶頸在於模型權重要不斷從記憶體搬到運算單元,頻寬跟不上速度。Cerebras的晶片直接把整顆模型權重放進晶片上44GB的SRAM裡,運算單元旁邊就是資料,省掉搬運時間。這正是GPT-5.6 Sol Ultrafast能做到標準模式14倍速度、又不用換模型的原因。 速度快了,準確度會打折嗎? 官方數據顯示沒有。在Humanity's Last Exam這個2500題的高難度基準測試中,GPT-5.6 Sol Ultrafast只花11小時就跑完全部題目,準確度維持不變;在衡量真實知識工作的GDP-Val基準上,端到端速度更是提升5.6倍。換句話說,這次是「同樣的腦子,換了更快的嘴」。 誰該關心GPT-5.6 Sol Ultrafast? 如果你在做 即時語音助理 、 大量文件批次處理 ,或需要agent連續呼叫多輪推論的應用,速度會直接決定使用體驗好不好。不過要注意兩點: 目前 只開放受邀企業客戶 ,一般開發者還排不到 Ultrafast模式 還沒公布獨立定價 ,暫時沿用標準版每百萬token輸入$5、輸出$30的費率 ...