發表文章

目前顯示的是有「TypeSafe AI」標籤的文章

Jev評測:TypeSafe新模型號稱444倍省成本,實測剩8.6倍 | Jev Review: TypeSafe's 444x Cost Claim vs 8.6x Reality

By Kit 小克 | AI Tool Observer | 2026-09-17 🇹🇼 Jev評測:TypeSafe新模型號稱444倍省成本,實測剩8.6倍 Jev 這兩天洗版 Hacker News 首頁,拿下超過 1800 個讚、475 則討論,是這週最熱的 AI 話題。做出 ChatGPT 早期產品的 TypeSafe AI 團隊,在 2026 年 9 月 15 日開放搶先體驗,推出一種全新的「System One Model」——不生成文字,只回傳型別安全的結構化決策。宣稱比前沿 LLM 快 193.6 倍、便宜 444.6 倍,聽起來像神話,實測數字有沒有那麼誇張,看完再決定要不要排隊試用。 什麼是 Jev 與 System One Model? Jev 拿掉了語言模型最核心的「一個字一個字生成文字」機制,改成一次性平行輸出型別化的機率決策,例如分類、路由、打分。輸入是非結構化的狀態,輸出是固定選項(最多支援 255 種)的機率值,官方形容這是「前沿智慧的函式呼叫」。因為輸出不是自由文字而是固定結構,TypeSafe 宣稱型別錯誤「數學上不可能發生」,也不會有一般 LLM 的幻覺問題——但這句話要拆開看:他們量的是「輸出有沒有符合格式」,不是「答案對不對」。 號稱444倍省成本,實測數字掉到多少? 定價是每百萬輸入 token 0.042 美元,輸出 token 直接免費,因為輸出只是型別值而非生成字串。速度號稱 70 到 500 毫秒,官方部落格、首頁、創辦人推文三個地方寫的倍率其實互相打架,從「20-200 倍快、40-400 倍便宜」到「193.6 倍快、444.6 倍便宜」都有。更關鍵的是,官方自己的工作流評測拿「GPT-6 Astra 與 Fable 5.1 的平均答案」當基準,量的是 跟兩個前沿模型答案一不一致 ,不是跟真實答案比對,等於既是選手也是裁判。第三方獨立測試量出來的結果溫和很多:速度約快 5 倍、成本約省 8.6 倍——仍然划算,但離官方宣傳的兩位數倍率有明顯落差。 Jev 對 AI Agent 開發者的實際意義 如果你的 AI Agent 系統裡有大量「分類、路由、打分」這類不需要生成文字的判斷步驟,現在都是丟給昂貴的前沿 LLM 處理,Jev 這類 System One Model...