中國開源AI模型月の暗面K3站上榜首
Anthropic這招玩不下去了
時常有新聞風向故弄玄虛
說什麼Mythos太強會自己思考
只能用一再出一個更安全的Fable 5
然後後來Fable 5又強到不能上架
或是Anthropic又出新聞說
自己發現在Claude系列模型有內部工作區
類似人腦意識思維
Anthropic把Fable吹上天
網路上也有不少Fable粉
後來沒多久《GPT-5.6 Sol》上市
Fable就GG了,
隨後的《Kimi K3》
又讓Fable神話再度破滅
Fable貴,而且有時會偷降智到Opus 4.8
美國人自己都做辛普森動畫酸Fable
不少人改用Kimi、GPT

阿里的千問3.8最近也出預覽板了
當初一堆人說阿里不可能開源(開放權重)
他們也有計劃要開放權重了
▼阿里千問Qwen。17小時前的發文


(但Qwen3.8 Preview我還沒玩過
先不評論,最近都在玩Kimi K3)
Deepseek V4正式板(GA)(General Availability)
這幾天會出,有可能是今天
(多方消息說最快7月20日)
我最近也已經在OpenCode上
玩過Deepseek V4 API的灰度測試
(灰度測試Graysacle Testing
也叫金絲雀測試Canary Testing
是軟體在正式向全民發佈前
篩選一些用戶,對他們先發放新功能
灰度測試的核心概念是
"由灰到黑",從一小部分用戶開始,
逐步擴大範圍到大眾)
最快今天Deepseek V4會出正式版
我自己的看法
之後中美4巨頭就是
Kimi、Deepseek、Qwen千問、GPT
(Fable不列入討論,就如我開頭說的
Anthropic愛故弄玄虛
而且Fable還會用戶玩到一半下架
這家我看可能玩不了幾年了,
在美國會被GPT(OpenAI)取代
)
這裡面的Deepseek,我也相當看好
因為Deepseek每次都能改變生態
(別忘了它是美國政府認證的強
因為美國政府禁用Deepseek
可說是白宮掛保證的)
2年後
可能我們看到的全球4巨頭,會是這樣:
3個大陸的(Qwen、Kimi、Deepseek)
加上一個美國OpenAI的GPT
(因為全球市場不只美國
其他國家不太會因為中美競爭,或政治因素
就不去使用大陸的模型)
所以全球範圍來看
幾年後的4巨頭
還真的可能是3大陸、1美國
來自權威機構ArenaAI的測試,中國最新開放權重模型K3,
在前端開發表現上超越Fable5站上榜首位置
震撼全球AI開發者
https://x.com/arena/status/2077824029126504525
來自西班牙的測試結果
https://x.com/nicos_ai/status/2077841576760381…
→ Fable 5:45,800 個token,$0.42
→ Kimi K3:38,200 個token,$0.05
K3的結果更好、更快,而且花了我8倍更少的費用
來自美國的測試
https://x.com/bhavani_00007/status/20777981667…
差距大到令人難以置信。
Kimi K3 建構了一個完整的場景,包含紋理、適當的燈光、彈藥箱、武器架,到處都有精細的細節。Opus 4.8 給了我一個幾乎空蕩蕩的房間,只有幾張漂浮的桌子。
毫無疑問,它完勝 Opus 4.8。Kimi K3 達到 Fable 5 等級,而且在 3D 和遊戲方面明顯優於 GPT-5.6 Sol。
一個開放權重模型竟然匹敵市面上最好的封閉模型。好好消化一下這點。
prompt
A realistic military armory with rifles, pistols, sniper rifles, grenades, bul le tproof vests, ammo crates, weapon racks, animated monitors, and dynamic lighti ng. build this in 3.js
--