Kimi K3實測,讓我不敢相信這是國產模型

向陽喬木推薦看
向陽喬木推薦看2026年7月18日

一直用 Codex 和 Claude Code,測了 Kimi K3 後,竟有超預期驚喜,真的是強!

剛用時,不瞭解情況,只敢給一些簡單任務,後面越用越牛逼。

後面直接給了 Kimi K3 服務器權限,一口氣開發了 6 個完整項目,全部上線、免費開源。

項目覆蓋前端、後端構架/數據庫開發、AI 模型調用,本地已有項目優化迭代。

全都是一輪對話搞定 MVP,2-5 輪對話完成打磨、發佈上線。

毫不誇張,Kimi K3 是國產模型巨大飛躍,能力直逼 Fable 5。

讓大家有底氣,再也不怕 A➗ 封號。

現在唯一擔心,Kimi 是否備足了 GPU ,預計馬上會有海量國內外用戶湧入。

下面,喬幫主會先展示、後拆解,全部提示詞、Skill、源碼都會開源給大家,建議先收藏再看。

開發項目演示(部分)

今晚看啥: 自然語言對話找片的網站,基於開源OMDB數據庫,實時AI檢索推薦,在線跳流媒體平臺看片。

https://imdb.qiaomu.ai/

X-follow :調用第三方 xAPI,跟蹤推特 KOL 最新信息,中文對照翻譯,一個人免打擾刷推。

https://x.qiaomu.ai/

Mastermind :給女兒做的益智 3D 遊戲,復刻自 Switch ,增加得分排行榜,高難模式。

https://mastermind.qiaomu.ai/


arXiv 論文搜索下載 :每日精選 AI 論文,一鍵下載 PDF 與在線閱讀,支持 AI 解讀,自然語言對話找論文。

https://arxiv.qiaomu.ai/

初中數學公式可視化學習: 給兒子開發的數學公式學習工具,秒懂勾股定理。

https://math.qiaomu.ai/

喬木提詞器 iOS App 優化 :找出 App 性能和交互問題,重新編譯優化。

喬木 Gif 壓縮 Skill :把任意錄屏 Gif 壓縮到能插入公衆號文章的幀率、尺寸大小。

安裝指令:npx skills add joeseesun/qiaomu-tiny-gif

項目解讀

IMDB 電影 AI 搜索

一般視頻網站都只支持電影名搜索,不知道名稱就不好找片子。

我想能不能用 AI 幫推薦電影,實時檢索 IMDB 庫展示,最好還能在線看。

網上找到一個免費 IMDB 數據庫叫 OMDB ,能免費申請 API,也可每月贊助 1 美元,獲得每天 1w 次調用。

http://www.omdbapi.com/

把 API key和文檔發給 Kimi K3,要求調喬木 AI PRD Skill 和 LLM Skill、網站部署Skill,寫產品方案並開發上線。

執行中激活了所有要求的 Skill,思考 58 次,調用了 82 次工具。

先搭後端 sqlite 數據庫,後寫前端頁面,甚至設計了 favicon 和 OG圖,讓網站看起來更正式、專業。

AI 全自動測試,很像一個人在喃喃自語,比如:“首頁感覺對了。看結果頁和詳情彈窗”。

測試通過後上線,調用了 Vercel cli 部署, Cloudflare 解析綁定了域名。

全過程我沒有做任何干預,一個完整網站就開發上線了。

後續還有兩輪對話,我僅補了詳情頁觀影地址和100個輪播提示,一次性全搞定。

最後,大家注意看頁面頂部背景,竟然是用 OMDB 返回的電影海報封面拼接做的背景,前端審美果然是 Kimi 傳統強項。

iOS App 喬木提詞器

Kimi K3 開發前後端優秀,爲了更全面測試,我直接把之前寫的iOS應用Github倉庫給它,讓它找優化空間。

之前 Swift 代碼用 GPT 5.5 開發,它覺得代碼質量中上。

但依然找到 5 個高危漏洞,4個性能問題、2個構架問題和不少 UX 問題。

可能它預感工作量大,直接啓動了 5 個 Subagent 修復,任務拆分合理,互不干擾。

很快修改完成,編譯通過,喚起 iOS 模擬器讓我體驗。

Switch 3D 遊戲復刻

女兒特別喜歡 Switch 上的《世界遊戲大全51》中的猜顏色遊戲。

每次選四個顏色,通過反饋信息(顏色和位置是否正確),用最短輪次,給出正確的顏色和順序排列。

好像也有實體遊戲機賣,大概 150 左右,如圖:

原來這個遊戲叫 mastermind,谷歌搜了下,也有網頁版,排名第一的產品如下:

爲了視覺效果和可玩性,直接上 3D 版,順便測模型的 Threejs 建模能力。

流程類似不贅述,只需知道遊戲叫 Mastermind,要求用Three.js開發, 讓 AI 生成 PRD 後開發。

第一版生成後就能玩,甚至還帶音效,但界面需優化。

比如盒子放右側更直觀,要能支持拖拽排序,顯示小球的移動軌跡等。

爲增加競爭性,要求改成雲端數據庫,記錄每個玩家的最好成績做排行榜,成品如下:

Gif 壓縮 Skill

個人覺得 Gif 是比視頻更容易展示的格式,在公衆號中,視頻需要點擊才能播放。

但公衆號有一個限制,Gif 最大爲 10M,不能超過 300 幀,幀率要控制在 12 - 20 fps。

本文很多演示 Gif 都超過限制,讓 Kimi K3 幫寫一個 Gif 壓縮 Skill。

10分鐘就開發完成,Skill 質量不錯,能自動剪掉過長靜態幀,在保證畫質前提下,降低文件大小。

大家看到的本文 Gif 演示,都用這個 Skill 處理過。

指令安裝地址:

npx skills add joeseesun/qiaomu-tiny-gif

Grok Build 82 萬行代碼 分析

最近馬斯克開源了 Grok Build,大概 82 萬行 Rust 代碼。

我同時發給 Kimi K3 和 GPT 5.6 sol Ultra 做全量代碼分析、挖掘,最後生成飛書文檔對比。

K3 竟然把 XOR 混淆的 System Prompt 解密了!文檔信息密度極高,挖掘出不少有趣的工程設計。

GPT 5.6 sol 同樣完成了任務,粗看標題很厲害,語言更流暢,但仔細讀發現內容有點空洞,大家可以對比下。

Kimi K3生成的飛書文檔

https://xiangyangqiaomu.feishu.cn/docx/OAoYdiZ1eoc2HTxmmZ3clWIPnLf

GPT 5.6 sol Ultra生成的文檔

https://xiangyangqiaomu.feishu.cn/docx/WvgKdcEJxo9nJqxExLwcUUiKnPb

更多項目

AR 3D 眼睛試戴 :提示詞相當簡單,竟然支持webcam攝像頭,人臉識別等。

Build a 3D sunglasses customizer with drag-orbit, PBR material live previews (metal、acetate frames, polarized、mirrored lenses),animated temple-arm fold/unfold, real-time lens tint & reflection adjustment, hinge hover-glow, and a webcam-AR "try on your face" mode with face tracking.

在線體驗:

https://glass.qiaomu.ai/

論文搜索下載學習 :arXiv 是最流行的論文預印本發佈網站,新 AI 論文一般都會發布到這裏,是個學習寶藏。

網站全英文,搜索查找不方便,所以想開發一箇中文簡化版。

開發這個項目時,已經凌晨1點,給了下面一段提示詞:

參考 imdb.qiaomu.ai 的代碼,開發一個更好用的arxiv網站,列出一些值得看的論文或主題,也可以搜索優質論文,可以一鍵下載pdf或在線看論文,調用喬木llm中的Deepseek flash v4做AI解讀和推薦引擎,網站域名叫 arxiv.qiaomu.ai 用喬木設計skill開發(你選最合適的風格,不要問我),代碼開源到github,arXiv的api參考:https://info.arxiv.org/help/api/basics.html#using

第二天醒來,網站開發好了,Github 也上傳了,感覺 Kimi K3 長程任務開發也超穩。

順手補了 2013-2015 年的 50 篇經典 AI 論文,增加了“搜索下載”模塊。

UI學習網站: 學習前端開發組件名和網頁風格,讓你的 Vibe Coding 更專業。

一句話讓 Kimi K3 生成 40 多種網頁組件風格,如新擬態、蘋果液態玻璃、極簡主義等,每個組件都是獨立的HTML + CSS,包在一個網頁展示非常直觀。

https://learnui.qiaomu.ai/styles/

模型侷限

Kimi 官方公告坦誠說了模型的一些問題,再綜合一點我的感受和發現:


如果是 API 調用,模型溫度 Temperture 參數默認爲 1,不能修改。
因訓練方式原因,與官方的 Kimi Code 匹配更好,如接入 Claude Code,效果可能會有折損。
K3 模型優化了長程、高難任務,主動性很強;遇到簡單、模糊需求,反而會過度思考和發揮,如並非你想要的,需在系統提示詞或AGENTS.md 中做約束。
K3 在交互、界面、視覺、空間等相關場景完全可以作爲首選模型,但架構、後端等場景,仍落後於最強閉源模型 Claude Fable 5 和 GPT-5.6,感興趣可以看官方 Benchmark。

更多官方評測圖表:

https://mp.weixin.qq.com/s/V4xhEIy8xDXSMDPrPkmUAQ

總結

寫到這兒,其實我自己都有點不敢相信。

Kimi K3 這個模型給我的體驗,竟然比 GPT 5.5 和 Claude Opus 4.8 還好。

雖然跟最頂級的 Fable、GPT 5.6 sol Ultra還有一點點差距,但體驗已經非常接近,非常不可思議。

從前後端開發、數據庫、AI 調用,到 iOS 優化、3D 建模、Skill 編寫,沒有任何一項拉胯。

怪不得 Kimi 會把版本號直接從 2.7 直接升到 3.0,看來團隊也相當有信心。

「不怕封號、放心用國產」這件事,真的開始成立了。

國產自研模型,Sonnet 級價格、Opus 級體驗!我怕真的買不到會員了


按慣例,本文提到的全部項目、提示詞、Skill 和源碼,我都會開源出來。

鏈接會整理在評論區,歡迎自取、歡迎折騰。

如果這篇文章對你有幫助,點個「在看」、轉發給需要的朋友,就是對喬幫主最大的支持,我們下次見。



Kimi K3實測,讓我不敢相信這是國產模型 - 今日精華