Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型

2025年07月24日18:52:08 科技 1461


新知答主@劉聰NLP

點擊文末「閱讀原文」查看完整內容、交流

測試是從簡單到複雜,從單一的靜態頁面,到最後實現一個小工具。先說我的總體感受,強,很強,審美變好了,項目代碼的完成度很高,跟 1T 參數的 K2 不相上下,有的一拼,但部署成本少了一半。

第一個「生成一個打工人時鐘的 html 頁面」,這裡主要看單一 HTML 生成效果是否美觀。這個配色就很 Qwen,基本信息都包含,「不過有些人在休息,有些人還在寫測試文章」,哈哈哈!

Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

第二個「根據給定的內容生成 PPT」我用的是前兩天的《Agent 時代上下文工程的 6 大技巧》。

內容顯示是完整的,PPT 頁數切換很炫酷,閃瞎了我的狗眼,就是內容呈現相較於換頁就顯得有點樸素了~但是整體我還是滿意的。

Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

第三個,上點難度,「創建一個紅白機風格的貪吃蛇遊戲」。

這個很棒,我是玩了半天,不過我覺得現在生成貪吃蛇遊戲對於大多數大模型來說都是小 case 了。現在想想一年前的大模型 code 能力,再想想現在大模型 code 能力,只感嘆大模型現在進步真的挺快了,尤其是開源大模型追閉源大模型,也很快了。

Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

第四個,生成可愛風格的五子棋遊戲。

可愛風格五子棋遊戲界面,畫面有兩個模式按鈕「人人對戰」和「人機對戰」,界面整體採用馬卡龍色調,棋盤簡潔清晰,棋子設計成卡通小動物(如貓咪和小熊),背景帶有輕微漸變和星星點綴,界面邊緣圓潤,按鈕 Q 萌,整體風格溫馨可愛,適合兒童或休閑玩家使用,2D 插畫風。

Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞


純一次生成的看著還可以,像那麼一回事兒,但是你人機對戰,是不是有點呆了呀。

於是我直接將 Qwen-Coder 配到了Cline里,看看在 Agent 下效果如何,同時也能考察 Qwen-Coder 的 Agent 能力。實話實說,真實好了不少,我覺得Qwen-Coder 這波的審美也是在線的,不過可能是因為前面一個太呆了,導致我大意了,竟然沒下贏。


第五個,再次升級,「生成一個 AI 圍棋對戰遊戲」。

這個是參考好友@洛小山,前兩天測試 k2 的例子。這是一個 AI 圍棋對戰遊戲項目,使用 FastAPI後端轉發AI消息,前端採用 Tailwind CSS + JavaScript 實現。

核心功能包括:支持用戶與傳統演算法 AI 或大模型 AI(OpenRouter、Qwen、Kimi)對局,提供多種遊戲模式(人人、AI 對戰、觀戰),實現完整的中國圍棋規則(氣的計算、提子、死活判定、佔領面積計算、數子計分),要有棋盤視覺提示、悔棋系統等功能。

Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞


我覺得生成內容還是很好的,前後端都生成了,不過我不懂圍棋,我感覺它在瞎下,但是我真不懂,哈哈哈!不過整體框架啥的弄得都挺好的,效果真不錯,Qwen 這波開源救我老命了。


第六個「生成一個通過點擊立方體的各個面,逐漸展開為完整平面的交互動畫」。

這是好友@卡爾 測試 K2 的例子,Claude4 是跑不出來的,Kimi K2 生成也是有 bug,但動畫本身都很流暢。


Qwen這個說實話,面沒對上,沒有那麼好,不過我後面又加上一句「展開需要符合客觀事實」,然後面能對上,但是展開的順序還是有點問題。這個確實有點難了。


第七個「生成一個小工具,直接將公眾號文章鏈接轉成 md,方便複製」。功能完全實現了,並且在前面預覽的也很好,格式、圖片也都搞下來了,支持一鍵複製。


所以,vibe coding 盛行的時代,想快速實現一個小的工具,真的太方便了,你只要能描述清楚你的需求即可,即使你描述不清楚,你也可以讓大模型幫你潤色,現在真是太方便了。


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

這次 Qwen-Coder 的實測表現真的是效果炸裂,尤其是在審美、代碼完整度、工具調用等方面,用起來真爽。

重點是依舊開源!現在的開源大模型的代碼能力,也正在從「能寫點代碼」進化為了「寫得又快又好、還能直接使用」。

最後想說,開源界最早是 Qwen 打下基礎,後來DeepSeek 爆火,加之 Kimi、Minimax 等都加入,中國開源大模型不斷更新,真幸福!中國開源模型就是遙遙領先,不接受任何反對!


答主@卜寒兮

點擊文末「閱讀原文」查看完整內容、交流

- 代碼能力小測

我簡單測試了下模擬物理場景的代碼能力。首先是一個生成可交互的動畫效果的任務,完成起來完全沒有壓力。


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

然後是生成一個 3D 迷宮遊戲,從場景搭建、迷宮生成、角色控制到動畫和碰撞檢測。

重點在於使用 Three.js 和其相關的載入器和控制器,並強調了版本兼容性(r128)、程序化紋理生成、動畫混合、以及角色朝向的精確計算。是一個比較複雜的項目,需要對 Three.js 有較好的理解。

效果大概是這樣,完成的也不錯:

Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

作為對比,這是 Claude 生成的效果:


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

- Agent 能力

這次發布,除了 Qwen3-coder 模型本體,Qwen 還推出了 Qwen Code 智能體,本質上是一個命令行工具, 基於 gemini Code 開發的,通過 Qwen Code 可以更好發揮 Qwen3-coder 模型的 Agentic 和工具使用的能力。

使用 Qwen Code,首先保證安裝了 Node.js 環境,如果還沒安裝,可以執行: curl -qL https://www.npmjs.com/install.sh | sh

然後通過 npm 全局安裝 Qwen code: npm install -g @qwen-code/qwen-code

然後在終端運行 qwen 指令就進入 Qwen Code 環境了,不過在使用之前,還需要授權一下 API key,Qwen Code 支持 OpenAI SDK 調用 LLM,在配置頁面選擇 OpenAI


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

填入你的阿里雲百鍊平台的 API Key,把 API 的Base url 也替換為阿里雲百鍊平台的,然後模型填入 qwen3-coder-plus,確認就完成授權了。


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

現在就可以跟 Qwen code 進行對話了,Qwen code 在 Gemini CLI 的基礎上開發而來,包括很很多基礎工具調用能力,比如基礎的文件讀寫、命令行工具等等。


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

1、測試了一下 Qwen Code 對於代碼項目的理解能力,直接讓他生成 GitHub 上 Qwen Code 的項目結構:


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

可以看到它對整個項目的架構和功能模塊理解得很全面。繼續讓它生成一份 wiki 資料,然後它直接給出一個完整的 wiki 文檔:


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

Qwen Code 推出給了可以給國內很多不方便使用 Gemini CLI、Claude Code 等工具的人一個選擇,也能很輕鬆用上 Agentic 命令行工具,開展更多的自動化開發工作。個人感覺這個工具的重要性不亞於 Qwen3 Coder 模型本身。你可以用它搜索代碼庫,協助代碼開發,自動化工作流,或者進行代碼的重構和優化等等。不過由於時間有限,還沒來得及做更多的能力測試,後面我會繼續使用 Qwen Code,有了新的體驗和發現,也會及時更新在這裡。

另外,讓我比較欣賞的一點是一直以來 Qwen 對社區三方工具的兼容性和適配性做的都很好,而且能感覺到是在積極主動的做這件事。

這次的 Qwen3-Coder 也是一樣,除了在 Gemini CLI 基礎上開發的 Qwen Code 命令行工具,現在還可以將 Qwen3-Coder 和 Claude Code、Cline 等工具搭配起來使用,儘可能發揮它的 Agentic 能力。

總的來說,個人認為 Qwen3-Coder 並非一次簡單的模型迭代,我更願意稱它是一次系統性的工程實踐,為下一代代碼大模型的發展搭建了更高的階梯。一個能夠自主發現問題、解決問題、並從解決過程中學習和提升的 Code Agent,或許已經離我們不遠了。Qwen3-Coder,正是朝著這個方向邁出的堅實而關鍵的一步。


答主@安小強

點擊文末「閱讀原文」查看完整內容、交流

謝邀。Qwen3-Coder-480B-A35B-Instruct,480B 參數的 MOE 模型(35B 激活參數)原生支持 256K 上下文,可外推擴展到 1M 上下文。許多榜單分數確實趕上 Claude Sonnet 4了(甚至略有超過)。但這不是一個單純的 coding模型,而是一個奔著 Agent 去的完整編程解決方案。

這次阿里發布的 Qwen3-Coder,不能只看模型,得把模型和它的配套工具 qwen-code 放在一起看,這才是它的全貌.

Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

Qwen Code 是一個命令行 AI 工作流工具,源自Gemini Cli,專為 Qwen3-Coder 模型優化,具有增強的解析器支持 & 工具支持。

效果上我最關注的是能否替代 Claude Code。前段時間月之暗面剛剛發布的 Kimi K2,已經做得很好了,這次阿里的 Qwen3 Code,更是令人驚喜。

我這裡已經啟動了,正在深入體驗。測試了1個火柴人格鬥雙人對戰的小遊戲,一次就過,沒有bug
(攻擊、碰撞檢測、移動、雙人鍵盤操控、死亡判定都沒有問題),就是畫面簡陋了些:


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

值得一提的是,阿里雲百鍊裡面,除了這次開源的模型以外,還有 1 個 100 萬上下文長度的 qwen3 coder 模型(應該是用 yarn 技術做了外推的,但暫時不知道是否有其它優化)另外這兩個模型還送 1000000 tokens……果然大家捲起來之後,我們這些開發者就舒服了(狗頭)。

做了許多測試,編寫前端代碼的通過率很高(頁面審美上稍弱一點,但出錯率很低),編寫後端代碼的通過率也很不錯。總體感受上比之前月之暗面 kimi k2 + claude code 的體驗還絲滑一些,弱於 claude code + claude 4。

text base rpg,還不錯(有小bug,比如戰鬥後生命-12了,人還活著……):


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

text based rpg

3d 場景測試:


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

空間理解測試:莫比烏斯環(裡面的圈對了,外面的不太對)


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

另外 Gemini cli 本事支持 yolo 模式(全自動模式),我看了一下 qwen code,果然也支持。

通過 claude code router,能很輕鬆把 qwen3 code 模型接入到 claude code中。

claude code 的 Agent 設計用起來還是比 gemini cli 穩定一些(比qwen code cli也一樣)。如圖,這是一句話通過 Claude Code + Qwen3 Code 生成的彈球遊戲,一次過,無bug:


Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

qwen3 code + claude code 做的 doodle jump (依然無報錯一次過,就是主角丑萌了一點):

Qwen3-Coder 挑戰 Claude4 ?知乎 50+ 項目實測千問 AI 編程大模型 - 天天要聞

以前 Claude 模型的編程能力是一座無法逾越的大山,現在已經不是了。Qwen3 Coder 和 Kimi K2 都一定程度跟上了它的能力,而且還在快速進步中。

真好。

科技分類資訊推薦

引領科技豪華MPV新風尚 第二代騰勢D9西安車展亮相 - 天天要聞

引領科技豪華MPV新風尚 第二代騰勢D9西安車展亮相

兼具宜商氣度與家用溫情的科技豪華旗艦MPV,第二代騰勢D9迎來西安地區正式亮相。新車依託全球新能源MPV冠軍底蘊,以第二代刀片電池、雙閥雲輦-C、天神之眼5.0智駕等核心技術全面升級,兼顧商務體面與家庭舒適,為西北高端用戶帶來一站式全能出行解決方案。
採購禁入!科華數據材料造假被拒門外 - 天天要聞

採購禁入!科華數據材料造假被拒門外

本報(chinatimes.net.cn)記者胡雅文 北京報道這家趕上AI算力風口的公司,因投標材料造假,被相關採購方列入禁入名單兩年,其此前提出的複議申請也被正式駁回。相關採購平台近日發布公告,明確駁回科華數據股份有限公司(下稱「科華數據」,002335.SZ)此前提交的複議申請。早在一年前,科華數據已被認定在「信息通信樞紐...
快評樂道L80:15萬元級買大五座,這波值得沖? - 天天要聞

快評樂道L80:15萬元級買大五座,這波值得沖?

日前,樂道L80正式發布並開啟預售,其整車購買預售價為24.58萬元起,租電購買預售價則低至15.98萬元起。面對大型SUV市場「細分再細分」之競爭趨勢,這款樂道年度重磅新車都有哪些優勢?又能否成為「大五座SUV革新之作」?下面,圈哥就帶大家全方位感受。
成都直擊凱威德:純電全尺寸SUV的張揚與大氣 - 天天要聞

成都直擊凱威德:純電全尺寸SUV的張揚與大氣

4月22日,凱迪拉克以奧斯卡級盛典規格,將上海保利大劇院點亮為璀璨舞台,在品牌代言人倪妮與全場嘉賓的共同見證下,凱迪拉克全尺寸純電公路旗艦——凱威德耀然上市。新車共推出長續航四驅Pro、高性能四驅Ultra兩款配置,官方售價區間為46.88萬-50.88萬元。