Claude 對上 Gemini:2026 年該為腦還是為產品付錢
PCMag 最新對決指出 Claude 推理與寫程式仍較強,Gemini 則在價格、Google 整合與 5 美元方案勝出。這篇只談你每天會碰到的差別。
三家聊天機器人排排比的文章已經沒人要看了。ChatGPT、Claude、Gemini 的對照表幾乎每次都長一樣:誰文筆好、誰便宜、誰黏在辦公套件裡。這個星期真正有用的,是兩邊對決。
PCMag 9 月的比較把問題寫在標題裡:比較聰明的腦,還是比較完整的產品。Claude 仍拿下前者。Gemini 拿下後者,而且便宜很多。若你讀過我們稍早的 ChatGPT、Claude、Gemini 三方比較,可以把這篇當成產品評測:兩邊的上下文都到了一百萬 token,寫程式的差距也不再是「各有千秋」。
一百萬 token 已經不是賣點
Claude 與 Gemini 現在都標到 1,000,000 token 的上下文。PCMag 寫這是作者看過最大的一檔。對會把 PDF、程式庫、會議紀錄塞進對話的人來說,這個數字以前就是購買理由。現在不是了。中型專案丟進去,兩邊都能給出「我有讀過檔案」的回答。
真正會碰到的是配額。兩邊都有五小時與每週用量上限,依方案而變。不寫程式的人,多數星期可以假裝上限不存在。寫程式的人,一個下午就用完。免費使用者就算只在做摘要,也會撞牆。PCMag 把上下文與上限打成平手,這是老實話。窗子一樣大,旁邊那顆電表才是體感。
8 月底有一則 Claude 免費方案的整理:Sonnet 5 更新後,部分組態的免費上下文可以拉到一百萬 token,官方價目表卻仍寫全方案 200K。免費方案對照把這件事標成「某些組態」。意思是:先觀察一週計數器,再決定要不要把工作流程建在上面。
免費 Claude 現在也給到五個 Projects,這以前是 Pro 的東西。Opus 跟較新的 Fable 系列模型仍要付費。免費層能做文件工作,撐不住把整個 repo 當對話紀錄來用。
誰比較聰明:差距不大,直到你需要那 10%
智力評分 PCMag 給 Claude。即便 Gemini Pro 開了 extended thinking,也追不上 Claude 最高檔模型。評論裡的例子小得幾乎失禮:問 Nioh 3 最終 DLC 何時出。Claude 的推理過程寫到第一個 DLC 比預期早發;Gemini 沒寫。不是每則提示都差這麼多。差的是你「就是為了那一筆細節才問」的那一次。
這跟過去一年實際使用 Claude 的感覺一致。它比較少在文件上含糊帶過,三則訊息前設下的限制它比較會記得,比較慢捏造出處。這些不會出現在行銷表格。會出現在你貼上 40 頁合約、問第七條到底改了什麼的時候。
Gemini 不笨。它快,而對 Workspace 裡那些「把這封信改短、把這張表變成人話」的工作,快就是功能。它比較常在推理的最後 10% 漏掉東西:缺一個日期,卻用完整的語氣收尾。
若你的工作是讀長文、對稿、找矛盾,多付的那 15 美元通常回得來。若你的工作是把 Google 文件變成 email,多付的錢只是在買一個比較會寫長句的摘要器。
寫程式這件事,沒有「看使用情境」
寫軟體的人,看到這裡就可以做決定。
PCMag 的句子不客套:Gemini 根本不是好用的寫程式工具。它很快。智力跟 Claude 的 Opus 5 這類模型不在同一個討論裡。提示詞沒校準好,Gemini 會把 Claude 一遍就能做對的簡單任務做壞。評論認為,連業餘的 vibe coding 都該選 Claude。
G2 對三千多則程式碼生成評論的整理把體感變成數字。評論者抱怨幻覺、過時套件、上下文丟掉時,關鍵詞出現率分成兩群。把通用聊天模型拿來寫程式的,高於類別平均 12%:ChatGPT 23%,Gemini 20%。專門的寫程式工具,加上 Claude,落在平均或以下:GitHub Copilot 13%、Claude 5%、Cursor 4%、Replit 2%,TESS AI 在 200 則評論裡是 0%。Claude 那 5% 樣本不夠大,G2 自己說只能當觀察、不能當獎牌。結構化正確性評分則較乾淨:Claude 4.60 / 5,近 50 則結構化回覆裡沒有 2 分或以下。
另一個被團隊忽略的發現:摩擦很常見,不滿意卻很輕。有人同一則評論先寫幻覺,再給五顆星。抱怨清單比較像試用前檢查表,不是「別碰這類工具」的警告。專門編輯器如 Cursor 摩擦更低,因為程式就在產生它的視窗裡跑,錯得比較便宜。
G2 的 Leader 象限外面還有 TESS AI(4.7 星、NPS 83)、Ask Codi(4.8、NPS 80)、SoftSpell(4.5、NPS 73)。位置差在評論量與市場覆蓋,不在使用者討厭它們。若你用滿意度而不是品牌來篩選,這些名字該進短名單。它們不該出現在 Claude 對 Gemini 的文章裡,除非當成提醒:還在問「哪個聊天機器人比較會寫程式」,已經比買了專門工具的人慢一個世代。
Google 的 200 美元方案解鎖 Antigravity 寫程式應用。Anthropic 的 200 美元方案解鎖 Claude Design。這不是同一種產品。前者是 Google 想進編輯器市場,後者是 Anthropic 想做產物工作區。你現有的 20 美元寫程式流程如果堪用,不必為了這兩個名字升級。
生產環境的補丁不要讓 Gemini 直接交。用它寫票、寫說明、寫測試大綱。補丁交給 Claude,或交給 Cursor。我們對 Claude Opus 4.6 的評測把「為什麼它比較少在關鍵處失手」寫得更細,這裡只保留結論:寫程式請選腦,不要選套件。
Gemini 贏在產品,而價格就是產品
價格評分 PCMag 幾乎沒有懸念。Claude 基礎付費大約每月 20 美元,Gemini 大約 5 美元。兩家都賣 200 美元檔。Gemini 較便宜的方案還帶雲端儲存,若你本來就要付 Google Drive,這筆帳是真的。
免費層的地圖講同一件事。Claude 免費是 Sonnet 與 Haiku;Opus 留下付費牆後面。Claude Pro 20 美元,年繳約 17;Max 5x 是 100,Max 20x 是 200。Google AI Pro 19.99 美元,綁 Gemini Live、Workspace 整合與 Canvas。ChatGPT Plus 仍是 20,Go 大約 8。只想逃離免費上限的人,8 到 20 美元這段已經很擠。Gemini 的 5 美元付費檔是異類,所以 PCMag 說它明顯比較負擔得起。
整合也是同一邊倒。Gemini 在 Gmail、Docs、Drive、Android 的第一方支援,PCMag 用 peerless。Claude 的瀏覽器與 Projects 比較適合一堆不屬於 Google 的 PDF。若你的工作本來就是 Google,Claude 會像一台外接腦;若不是,Gemini 的 5 美元方案是「比較不會寫程式、比較知道你日曆」的折扣 Claude。
PCMag 有一節標題叫「兩邊都不在乎把你顧好」。雜誌筆法,事實卻不新鮮。Google 會在 Workspace 周邊收集很多行為,除非你在對的企業方案上。Anthropic 的消費條款比以前好,仍然不是醫療或機密文件的地方。病歷或交易文件請用企業版,或不要貼。
怎麼試、誰該換
不要用免費方案評估寫程式。PCMag 寫得很清楚:免費使用者就算不寫程式也會碰到上限,寫程式連付費檔也燒得很快。
若你還沒選定,用同一組三件事試:
- 把同一份 80 頁 PDF 丟進兩個免費對話,請它列出變更。看誰捏造條款。
- 貼一段真的有 bug 的 200 行函式,不要提示。數幾次才能跑起來。
- 請它依你只存在 Google 日曆裡的行程排一週。Gemini 會去看。Claude 會請你貼上來。
第二項是工作內容,就付 Claude 的錢,或兩邊都不買、留在 Cursor。第三項是工作內容,Gemini 便宜的付費檔就夠。第一項是工作內容,仍是 Claude。
若你現在付 20 美元給 Claude,但八成用量是「把這份 Doc 摘要、把這封信改短」,換 Gemini。5 美元加 Drive 空間比較誠實。智力下降會出現在那兩成真正要分析的時候,你可能不在乎。
若你正用 Gemini 寫程式,或你常常因為第一個答案漏掉限制而重問,換 Claude。G2 的正確性分數與 PCMag 的寫程式段落說的是同一件事。一個下午清掉一次自信的錯誤補丁,比每個月多 15 美元貴。
已經有帶模型選擇器的程式編輯器,就不必把聊天機器人當 IDE。200 美元的 Antigravity 或 Claude Design,是買供應商工作流的人在看的,不是工作流已經成形的人。
2026 年這場比較比 2024 年簡單。上下文打平了。腦沒有。套件沒有。需要腦就為腦付錢。人已經住在 Google 裡,就為套件付錢。不要花 20 美元買一套件仿製品,也不要花 5 美元期待 Opus 5 會從 Google 裡長出來。
分享文章
留言評論
0 則評論暫無評論,搶先發表你的看法吧!
相關文章
Claude Cowork 評測:Anthropic 的 AI 代理走向行動端,學會了「看教學」
Claude Cowork 現在能在手機上運行、關掉筆電後持續工作,還能透過螢幕錄影學會新任務。實際體驗如何?哪些功能真的有用?
Claude Code 跨 Session 訊息與 Agent Teams:從單打獨鬥到團隊協作
Claude Code v2.1.224 新增跨 Session 訊息傳遞與實驗性 Agent Teams 功能,讓多個 Claude Code 工作階段能互相溝通、分配任務、協同開發。
Cursor AI 程式碼編輯器 2026 年評測:依然是最好的 AI 編輯器,但差距正在縮小
我們連續兩個月使用 Cursor 最新版本,整理出它的優勢、短板,以及在競爭對手快速追趕下,每月 20 美元是否仍然值得。