萬眾矚目的 Google Gemini 3.0 終於發布了!這幾天大家應該都被洗版了吧?這次它的表現真的可以用「誇張」來形容。以前我們對 Gemini 前端設計的印象可能是簡陋的排版、不協調的漸變色,充滿了濃濃的「AI 味」,程式能寫但介面設計慘不忍睹,但這次 Google 帶著驚喜回來了,可以。
今天就帶大家看看 Gemini 3.0 到底更新了什麼、實際使用起來如何,以及如何透過 Google AI Studio 與最新的 Antigravity IDE 來免費使用這個強大的模型。
介面設計:從「AI 感」到「設計師級」
首先,這次 Gemini 3.0 最讓我驚豔的,絕對是它的前端程式碼生成與美感設計能力。
在過去,如果直接請 Gemini 生成網頁介面,結果通常都很簡陋,或是充斥著各種不協調的漸變色,簡單說就是充滿了濃濃的「AI 感」。但現在,Gemini 3.0 可以生成乾淨俐落、不失細節點綴,且具有高度美感的網頁設計。
目前在 LMSYS 語言模型競技場的排行榜上,Gemini 3.0 Pro 也成功拿下了綜合、文字生成、網頁設計與視覺領域的排名第一,可見全球網友對這次的升級是相當買單的。
另外這次 Gemini 3.0 的更新,也大幅強化了 3D 方面的表現,Google 官方有提供一系列使用 Gemini 3 Pro 生成的範例,讓大家體驗 Gemini 3 的強大!
測試資料集表現
根據 Google 官方提供的 Benchmark 資料,Gemini 3 Pro 在綜合推理與科學能力的領域,展現了遠超前代模型 Gemini 2.5 Pro 以及競爭對手(如 GPT-5.1、Claude 4.5 Sonnet)的能力。
- Humanity’s Last Exam & GPQA Diamond:大幅領先。
- AIME 2025 (數學):表現優異。
- MMMU-Pro (多模態):同樣是領先地位。
| Benchmark | 描述 (Description) | 設定 / 指標 (Settings / Metric) | Gemini 3 Pro | Gemini 2.5 Pro | Claude Sonnet 4.5 | GPT-5.1 |
|---|---|---|---|---|---|---|
| Humanity’s Last Exam | 學術推理 | 無工具 | 37.5% | 21.6% | 13.7% | 26.5% |
| 搭配搜尋與程式執行 | 45.8% | — | — | — | ||
| ARC-AGI-2 | 視覺推理謎題 | ARC Prize 驗證集 | 31.1% | 4.9% | 13.6% | 17.6% |
| GPQA Diamond | 科學知識 | 無工具 | 91.9% | 86.4% | 83.4% | 88.1% |
| AIME 2025 | 數學 | 無工具 | 95.0% | 88.0% | 87.0% | 94.0% |
| 搭配程式執行 | 100% | — | 100% | — | ||
| MathArena Apex | 高難度數學競賽題目 | 23.4% | 0.5% | 1.6% | 1.0% | |
| MMMU-Pro | 多模態理解與推理 | 81.0% | 68.0% | 68.0% | 76.0% | |
| ScreenSpot-Pro | 螢幕畫面理解 | 72.7% | 11.4% | 36.2% | 3.5% | |
| CharXiv Reasoning | 複雜圖表資訊整合 | 81.4% | 69.6% | 68.5% | 69.5% | |
| OmniDocBench 1.5 | 光學字元辨識 (OCR) | 整體編輯距離 (越低越好) | 0.115 | 0.145 | 0.145 | 0.147 |
| Video-MMMU | 影片知識獲取 | 87.6% | 83.6% | 77.8% | 80.4% | |
| LiveCodeBench Pro | 來自 Codeforces、ICPC 和 IOI 的程式競賽題目 | Elo 等級分 (越高越好) | 2,439 | 1,775 | 1,418 | 2,243 |
| Terminal-Bench 2.0 | 代理式 (Agentic) 終端寫碼 | Terminus-2 代理 | 54.2% | 32.6% | 42.8% | 47.6% |
| SWE-Bench Verified | 代理式 (Agentic) 寫碼 | 單次嘗試 | 76.2% | 59.6% | 77.2% | 76.3% |
| t2-bench | 代理式 (Agentic) 工具使用 | 85.4% | 54.9% | 84.7% | 80.2% | |
| Vending-Bench 2 | 長序列代理任務 | 淨值 (平均),越高越好 | $5,478.16 | $573.64 | $3,838.74 | $1,473.43 |
| FACTS Benchmark Suite | 保留測試集:內部事實基礎、參數化知識、多模態及搜尋檢索基準 | 70.5% | 63.4% | 50.4% | 50.8% | |
| SimpleQA Verified | 參數化知識 | 72.1% | 54.5% | 29.3% | 34.9% | |
| MMMLU | 多語言問答 | 91.8% | 89.5% | 89.1% | 91.0% | |
| Global PIQA | 跨越 100 種語言與文化的常識推理 | 93.4% | 91.5% | 90.1% | 90.9% | |
| MRCR v2 (8-needle) | 長上下文效能 | 128k (平均) | 77.0% | 58.0% | 47.1% | 61.6% |
| 1M (單點測試) | 26.3% | 16.4% | 不支援 | 不支援 |
在 Agent (代理) 與程式能力方面:
- SWE-bench Verified:雖然略輸給 Claude 4.5 Sonnet 與 GPT-5.1 一些,但分數相當接近。
- TauBench (工具使用):成功超越 GPT-5.1 與 Claude 4.5。
- ScreenSpot Pro (UI 理解):這是最誇張的,Gemini 3 Pro 拿到了 72.7% 的得分,完全輾壓對手的 3.5% - 36.2%,顯示它對高解析度且複雜畫面的理解力極強。
此外,Gemini 3 依舊保持了長文理解 (Long Context) 的優勢,支援高達 100 萬 Tokens 的 Context Window。在 Fact Benchmark Suite (長文資訊總結) 與 MRCR v2 (多輪對話大海撈針) 的測試中,表現都非常穩定。
實戰測試:Google AI Studio 與 Canvas
現在 Gemini 3 Pro 已經在 Google AI Studio 與 Gemini App 上免費開放。但個人建議依舊在 Google AI Studio 中使用,因為 Gemini App 免放帳戶有每天 5 則訊息的限制。
Google 官方建議現在的提示詞 (Prompt) 要簡潔扼要,不需要像過去那樣寫長篇大論,將每個修改細節都告訴 LLM。
1. Gemini App Canvas:解釋性動畫
我嘗試用 Gemini App 的 Canvas 功能,讓它製作一個「解釋 DNS 運作原理」的動畫。
提示詞:
製做一個解釋網址解析原理的動畫,從使用者在瀏覽器輸入網址開始,到返回IP的整個DNS查詢流程
結果非常驚人!它生成了一個互動式的網頁,雖然一開始排版稍微有點擠,但對話修復一次後就完美了。相比之下,舊版 Gemini 2.5 Pro 生成的版本 UI 設計不佳,還莫名其妙用了一堆 Emoji。
2. Google AI Studio Build:貪食蛇與 3D 履歷
如果要做更複雜的應用,建議使用 Google AI Studio 的 Build 功能。
- 日式復古貪食蛇:我只下了一句簡單的提示詞,指定「日式復古街機風格」。它不僅字體到位,甚至做出了老式映像管電視的畫面抖動效果!
- 3D 個人履歷網站:我要求製作一個充滿 3D 物件的履歷、作品集網頁。Gemini 3 Pro 透過 2、3 輪對話,不僅解決了建置錯誤,還生成了一個背景有 3D 元素互動、頁面切換有過場動畫的精美網站。
甚至我還讓它寫了一個「圖片去浮水印」的小工具,雖然底層是調用 Nano Banana API,但功能完全可用!
全新 AI IDE:Antigravity (反重力)
這次 Google 還發布了一個大殺器——Antigravity。這是一個基於 VS Code 修改而來的 AI IDE,目前可以在裡面免費使用 Gemini 3 Pro修改專案!
怎麼玩?
既然我們剛剛已經用 Gemini App 設計出了漂亮的個人網站,我們可以利用 Antigravity 將它變成一個易於維護的 Hugo 模板。
- 開啟專案:在 Antigravity 打開舊的 Hugo 專案資料夾。
- 匯入設計:將剛剛 AI 生成的 HTML 檔案丟進去。
- 對話修改 (Ctrl+L):在對話框中輸入
@參考設計.html,要求它參考這個設計來重構整個 Hugo 主題。 - Planning Mode:它會先列出修改計畫,你可以針對細節提出建議,確認無誤後點擊執行。
整個過程非常流暢,它會自動修改多個檔案,並提供 Diff 檢視。最終我成功將舊網站翻新成 Gemini 3 設計的全新風格,而且完全免費!(免費的不用白不用w)
視覺辨識能力依舊強悍!
最後稍微測試了一下視覺辨識。
- 一般場景:辨識學校公告欄的照片,電腦打字與手寫字都能精準轉錄。
- 極限場景:辨識模糊且距離較遠的石碑文字。這邊 Gemini 3 Pro 就翻車了,遺漏了大量字段,甚至出現了幻覺 (Hallucination) 自己編造內容。
所以在處理直書且稍微模糊的極限狀況下,使用上還是要多加注意。
總結
Gemini 3.0 在前端介面設計與程式撰寫上的進步是肉眼可見的巨大,加上 Antigravity 這個新工具的推出,Google 這次真的展現了強大的競爭力。如果你是開發者,或是想嘗試用 AI 寫網頁的朋友,強烈建議去試玩看看!
小撇步:目前 Gemini App 免費版額度較少,建議大家優先使用 Google AI Studio 或 Antigravity 來體驗完整的 Gemini 3 Pro。
影片介紹
如果你想看更詳細的操作演示和那個 3D 網頁的動態效果,歡迎觀看我的 YouTube 影片: