AI 新聞

Google 殺瘋了!Gemini 3.0 設計美感史詩級進化!一句話生成完整應用、精美 3D 網頁|同時推出 Antigravity AI IDE 實現完整開發工作流

萬眾矚目的 Google Gemini 3.0 終於發布!這次不只在推理能力上輾壓對手,更在前端設計美感上有著史詩級的躍進。本文將帶你實測 Gemini 3 Pro 的各項能力,從製作復古遊戲到 3D 履歷網站,並介紹 Google 全新推出的 AI IDE "Antigravity",讓你免費體驗最強大的開發工作流。

The Walking Fish 步行魚 頭像

· 2659 字 / 閱讀時間: 6 分鐘 · 載入中... ...

文章 Google 殺瘋了!Gemini 3.0 設計美感史詩級進化!一句話生成完整應用、精美 3D 網頁|同時推出 Antigravity AI IDE 實現完整開發工作流 的特色圖片

萬眾矚目的 Google Gemini 3.0 終於發布了!這幾天大家應該都被洗版了吧?這次它的表現真的可以用「誇張」來形容。以前我們對 Gemini 前端設計的印象可能是簡陋的排版、不協調的漸變色,充滿了濃濃的「AI 味」,程式能寫但介面設計慘不忍睹,但這次 Google 帶著驚喜回來了,可以。

今天就帶大家看看 Gemini 3.0 到底更新了什麼、實際使用起來如何,以及如何透過 Google AI Studio 與最新的 Antigravity IDE 來免費使用這個強大的模型。

介面設計:從「AI 感」到「設計師級」

首先,這次 Gemini 3.0 最讓我驚豔的,絕對是它的前端程式碼生成與美感設計能力

在過去,如果直接請 Gemini 生成網頁介面,結果通常都很簡陋,或是充斥著各種不協調的漸變色,簡單說就是充滿了濃濃的「AI 感」。但現在,Gemini 3.0 可以生成乾淨俐落、不失細節點綴,且具有高度美感的網頁設計。

Gemini 3.0 生成的網頁設計範例

目前在 LMSYS 語言模型競技場的排行榜上,Gemini 3.0 Pro 也成功拿下了綜合、文字生成、網頁設計與視覺領域的排名第一,可見全球網友對這次的升級是相當買單的。

語言模型競技場 Gemini 3 Pro 目前排名第一

另外這次 Gemini 3.0 的更新,也大幅強化了 3D 方面的表現,Google 官方有提供一系列使用 Gemini 3 Pro 生成的範例,讓大家體驗 Gemini 3 的強大!

Gemini 3 小遊戲 Demo

測試資料集表現

根據 Google 官方提供的 Benchmark 資料,Gemini 3 Pro 在綜合推理與科學能力的領域,展現了遠超前代模型 Gemini 2.5 Pro 以及競爭對手(如 GPT-5.1、Claude 4.5 Sonnet)的能力。

  • Humanity’s Last Exam & GPQA Diamond:大幅領先。
  • AIME 2025 (數學):表現優異。
  • MMMU-Pro (多模態):同樣是領先地位。

Gemini 3 Pro 各項跑分數據比較

Benchmark 描述 (Description) 設定 / 指標 (Settings / Metric) Gemini 3 Pro Gemini 2.5 Pro Claude Sonnet 4.5 GPT-5.1
Humanity’s Last Exam 學術推理 無工具 37.5% 21.6% 13.7% 26.5%
搭配搜尋與程式執行 45.8%
ARC-AGI-2 視覺推理謎題 ARC Prize 驗證集 31.1% 4.9% 13.6% 17.6%
GPQA Diamond 科學知識 無工具 91.9% 86.4% 83.4% 88.1%
AIME 2025 數學 無工具 95.0% 88.0% 87.0% 94.0%
搭配程式執行 100% 100%
MathArena Apex 高難度數學競賽題目 23.4% 0.5% 1.6% 1.0%
MMMU-Pro 多模態理解與推理 81.0% 68.0% 68.0% 76.0%
ScreenSpot-Pro 螢幕畫面理解 72.7% 11.4% 36.2% 3.5%
CharXiv Reasoning 複雜圖表資訊整合 81.4% 69.6% 68.5% 69.5%
OmniDocBench 1.5 光學字元辨識 (OCR) 整體編輯距離 (越低越好) 0.115 0.145 0.145 0.147
Video-MMMU 影片知識獲取 87.6% 83.6% 77.8% 80.4%
LiveCodeBench Pro 來自 Codeforces、ICPC 和 IOI 的程式競賽題目 Elo 等級分 (越高越好) 2,439 1,775 1,418 2,243
Terminal-Bench 2.0 代理式 (Agentic) 終端寫碼 Terminus-2 代理 54.2% 32.6% 42.8% 47.6%
SWE-Bench Verified 代理式 (Agentic) 寫碼 單次嘗試 76.2% 59.6% 77.2% 76.3%
t2-bench 代理式 (Agentic) 工具使用 85.4% 54.9% 84.7% 80.2%
Vending-Bench 2 長序列代理任務 淨值 (平均),越高越好 $5,478.16 $573.64 $3,838.74 $1,473.43
FACTS Benchmark Suite 保留測試集:內部事實基礎、參數化知識、多模態及搜尋檢索基準 70.5% 63.4% 50.4% 50.8%
SimpleQA Verified 參數化知識 72.1% 54.5% 29.3% 34.9%
MMMLU 多語言問答 91.8% 89.5% 89.1% 91.0%
Global PIQA 跨越 100 種語言與文化的常識推理 93.4% 91.5% 90.1% 90.9%
MRCR v2 (8-needle) 長上下文效能 128k (平均) 77.0% 58.0% 47.1% 61.6%
1M (單點測試) 26.3% 16.4% 不支援 不支援

Agent (代理) 與程式能力方面:

  • SWE-bench Verified:雖然略輸給 Claude 4.5 Sonnet 與 GPT-5.1 一些,但分數相當接近。
  • TauBench (工具使用):成功超越 GPT-5.1 與 Claude 4.5。
  • ScreenSpot Pro (UI 理解):這是最誇張的,Gemini 3 Pro 拿到了 72.7% 的得分,完全輾壓對手的 3.5% - 36.2%,顯示它對高解析度且複雜畫面的理解力極強。

此外,Gemini 3 依舊保持了長文理解 (Long Context) 的優勢,支援高達 100 萬 Tokens 的 Context Window。在 Fact Benchmark Suite (長文資訊總結) 與 MRCR v2 (多輪對話大海撈針) 的測試中,表現都非常穩定。

實戰測試:Google AI Studio 與 Canvas

現在 Gemini 3 Pro 已經在 Google AI StudioGemini App 上免費開放。但個人建議依舊在 Google AI Studio 中使用,因為 Gemini App 免放帳戶有每天 5 則訊息的限制

Google 官方建議現在的提示詞 (Prompt) 要簡潔扼要,不需要像過去那樣寫長篇大論,將每個修改細節都告訴 LLM。

1. Gemini App Canvas:解釋性動畫

我嘗試用 Gemini App 的 Canvas 功能,讓它製作一個「解釋 DNS 運作原理」的動畫。

提示詞:
製做一個解釋網址解析原理的動畫,從使用者在瀏覽器輸入網址開始,到返回IP的整個DNS查詢流程

Canvas 生成的 DNS 動畫演示

結果非常驚人!它生成了一個互動式的網頁,雖然一開始排版稍微有點擠,但對話修復一次後就完美了。相比之下,舊版 Gemini 2.5 Pro 生成的版本 UI 設計不佳,還莫名其妙用了一堆 Emoji。

2. Google AI Studio Build:貪食蛇與 3D 履歷

如果要做更複雜的應用,建議使用 Google AI Studio 的 Build 功能

  • 日式復古貪食蛇:我只下了一句簡單的提示詞,指定「日式復古街機風格」。它不僅字體到位,甚至做出了老式映像管電視的畫面抖動效果
  • 3D 個人履歷網站:我要求製作一個充滿 3D 物件的履歷、作品集網頁。Gemini 3 Pro 透過 2、3 輪對話,不僅解決了建置錯誤,還生成了一個背景有 3D 元素互動、頁面切換有過場動畫的精美網站。

甚至我還讓它寫了一個「圖片去浮水印」的小工具,雖然底層是調用 Nano Banana API,但功能完全可用!

全新 AI IDE:Antigravity (反重力)

這次 Google 還發布了一個大殺器——Antigravity。這是一個基於 VS Code 修改而來的 AI IDE,目前可以在裡面免費使用 Gemini 3 Pro修改專案!

怎麼玩?

既然我們剛剛已經用 Gemini App 設計出了漂亮的個人網站,我們可以利用 Antigravity 將它變成一個易於維護的 Hugo 模板

  1. 開啟專案:在 Antigravity 打開舊的 Hugo 專案資料夾。
  2. 匯入設計:將剛剛 AI 生成的 HTML 檔案丟進去。
  3. 對話修改 (Ctrl+L):在對話框中輸入 @參考設計.html,要求它參考這個設計來重構整個 Hugo 主題。
  4. Planning Mode:它會先列出修改計畫,你可以針對細節提出建議,確認無誤後點擊執行。

Antigravity 的操作介面

對話時跟Cursor、cline一樣可用@指定檔案 可選planning或fast模式 planning模式在一開始會先生成一份規劃檔案供我們查閱與修改,確定沒問題再由使用者按下執行

整個過程非常流暢,它會自動修改多個檔案,並提供 Diff 檢視。最終我成功將舊網站翻新成 Gemini 3 設計的全新風格,而且完全免費!(免費的不用白不用w)

最終成品

視覺辨識能力依舊強悍!

最後稍微測試了一下視覺辨識。

  • 一般場景:辨識學校公告欄的照片,電腦打字與手寫字都能精準轉錄。
  • 極限場景:辨識模糊且距離較遠的石碑文字。這邊 Gemini 3 Pro 就翻車了,遺漏了大量字段,甚至出現了幻覺 (Hallucination) 自己編造內容。

中文字即便是手寫的,且略為潦草,Gemini 3 Pro 也一樣可以辨識 極限場景下,Gemini 3 Pro 辨識錯誤後開始編造內容

所以在處理直書且稍微模糊的極限狀況下,使用上還是要多加注意。

總結

Gemini 3.0 在前端介面設計與程式撰寫上的進步是肉眼可見的巨大,加上 Antigravity 這個新工具的推出,Google 這次真的展現了強大的競爭力。如果你是開發者,或是想嘗試用 AI 寫網頁的朋友,強烈建議去試玩看看!

小撇步:目前 Gemini App 免費版額度較少,建議大家優先使用 Google AI StudioAntigravity 來體驗完整的 Gemini 3 Pro。

影片介紹

如果你想看更詳細的操作演示和那個 3D 網頁的動態效果,歡迎觀看我的 YouTube 影片:

分享這篇文章