用嘴 P 圖的這一天真的來了!超強多模態 Gemini AI 讓一票設計師默默把繪圖板拿起來邊啃邊思考人生 ~

這部在講什麼

介紹 Google Gemini 2.0 多模態 AI 的強大功能,展示其直接理解影音、原生生成影像以及精確修圖的實測表現。

適合誰想提升效率的設計師、社群創作者與 AI 愛好者。
你會得到掌握 Gemini 2.0 實測功能、學會多模態 AI 的 P 圖技巧、了解 AI 輔助設計的應用。
最值得看2:18 展示用文字指令精準修改人像細節與姿勢。

內容脈絡

0:15
0:45
4:25
5:18

一眼重點意義優先,時間戳用來導航

評測比較0:45

影音直讀功能

無需文字稿即可摘要中英文影片,並能為音訊自動生成含時間戳的逐字稿。
評測比較1:14

原生影像生成

具備深度整合的推理能力,非掛載外部模型,能維持影像修改前後的高度一致性。
評測比較2:15

文字精準 P 圖

透過對話即可執行美膚、換髮色、改服飾甚至調整表情,效率遠超傳統 Photoshop 技巧。
評測比較4:13

環境與場景合成

支援移除路人、添加人物、轉換藝術風格,並能為商品生成專業的虛擬模特兒。
評測比較4:53

專業視角與設計

可自由調整相機拍攝視角、變更晝夜燈光效果,或快速生成室內裝修草圖。

看完可以做什麼

登入 Google AI Studio,嘗試上傳一張照片並練習用文字指令更換背景或服飾。
需要留意:實驗平台不儲存對話紀錄需及時存圖;內容審查機制嚴格易導致任務中斷;多輪修改後畫質會逐漸降低。

觀眾怎麼看

整理 35 則有效留言信心 高

觀眾對 Gemini 2.0 的多模態生成能力感到驚艷,但普遍反映實際使用時存在嚴格審查、Token 限制及生成品質不穩定的問題。

共識生成效率與創意應用8 則提及

多數觀眾認同該工具能大幅提升影像處理效率,並對影片中展示的創意應用感到驚艷,認為其改變了創作流程。

分歧生成品質與實測落差6 則提及

部分觀眾認為效果極佳,但也有不少人反映實際操作時品質不佳、無法精確融入實景,甚至出現人像變形或風格不符的情況。

留言樣本僅反映部分使用者體驗,實際效能可能因帳號權限與系統更新而異。

生成於 2026-07-12 檢舉
摘要先揭露後段價值,完整內容仍屬於原創作者。 回 YouTube 看最值得的一段 → 在 YouTube 邊播邊讀 · 加入 Chrome →