📌 本文更新於 2026 年 9 月:SDK 改為現行的 google-genai/@google/genai(舊版 2025-11-30 起停止維護)、cURL 範例換成官方 generateContent 端點;模型與價格表全面改為 2.5/3.x 現役世代(1.0/1.5/2.0 皆已退役);免費額度改為「以 AI Studio 儀表板為準」並補上 Tier 升級條件;ChatGPT API 對照也更新成 GPT-5 系列現況。
如何開始使用 Gemini API:懶人快速開通攻略
✅ 第一步:先拿到你的「魔法鑰匙」——API 金鑰
如何取得 Gemini API?想用 Gemini API,不需要什麼程式背景,基本上就像辦一張會員卡,拿到鑰匙後就能開啟 AI 魔法世界。
流程很簡單:
- 登入 Google 帳號,進入 Google AI Studio。
- 建立一個專案(或選一個舊的也可以)。
- 到 API keys 頁面點「Create API key」→ 產生一串看起來很機密的密碼字串。

這串就是你的 API 金鑰,記得複製下來好好保存。接下來只要在任何支援 Gemini 的外部工具、插件、網站服務裡,貼上這串金鑰,就能叫 Gemini 幫你動腦了。
像 Notion AI 插件、AI 瀏覽器擴充工具、有些寫作/設計平台,都會有個「填入 Gemini API Key」的欄位,只要貼上,就能開啟智慧模式。順帶一提,AI Studio 現在的介面已經統一叫 Playground,拿到金鑰之前也可以先在裡面把 prompt 試到滿意再搬進程式。
🧠 小提醒:
- 這串 API 金鑰就像是你專屬的提款卡密碼,不要貼在公開網站、也不要丟到 GitHub。
- Google 有提供免費額度可以先試用,平常用其實很夠用,不需要馬上刷卡。
- 記得,如果你換了 Google Cloud 專案,API 金鑰也要重新設定一次。
拿到金鑰之後,就可以開始動手寫程式啦。
你可以選擇走簡單路線,直接用 HTTP + cURL 發請求;或是走輕鬆一點的路線,裝官方提供的新版 SDK(Google GenAI SDK),像是:
Python:pip install google-genai
Node.js:npm install @google/genai
Go:google.golang.org/genai
⚠️ 注意:舊版的 google-generativeai(Python)跟 @google/generative-ai(JS)自 2025-11-30 起已經 deprecated、不再維護,也用不到 Live API、Veo 這些新功能。網路上的舊教學如果還在教這兩個套件,請直接換成新版。
只要把金鑰放對位置(放在 HTTP header 的 x-goog-api-key 裡),Gemini 就會乖乖聽你說話。額外小確幸是,Google Cloud 新用戶有送 300 美元試用金!等於 Google 請你喝咖啡加送開發空間,先玩個幾百次再說!
這裡給你一個最基本的範例,用 cURL 打官方的 generateContent 端點,讓 Gemini 說個笑話來聽聽(模型用最便宜的 gemini-2.5-flash-lite,想用最新的可以換成 gemini-3.8-flash):curl -X POST "https://generativelanguage.googleapis.com/v1beta/models/gemini-2.5-flash-lite:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: $GEMINI_API_KEY" \ -d '{"contents": [{"parts": [{"text": "講個笑話來聽聽"}]}]}'
如果成功的話,回傳回來的會是 JSON 格式,裡面就有 Gemini 幫你想好的笑話。你也可以把 text 換成其他問題,像是「幫我寫一段商品文案」或「用台語翻譯這句話」。
用 SDK 的話更輕鬆,像 Node.js 一樣,generateContent() 一行就可以叫出回答,完全是開發者的 AI 點餐神器。
上面的 cURL 展開來長這樣,方便你直接複製(把 $GEMINI_API_KEY 換成你的金鑰,或先 export 進環境變數):
curl -X POST "https://generativelanguage.googleapis.com/v1beta/models/gemini-2.5-flash-lite:generateContent" \
-H "Content-Type: application/json" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-d '{"contents": [{"parts": [{"text": "講個笑話來聽聽"}]}]}'
補充一個 2026 年的新變化:Google 從 2026 年 6 月起主推新的 Interactions API(端點是 POST https://generativelanguage.googleapis.com/v1beta/interactions),generateContent 被官方歸類為 legacy。不過別緊張,generateContent 仍然完整支援、也持續拿到新模型,初學者先用它入門完全沒問題;等你要做比較複雜的多輪互動再去看官方的 Interactions 遷移指南就好。
💡 Google 2025 發表會懶人包!十分鐘看完: Gemini AI、Pixel 10 全系列、100 倍變焦等十大亮點!
2025 年 8 月的發表會發佈了 Gemini 作為 AI 助理的全新整合與功能:
- Gemini AI 現在會內建於 Pixel 手機、手錶、耳機,未來還會擴展到汽車、家用揚聲器和顯示器。
- 推出了「Gemini Live」功能,使用者可以即時分享手機鏡頭畫面,獲得現場協助。(影片裡 0:50 有 NBA 球星字母哥示範)
Gemini API 可以做什麼?
Gemini 是 Google 家現在最強的生成式 AI 模型,強到不像話。除了會「看字懂意思」,它還會「看圖猜內容」、「聽音辨場面」,甚至連影片都能理解個大概。你可以把它想成一個有點誇張的 AI 萬事通,只要你開口,它幾乎都能給出一個像樣的答案。
✍️ 幫你寫字寫文案,連道歉信都能代筆
你可以給 Gemini 幾句提示,它就能幫你:
- 寫完一篇還沒結尾的文章
- 生出一個創意小故事
- 幫你總結文件、翻譯段落
- 甚至把你不想打的道歉信、拒絕信,包裝得又誠懇又動人
重點是——它寫的還不錯。根據一些大型語言理解測試(像是 MMLU),它的表現甚至超過人類專家!是不是有點毛骨悚然,但又有點想趕快拿來用看看?
👨💻 懂程式碼,比很多線上課程還有耐心
如果你是寫程式會卡住的人(其實誰不會),Gemini 可以直接幫你看程式碼、解釋它在幹嘛,甚至照你的需求寫一段出來。不管你是寫 Python、Java 還是 Go,它都能搭上話。
你只需要問它:「這段是幹嘛的?我想改成 XXX 要怎麼寫?」
它會秒懂然後給你範例,完全像請到一個不會請假、也不會翻白眼的資深工程師。
🖼 看圖說話不是夢,還能幫你解影片
Gemini 的多模態能力也很強。
你傳一張照片給它,它不只會說「這是一隻貓」,還會說出「這隻貓看起來正在生氣,因為旁邊的杯子打翻了」。
同樣地,給它一段音訊、甚至影片片段,它也能理解裡面發生什麼事——而且現在的上限很誇張:影片最長可以餵 3 小時(低解析度)或 1 小時(高解析度),一次請求最多 10 部;PDF 最多 1,000 頁或 50MB;音訊每個 prompt 最長 9.5 小時。超級適合做:
- 圖片問答聊天機器人
- 看圖寫圖說文的教學應用
- 自動產出影音摘要的影片助手
一個小提醒:主線的文字模型(像 2.5 Flash、3.8 Flash、3.1 Pro Preview)「吃」得很雜,但「吐」出來的只有文字。想要它產圖、產語音,要另外用圖片模型(Nano Banana 系列)、TTS 模型或 Live API 模型,後面價格那段會講。
🤖 拿來做聊天機器人?非常可以,還很會記話
當然,最基本的應用之一就是做成聊天機器人。
跟 Gemini 對話,就像請一個反應快、記性好又不會情緒勒索的 AI 小幫手。你可以拿它來做:
- 客服聊天機器人
- 個人助理式的對話 AI
- 複雜任務的流程引導機器人
它最大的優勢之一是「長記憶」。不像某些 AI 每三句話就忘了你剛剛說什麼,Gemini 可以記得對話脈絡、上下文邏輯,而且不會跳針。現役主線模型一次可以吃 1,048,576 個 token 的輸入(大約就是「一百萬 token」),輸出上限 65,536 個 token。
而且 Google 還有推出 Gemini Live 這種能即時語音互動的功能,基本上就是能跟你用講的,像真人聊天一樣。開發者這邊也有對應的 Live API(目前模型是 gemini-3.1-flash-live-preview),可以自己做出邊講邊回的語音助理。
ChatGPT API 跟 Gemini API 哪個好用?

Gemini API 表格比較(2026 年 9 月版)
| 比較項目 | ChatGPT API(OpenAI) | Gemini API(Google) |
| 模型能力與表現 | GPT-5 系列已經是主力,現行旗艦是 GPT-5.6 家族(sol/terra/luna)與 GPT-6 Astra,對話自然、程式表現穩定 | 穩定版 Gemini 2.5 Pro/Flash,最新的 3.x Flash 系列(3.8 Flash 已 GA)與 3.1 Pro Preview,推理、程式、學術任務表現強,回答精簡有力 |
| 多模態能力 | 文字為主,圖片生成(gpt-image-2)、File Search、Code Interpreter 都以 Responses API 內建工具的形式提供 | 原生支援文字、圖片、音訊、影片輸入,全部走同一個 API;圖片輸出用 Nano Banana 系列模型、語音互動用 Live API |
| 語言支援與在地化 | 多語言能力強,中文表現佳 | 多語言也很出色,Google 自家搜尋與翻譯優勢讓在地化更貼近使用情境 |
| 功能彈性與整合 | Responses API 內建 Web Search(US$10/1,000 次)、Computer Use、Remote MCP,生態成熟 | 可直接整合 Google 搜尋:Grounding with Google Search 在 3.x 模型每月 5,000 次免費,適合深度資訊查詢 |
| 上下文長度(token) | GPT-5 為 400K 輸入/128K 輸出;GPT-5.6 家族與 GPT-6 拉到 1.05M | 主線模型 1,048,576 輸入/65,536 輸出,超長文本處理強大 |
| 開發者體驗 | 註冊簡單,API 文件與社群資源豐富,新手上手快 | 到 AI Studio 點一下就有金鑰,還有 Playground 可以先試 prompt;新版 google-genai SDK 支援 Python/Node/Go |
| 價格與免費額度 | 沒有像 Gemini 那種公開的免費層(只有開啟資料分享換每日免費 token 的方案);GPT-5 每百萬 token 輸入 US$1.25/輸出 US$10,gpt-5-mini US$0.25/US$2.00,gpt-5-nano US$0.05/US$0.40 | 有免費層;2.5 Flash-Lite 每百萬 token 輸入 US$0.10/輸出 US$0.40,2.5 Flash US$0.30/US$2.50,3.8 Flash 介紹價 US$0.75/US$3.75 |
| 適合情境 | 想快速打造聊天機器人、處理一般問答、常識性任務,或已經在用 OpenAI 生態的團隊 | 需要多模態輸入、長文本處理、與 Google 生態整合的專案開發,以及想用免費層先驗證想法的人 |
要注意兩邊都已經不是「一個模型打天下」了:OpenAI 那邊 GPT-5 之後還有 GPT-5.2(US$1.75/US$14)、GPT-5.4(US$2.50/US$15)、GPT-5.5(US$5/US$30),一路到 GPT-5.6 家族(gpt-5.6-sol US$4/US$20、-terra US$2/US$12、-luna US$0.20/US$1.20)跟 GPT-6 Astra(US$10/US$50);Gemini 這邊也是 Flash-Lite、Flash、Pro 三種檔次各自有價。比價時請對「同一檔次」比,不要拿 GPT-6 Astra 跟 2.5 Flash-Lite 比價格,那不公平。
總結:如果把 ChatGPT API 和 Gemini API 比喻成兩款飲料,一個是經典可樂(穩定好喝,人人熟悉),另一個是新出的綜合果汁(口味豐富,主打多合一)。哪個好喝?要看你的口味和需求!
若你需要強大的對話和豐富的現有範例,ChatGPT 是穩紮穩打的選擇;但如果你嚮往多模態整合、一杯滿足,而且想省點荷包,Gemini 值得你一試。反正兩家都有各自優勢,身為開發者何不兩邊薅羊毛,把好處都利用起來呢 😎
現在加入 AI 峰哥 LINE,私訊關鍵字「白皮書」
免費領取「人資 AI 實戰指南」,了解生成式 AI 在 HR 四大應用策略與 16 個 Prompt 範例
» 更多推薦:
Gemini API 是免費的嗎?有哪些免費額度?
先說結論:可以,而且 Google 給得不算小氣。
他們設計了一個叫「Free Tier」的長期免費機制——不是那種三天試用完就請你刷卡的套路,而是你每天都有穩定的免費配額可以用,只要你沒濫用,它就會一直免費給你用下去。
免費額度怎麼算?
先講一個 2026 年的大改變:Google 官方的 rate-limits 頁面已經不再列出「每個模型幾 RPM/幾 RPD」的固定表格了。你實際能用多少,要登入 AI Studio 的速率上限儀表板看,而且會依模型、依你的帳戶等級而不同。
- 免費層(Free)只要有專案就有,不用綁信用卡
- 額度單位還是那三個:RPM(每分鐘請求數)、TPM(每分鐘 token 數)、RPD(每天請求數),但實際數字以儀表板為準
- 網路上流傳的「Flash 每分鐘 15 次、每天 1,500 次」這類數字,是舊版官方表或第三方整理,別直接拿來規劃產品;Pro 系列是否還在免費層也請以儀表板為準
另外一個很重要、但很多人沒注意的差別:免費層送進去的資料,Google 會拿來改進產品;付費層則不會。如果你要處理客戶資料、公司內部文件,請直接開付費,不要省那幾塊錢。
對大多數插件、小工具、個人用戶來說,免費層還是夠玩、夠驗證想法的。講白一點:你就算整天坐在那邊丟問題給它,也不會馬上翻臉,只是被限速時會請你等一下。
token 是什麼?我要怎麼知道我用多少?
一個 token 大概是 4 個英文字符、1 個中文字的單位,簡單說你打一段幾百字的提問,再加上 Gemini 回你一段答案,大約會花掉幾百~幾千個 token。
只要你不是在拿它寫十萬字小說、或每天幫一堆人自動生成報告,平常使用是很難用爆的。Google 給得這麼寬容,真的有點像在默默補助開發者學習費。
而且這些免費額度是 每天會自動刷新 的,沒有什麼「只能用 X 天」的限制,基本上你只要不要手滑過量,它就會乖乖供應你每天用到飽。
🚨 什麼時候會開始收費?
當你開始做出一點規模,例如:
- 請求量動輒上千、超過每天上限
- 想要用到速度更快、限制更寬的模型
- 或者你的 app 每天都有一堆使用者在敲它
那時候你就要考慮升級到付費等級了。Google 設計了幾個 Usage Tier(使用層級),目前的升級條件長這樣:
- Free:有專案即可
- Tier 1:把專案綁定帳單帳戶就能升(帳單上限 US$250)
- Tier 2:累計付費滿 US$100,且付費滿 3 天
- Tier 3:累計付費滿 US$1,000,且付費滿 30 天
2026 年 3 月 23 日起,計費方式也改成 Prepay(預付)/Postpay(後付)兩種,細節以官方 billing 頁為準。層級越高,速率上限越寬,同樣是到儀表板看你目前拿到多少。
一旦進入付費,每百萬 token 就會開始算錢(輸入+輸出都會計)。但別怕,通常到你願意付錢的那個程度,你的產品也差不多開始賺錢了。而且有兩招可以省:Batch API 打五折(不急著要答案的批次任務丟這裡),以及 Context caching(預設就是 implicit 自動快取,命中的部分只收大約標準價的 10%)。
免費額度在哪些國家有?
目前台灣是支援地區之一,所以你可以爽爽用免費額度。
如果你剛好在某些不支援的國家或區域(Google 官方有列),那就比較可惜,可能連免費額度都看不到。但放心,大多數國家都在支援範圍內。
Gemini API 有什麼限制?不要一股腦猛刷,小心被擋下來

雖然 Gemini API 功能強大又大方給免費額度,但該有的限制還是有。以下幫你整理幾個容易踩雷的點,早知道早避免:
請求速率限制:不是你想刷幾次就幾次
不管你是免費用戶還是付費等級,用 Gemini 都會被「限速」。簡單說:
- 免費層每個模型的 RPM/TPM/RPD 都不一樣,官方現在不公布固定表,一律到 AI Studio 的速率上限儀表板查你自己的數字
- 付費升級之後,Tier 1 → Tier 2 → Tier 3 逐級放寬,爽度升級,但實際上限同樣以儀表板為準
- 但別得寸進尺,瘋狂刷爆它的話,Google 也會根據你的帳戶信用、使用紀錄來決定給不給你更高的配額
另外,有些模型(像會產圖的 Nano Banana 系列、Imagen)還有限制「每分鐘幾張圖」、「每分鐘幾段影片」這種指標,不是每個模型都一樣,要看你用的是哪一款。
總之,不要手癢一直狂送 API,Google 雖然不會馬上封鎖你,但 Rate Limit 擋你一下也是常有的事。當它叫你休息,你就去喝杯水冷靜一下。
上下文限制(記憶力):不是所有模型都能一次記100萬字
模型的「記憶容量」也是有上限的,專業一點叫 context window。意思是它一次能處理的總字數有極限。
- 早期的 Gemini 1.0 世代大概只有 32K tokens(已退役,現在 API 上找不到了)
- 現役主線模型(2.5 Flash/Pro、3.x Flash、3.1 Pro Preview)輸入上限 1,048,576 tokens,輸出上限 65,536 tokens
- 對照 OpenAI:GPT-5 是 400K 輸入/128K 輸出,GPT-5.6 家族與 GPT-6 才拉到 1.05M,所以 Gemini 在長文本這塊還是很有競爭力
如果你丟的是幾百頁 PDF 或大量對話紀錄,記得選對支援長上下文的模型。不然不是它突然失憶、就是回你錯亂訊息,還會直接給你錯誤訊息說「超過上限囉~」
小提醒:上下文越長,系統運算負擔越高,處理時間越久,計費也會越貴。Pro 系列還有一個門檻:超過 200K token 的請求,輸入輸出單價都會跳一級(例如 2.5 Pro 輸入從 US$1.25 變 US$2.50)。沒必要就不要一口氣餵它長篇小說,對你對它都好。
回應速度:快慢取決於你怎麼用
- 想快,就用 Flash 系列。像 Gemini 2.5 Flash-Lite、3.5 Flash-Lite 或 3.8 Flash,就是為速度和成本優化,回應相對快
- 想準,就選 Pro。像 2.5 Pro 或最新的 3.1 Pro Preview,推理深一點,但跑得沒那麼飛快、也貴不少
影響速度的還有你丟的內容量。簡單幾百字問答,它幾秒就回你;你要它幫你寫十頁報告,或一次分析五萬字,當然會等久一點。
免費跟付費用戶,在模型反應上理論上沒差太多,差的是速率與併發上限。免費層能同時跑的請求數有限,如果你要同時大量丟任務,那還是得升級才撐得住。
其他限制:內容審查、模型預覽、政策規則等等
跟 ChatGPT 一樣,Gemini 也有內建的內容安全規則。
- 遇到違規的 prompt(像是非法用途、敏感主題),它可能直接拒絕回應或請你重寫
- 有些模型還掛著「Preview」標籤,像 3.1 Pro Preview、3 Flash Preview,功能跟價格都可能變動,也可能像 3 Pro Preview 那樣說退役就退役(2026-03-09 換成 3.1 Pro Preview);正式產品建議用 Stable/GA 的版本
- 模型會退役:1.5 系列 2025-09-29 關閉、2.0 Flash/Flash-Lite 2026-06-01 關閉,程式碼裡寫死的模型名記得定期看官方 deprecations 頁
- Batch API 已經有了(價格打五折),微調等其他功能支不支援,要看官方更新
所以在開發前,建議你先花幾分鐘看一下 Google 的官方文件,不要一直靠「試試看」來碰運氣,真的很浪費時間。
🧯 最後提醒(順便嘴一下其他人)
這些限制不是在刁難你,是希望你不要學那些 Reddit 上的悲劇使用者:「我只是想試玩一下,怎麼帳單跳出來幾百美金」 😱 當你還在試驗階段、用免費額度時,請理性使用,設定好配額預警。別傻傻讓外掛暴衝,回過神時 API key 幫你刷了一週的 server 費用。
Gemini 模型這麼多,到底誰適合你?一篇搞懂特色、價格與適用情境

2026 年 9 月更新:這一段原本寫的是 1.0/1.5 世代,全部都已經退役了。以下整張表和各模型介紹,改成以官方定價頁(2026-09-11 更新)為準的現役陣容:穩定版是 2.5 系列,最新是 3.x Flash 系列(3.8 Flash 於 2026-09-02 GA)與 3.1 Pro Preview。
Gemini api 收費表(現役模型,USD/每百萬 token)
| 模型 | 狀態 | 輸入 | 輸出 | 一句話定位 |
|---|---|---|---|---|
| gemini-2.5-flash-lite | Stable | US$0.10 | US$0.40 | 最便宜、跑批次分類標記 |
| gemini-2.5-flash | Stable | US$0.30 | US$2.50 | 穩定版主力,一般應用首選 |
| gemini-2.5-pro | Stable | US$1.25(>200K:US$2.50) | US$10(>200K:US$15) | 穩定版的高階推理 |
| gemini-3-flash-preview | Preview | US$0.50 | US$3.00 | 3 世代 Flash 的預覽版 |
| gemini-3.5-flash-lite | GA(2026-07-21) | US$0.30 | US$2.50 | 3 世代的省錢款 |
| gemini-3.5-flash | GA(2026-05-19) | US$1.50 | US$9.00 | 3 世代 Flash 正式版 |
| gemini-3.6-flash/3.7-flash/3.8-flash | GA(3.8 於 2026-09-02) | US$0.75(介紹價,2027 起 US$1.50) | US$3.75(介紹價,2027 起 US$7.50) | 最新 Flash,介紹價到 2026-12-31 |
| gemini-3.1-pro-preview | Preview(2026-02-19 起) | US$2.00(>200K:US$4.00) | US$12(>200K:US$18) | Pro 線最新、最聰明 |
免費層在你的速率上限之內不收費(哪些模型有開放免費層,以 AI Studio 儀表板為準),付費層才按表計價。表裡的 3.6/3.7/3.8 Flash 介紹價只到 2026 年 12 月 31 日,之後回到 US$1.50/US$7.50,規劃明年預算時記得算進去。
附加功能定價(音訊、圖片、Live、搜尋)
| 項目 | 模型/條件 | 付費方案價格 |
|---|---|---|
| 音訊輸入 | 2.5 Pro/2.5 Flash(約 32 tokens/秒) | US$1.00/每百萬 token |
| Live API(即時語音/影像互動) | gemini-3.1-flash-live-preview | 文字輸入 US$0.75、音訊輸入 US$3.00、文字輸出 US$4.50、音訊輸出 US$12.00(每百萬 token) |
| 圖片生成 | gemini-2.5-flash-image(Nano Banana,2026-10-02 退役) | 每張約 US$0.039 |
| gemini-3.1-flash-image(Nano Banana 2) | 每張約 US$0.067 | |
| gemini-3-pro-image(Nano Banana Pro) | 每張約 US$0.134(4K 約 US$0.24) | |
| Context caching(上下文快取) | 預設 implicit 自動快取 | 快取命中部分約標準價 10% |
| Batch API(批次處理) | 不急著要答案的任務 | 標準價五折 |
| Grounding with Google Search(結合 Google 搜尋) | Gemini 3.x 模型 | 每月 5,000 次免費(各模型共用),超過每 1,000 次 US$14 |
| Gemini 2.5 系列 | 每日 1,500 次(Pro)/500 次(Flash)免費,超過每 1,000 次 US$35 |
別被名字搞混了,「Gemini API」不是只有一個模型,而是一整個「模型家族」。就像手機有旗艦機、平價機、入門機,Gemini 也有從高智商超級AI到低成本批次處理的不同選擇。以下幫你介紹目前 2.5/3.x 世代的主要成員,看你想要速度、精度、還是省錢,有得選。
Gemini 2.5 Flash-Lite:最便宜的入門款,量產任務小天才
這是現在整個家族裡最便宜的雲端模型,也是官方快速入門文件裡 cURL 範例預設用的那一支。理解力不是最強,但也不太吃資源。
- 狀態:Stable(穩定版)
- 價格:輸入 US$0.10/輸出 US$0.40 每百萬 token
(翻譯:便宜到你會懷疑它是不是在做慈善)
👉 如果你只要跑分類、標記、結構化資料處理,不求回答多有深度,它就是最划算的入門量產工具,想先試水溫、不想一開始就爆預算的話,從這支開始準沒錯。
Gemini 2.5 Flash:穩定版主力,什麼都能做一點
這是很多人現在第一次正式上線用的版本。它強調「均衡」,寫文案、改語句、摘要重點、做分類,幾乎都能勝任,而且是穩定版,不用擔心哪天 API 突然改名。
- 狀態:Stable(穩定版),音訊輸入另計 US$1.00/每百萬 token
- 價格:輸入 US$0.30/輸出 US$2.50 每百萬 token,便宜又穩定
👉 適合拿來做內容生成器、聊天機器人、客服助手,要即時對話系統、大量生成任務、或低成本部署,選它荷包會感謝你。
Gemini 2.5 Pro:穩定版的高智商,長文件與複雜邏輯的好夥伴
這是 2.5 家族的「老大哥」,專門處理高難度任務,例如複雜邏輯推理、長文件分析、程式碼輔助、企業級知識系統。聰明但貴。
- 狀態:Stable(穩定版)
- 價格:輸入 US$1.25/輸出 US$10 每百萬 token;單次請求超過 200K token 時跳到 US$2.50/US$15
- Grounding with Google Search 每日 1,500 次免費(超過每 1,000 次 US$35)
👉 不是真的需要它的高智商就先別急著用,除非你真的在處理不能出錯、需要深度推理的任務,不然 Flash 就很夠用。
Gemini 3.x Flash 系列:最新世代,介紹價撐到年底
Gemini 3 是 2025 年 11 月登場的新世代,到 2026 年已經迭代到 3.8。Flash 這條線更新得很勤,目前 API 上同時有好幾支:
- gemini-3.8-flash(2026-09-02 GA)、3.7 Flash、3.6 Flash:輸入 US$0.75/輸出 US$3.75 每百萬 token,這是介紹價,2026-12-31 之後回到 US$1.50/US$7.50
- gemini-3.5-flash(2026-05-19 GA):輸入 US$1.50/輸出 US$9.00
- gemini-3.5-flash-lite(2026-07-21 GA):輸入 US$0.30/輸出 US$2.50,3 世代的省錢款
- gemini-3-flash-preview:輸入 US$0.50/輸出 US$3.00,還是 Preview
- 3.x 全系列的 Grounding with Google Search 每月共用 5,000 次免費,超過每 1,000 次 US$14
👉 想用最新能力、又不想付 Pro 價格,3.8 Flash 是現在的甜蜜點;但別忘了介紹價有期限,寫預算時用回歸價算比較保險。
Gemini 3.1 Pro Preview:Pro 線最新,高智商的天龍人
這隻是目前 Pro 線最聰明的一支,2026-02-19 上線,取代了 2026-03-09 退役的 3 Pro Preview。名字裡還掛著 Preview,意思是功能與價格都可能再變。
- 狀態:Preview
- 價格:輸入 US$2.00/輸出 US$12 每百萬 token;超過 200K token 時 US$4.00/US$18
👉 如果你要處理長文件、複雜邏輯、程式碼輔助,而且想要最強的推理,選它;但正式產品建議等 Stable 版,或至少把模型名做成設定檔,退役時好換。
Gemini Nano:模型變小,跑進手機裡的 AI
這是 Google 為行動裝置設計的小模型,名字很可愛但用法不一樣:
- 跑在本地,不靠雲端,不經 API
- 有 Nano-1 跟 Nano-2,參數數量很迷你(不到 33 億)
👉 你手機裡的 AI 可能就是 Nano,但對開發者來說,它比較像是硬體方案,不是你打 API 就能玩的東西。
歷史小教室:1.0、1.5、2.0 都去哪了?Ultra 又是什麼?
如果你 Google 到的教學還在講 Gemini 1.0 Pro、1.5 Pro、1.5 Flash、1.5 Flash-8B、2.0 Flash,那是舊資料,這些模型全都已經退役:
- Gemini 1.0 Pro/1.0 Ultra:早已不存在於 API
- Gemini 1.5 Pro/Flash/Flash-8B:2025-09-29 關閉
- Gemini 2.0 Flash/Flash-Lite:2026-06-01 關閉
- Gemini 3 Pro Preview:2026-03-09 退役,由 3.1 Pro Preview 接手
另外要澄清一個常見誤會:現在講「Ultra」,指的是 Google AI Ultra 訂閱方案(2025 年 5 月 I/O 推出的消費者方案),API 上並沒有叫 Ultra 的模型。想要最強推理,請看 Pro 線。
小提醒:多模態模型計費也會包含圖片/影音
你丟進去的圖片、音訊、影片都會換算成 token 一起計費(音訊在 2.5 Pro/Flash 是 US$1.00/每百萬 token,大約 32 tokens/秒)。而「產圖」是另外的模型、另外按張計價:gemini-2.5-flash-image(Nano Banana)每張約 US$0.039,但這支 2026-10-02 就要退役;接手的是 gemini-3.1-flash-image(Nano Banana 2)每張約 US$0.067,以及 gemini-3-pro-image(Nano Banana Pro)每張約 US$0.134、4K 約 US$0.24。
小結:怎麼選?
| 模型 | 特色 | 價格級距 | 適合誰 |
| 2.5 Flash-Lite | 最低成本、應急夠用 | 🌟 幾乎免費 | 簡單分類、大量實驗 |
| 2.5 Flash | 穩定萬用、CP 值高 | ★ | 一般應用、入門首選 |
| 2.5 Pro | 穩定版長記憶+高智慧 | ★★★ | 文件分析、邏輯處理 |
| 3.5 Flash-Lite/3.8 Flash | 最新世代、介紹價到年底 | ★~★★ | 想用新能力又想省的人 |
| 3.1 Pro Preview | 最強推理、還在 Preview | ★★★★ | 專案不能出錯的你(但要能接受版本變動) |
| Nano | 在地裝置小助手(非 API) | — | 離線、手機應用開發 |
結語:拿到鑰匙只是開始,真正有趣的是你會怎麼用
所以說,Gemini API 不只是「能用」,而是「超值得玩」。從你註冊拿到那串 API 金鑰開始,就像打開了一扇通往 AI 實驗室的大門——你可以從小工具開始玩起,也可以一步步打造出屬於你的超強工作流。
你要它幫你寫文、寫程式、看圖、回答問題都沒問題,甚至還能挑模型口味:要快的、有,要聰明的、有,要便宜又能跑批量任務的?也有。加上每天送你一批免費額度,根本就像 Google 在默默幫你養副駕駛。
當然啦,不是每個模型都適合每一個場景,也不是免費就可以為所欲為。但只要你懂得選對工具,調整用法,Gemini 絕對能在你的 AI 工具箱裡佔一席之地,甚至變成主力。
未來它還會不斷進化(光是 2026 年就從 3 Pro Preview 換到 3.1、Flash 跑到 3.8),你也可以一路跟著升級。現在開始玩,總比等別人玩熟了你才跟進來得精彩。
那你呢?要用 Gemini 幫你跑什麼任務?不如現在就打開 AI Studio,試看看它第一句會回你什麼吧。😏
需要針對“公司產業特性”與“實際流程”設計的 AI 課程嗎?需要 AI 補助課程嗎?
如果需要專業講師針對公司產業特性與實際流程設計課程,或者諮詢企業數位課程補助,
建議直接聯繫 AI 峰哥(黃敬峰老師),他擅長依照你想學的特定主題,為個人或企業團隊量身規劃課程內容,甚至從頭到尾負責課程設計、工具選型、流程建議與實際部署。他不只是工具教學者,更會從策略整合、落地流程等面向出發,協助企業建立客製化培訓方案 。
課程介紹與學員課程評價/心得 👉 https://peaker.com.tw/ai
🦾 AI 峰哥過去累積超過 500 小時教學時數,合作過華碩、台灣理光、南山人壽、裕隆、TOYOTA 等企業,專長涵蓋 AI 工具應用、流程自動化到企業內部導入策略等領域 。他的工作坊教學氛圍強調小組互動與實作對話,能促進團隊成員分享使用 AI 的思維與效率提升方式。
AI 峰哥 LINE 諮詢
參考資料
- Gemini API quickstart
Google 官方的入門教學頁,說明如何申請 API 金鑰、安裝 SDK,以及基本使用範例(含本文的 cURL 範例)。 - Gemini API pricing
Gemini API 官方定價頁(本文價格表依 2026-09-11 版本),列出各模型的 token 費率、Grounding、圖片生成、Live API 等附加功能價格。 - Gemini models
列出目前 API 可用的 Gemini 模型(2.5 系列、3.x Flash 系列、3.1 Pro Preview 等),每個模型的特性、輸入上限與用途。 - Gemini API libraries
官方 SDK 清單(google-genai/@google/genai/Go),以及舊版 SDK 2025-11-30 起停止維護的說明。 - Rate limits、Billing
速率上限與 Usage Tier 說明;實際額度到 AI Studio 儀表板查看。 - Deprecations、Migrate to the Interactions API
模型退役時程(1.5/2.0/3 Pro Preview),以及 generateContent 轉 Interactions API 的官方指南。 - OpenAI API pricing
OpenAI 官方定價頁,本文 GPT-5 系列價格與 context 長度的來源。 - Generative AI pricing on Vertex AI
Google Cloud 官方價格頁面,走 Vertex AI(企業版)路線的話看這份。 - Gemini 1.5 technical report(歷史資料)
Google DeepMind 發布的 1.5 模型技術白皮書;1.5 系列已於 2025-09-29 退役,僅供了解長上下文架構的演進。 - Comparing Gemini 1.5 Pro with GPT-4(歷史資料)
Google 官方部落格文章,當年 1.5 Pro 與 GPT-4 的基準測試比較;兩邊模型都已被 2.5/3.x 與 GPT-5 系列取代。











