這個版本在做什麼
Gemini CLI 是 Google 的命令列 AI 工具,定位類似 Anthropic 的 Claude Code——讓開發者在終端機裡直接與 AI 協作開發。v0.42.0 在 2026 年 5 月 12 日發布,這次更新同步推進了三個方向:語音輸入、持久記憶、模型擴充。
單看任何一項都不算革命性,但三條線同時推進,顯示 Google 正在快速補齊 CLI AI 工具的核心功能。以下逐項說明。
語音模式:從實驗到正式 UI
v0.42.0 對語音輸入做了三個層面的更新,合在一起代表語音功能從原型狀態升格為正式功能:
麥克風 icon + 波形動畫
輸入框加入麥克風按鈕,錄音時顯示波形動畫。使用者知道系統在聽,也知道什麼時候結束。
語音轉文字插入游標位置
語音辨識的文字會插入目前游標位置,而不是附加到最後。可以先打一半再用語音補充。
Gemini Live backend
使用 Gemini Live 作為語音辨識後端,啟用前會顯示隱私說明。音訊資料送到 Google 伺服器處理。
雲端依賴,非本地
語音辨識依賴 Gemini Live API,需要網路連線,且受 Google 隱私政策規範。離線環境無法使用。
對比 Claude Code 目前沒有原生語音輸入,Gemini CLI 在這個方向走得更快。適合雙手佔用、或需要快速口述指令的工作情境。
Auto Memory:AI 開始自動記住你
v0.42.0 加入了 Auto Memory inbox flow,採用 canonical-patch contract 設計:AI 在對話中偵測到值得記住的資訊時,會產生一個「記憶草稿」送進 inbox,使用者確認後才真正寫入持久記憶。
這個設計跟 Claude Code 的 auto memory 系統理念相同:AI 主動整理記憶,人工確認後生效,避免記憶雜訊累積。兩個 CLI 工具在 2026 年幾乎同步做了相似的記憶系統。
從開發者角度看,Auto Memory 解決的核心問題是「每次 session 重新交代背景」的摩擦:你的技術偏好、專案約定、常用設定,AI 記住一次之後就不需要再說。
v0.42.0 同時修了 Skills inbox dialog 的顯示問題(在 alternate buffer 下的滾動和適應),讓記憶管理的 UI 更可用。
Gemma 4 預設啟用
透過 Gemini API,Gemma 4 系列模型現在預設可用,不需要額外設定。Gemma 是 Google 的開放權重模型,Gemma 4 是最新版本,在推理能力和指令追蹤上有明顯提升。
對 Gemini CLI 使用者的實際意義:可以在 CLI 裡直接切換使用 Gemma 4,不需要單獨架設本地推理環境。適合想用開放模型但不想維護本地部署的工作流。
同次更新也修正了 fallback chain 邏輯:當首選模型不可用時,自動 fallback 的選擇和嘗試次數現在行為更一致,區分了「自動 fallback」和「明確指定模型的重試」兩種情境。
使用體驗細節修正
這個版本有幾個值得注意的 UX 改善,雖然不是主要功能,但影響日常使用流暢度:
/exit --delete 旗標 — 退出 session 時可以同時刪除 session 記錄,方便清理暫時性的工作 session。/commands list 子指令 — 列出所有可用指令,方便探索功能。--ignore-env 旗標 — 忽略本地 .env 檔案,適合 CI/CD 環境或需要隔離環境變數的場景。和 Claude Code 比:差距在縮小
Gemini CLI 和 Claude Code 是目前最主要的兩個 AI 開發 CLI 工具。v0.42.0 的 Auto Memory 和「壓縮期間繼續輸入」這兩個功能,Claude Code 都已經有了——Gemini CLI 在快速追齊。
語音輸入是 Gemini CLI 目前的差異化點,Claude Code 目前沒有內建語音輸入。如果你的工作流需要語音指令,這個版本的 Gemini CLI 值得試試。
模型選擇上,Gemini CLI 現在可以跑 Gemma 4(開放權重);Claude Code 鎖定 Anthropic 模型。對需要開放模型的企業或開發者,這是實質的差異。