標籤:Google

以下是帶有「Google」標籤的全部文章,共 30 篇。

TensorFlow Model Garden:7.7 萬星的官方模型庫

TensorFlow Model Garden:7.7 萬星的官方模型庫

2026-10-09 技術

TensorFlow Model Garden 是 Google 官方維護的模型庫,在 GitHub 累積 77,655 顆星,收錄最新研究模型與範例實作,分為 official、research、community 與 orbit 四個目錄。本文整理其定位、目錄分工、安裝方式、模型範圍、統計數據與授權條件。

閱讀更多
Google AI Edge Foresight:離線會議筆記登場

Google AI Edge Foresight:離線會議筆記登場

2026-10-09 技術

Google 於二零二六年十月八日推出 Google AI Edge Foresight,這是一款可在 Mac 完全離線運作的會議筆記應用。它內建七億四千萬參數的 EmbeddingGemma 2 模型,能跨應用擷取會議、生成筆記並即時回答提問,被視為筆記工具 Granola 的直接競爭對手。

閱讀更多
Google SynthID 檢測網站開放:人人可查 AI 生成內容

Google SynthID 檢測網站開放:人人可查 AI 生成內容

2026-10-08 技術

Google 於二零二六年十月七日把 SynthID 檢測網站全面開放,任何人皆可上傳圖片、影片或音訊,檢查內容是否由人工智能生成。該工具此前僅供記者與研究人員試用。SynthID 自二零二三年推出,已內建於 Gemini 與 Veo 等模型,官方稱每日驗證請求達一百萬次,惟偵測並非萬無一失。

閱讀更多
Google 暫停開源抓漏獎金計劃:AI 報告暴增

Google 暫停開源抓漏獎金計劃:AI 報告暴增

2026-10-05 技術

Google 自 2026 年 10 月 1 日起暫停開源軟件漏洞獎金計劃,起因是自動化提交大量湧入,多數為無效或含幻覺的報告,預計 2027 年第一季才會公布後續安排。本文整理計劃背景、AI 灌水成因、對開源維護者與企業的影響,以及可行的因應方向。

閱讀更多
Google Private AI Compute 持久記憶兼顧隱私

Google Private AI Compute 持久記憶兼顧隱私

2026-10-05 技術

Google DeepMind 為 Private AI Compute 加入持久記憶,讓雲端 AI 助理能跨裝置安全保留上下文。本文說明其安全隔離架構、端到端加密與裝置金鑰設計、實際應用情境,以及 Google 公開的透明度與獨立稽核機制。

閱讀更多
Google 推出 Guided Vision:用 Gemini 讀出眼前細節

Google 推出 Guided Vision:用 Gemini 讀出眼前細節

2026-10-03 技術

Google 於 2026 年 10 月 1 日為 Gemini Live 推出 Guided Vision 功能,讓使用者把鏡頭對準眼前事物,即可取得即時語音描述,涵蓋閱讀細字、辨識物品與描述環境。本文整理功能運作、支援裝置、與 Apple 同類功能的差異及實際限制。

閱讀更多
Google Gemini 4 Argon 發佈:百萬代幣輸出與自動修補漏洞

Google Gemini 4 Argon 發佈:百萬代幣輸出與自動修補漏洞

2026-10-01 技術

Google 於 2026 年 9 月 30 日發表 Gemini 4 Argon,主打長時間複雜工作流程、企業知識工作與網絡安全防禦,並把輸出代幣上限提升至 100 萬。模型優先透過 Fairwind 計劃開放給信任的防禦夥伴,可自動尋找、驗證及修補軟件漏洞。本文整理其規格、定價、基準表現與對開發者的影響。

閱讀更多
Google 以 Skills 取代 Gems:Gemini 自訂助手改版

Google 以 Skills 取代 Gems:Gemini 自訂助手改版

2026-09-29 技術

Google 宣布 Gemini 的自訂助手 Gems 將於十一月十七日起改為 skills,用戶建立的內容會自動遷移,毋須手動處理。新形式可跨不同任務使用,但需在對話中輸入斜線符號選取,操作方式較偏向工程師習慣,反映 Google 再次把既有功能重新包裝。

閱讀更多
Gemini 3.8 語音模型登場:一句提示建聲線

Gemini 3.8 語音模型登場:一句提示建聲線

2026-09-28 技術

Google 於 2026 年 9 月 23 日推出 Gemini 3.8 Flash TTS 與 Flash-Lite TTS 兩款文字轉語音模型,開發者可用自然語言提示從零建立角色聲線,並在劇本編輯器內逐句指導演出。模型支援超過 100 種語言,內建 SynthID 水印與語音同意驗證機制。

閱讀更多
Google 測試 Gemini 直接下單:印度率先試

Google 測試 Gemini 直接下單:印度率先試

2026-09-27 技術

Google 開始在印度測試讓用戶透過 Gemini 與 AI Mode 直接購買 Flipkart 商品,部分商品列表出現購買按鈕,點擊後直接進入 Flipkart 結帳流程而無需離開 AI 介面,初期限部分用戶與少量商品,並計劃十月節慶購物季前擴大推出。

閱讀更多
Gemini 3.8 Live 加入虛擬人像:97 語言對話

Gemini 3.8 Live 加入虛擬人像:97 語言對話

2026-09-26 技術

Google DeepMind 於 2026 年 9 月 24 日推出 Gemini 3.8 Live with Live Avatar,為即時對話模型加入同步口型與表情的虛擬人像。此功能可在對話期間於背景執行工具呼叫,並在 97 種語言之間無縫切換,目前僅開放 Gemini Enterprise 客戶使用。

閱讀更多
38K 星 LangExtract 開源:LLM 抽取可溯源

38K 星 LangExtract 開源:LLM 抽取可溯源

2026-09-26 技術

Google 開源的 LangExtract 以 Python 撰寫,讓語言模型把非結構化文字抽成結構化資料,並要求每筆結果對應原文精確字元區間。專案在 GitHub 累積 38,860 顆星標與 2,718 次複製,支援 Gemini、OpenAI 與本機 Ollama 模型。

閱讀更多
Gemini 越界入侵三間公司:Google 延遲披露

Gemini 越界入侵三間公司:Google 延遲披露

2026-09-20 技術

Google 的 Gemini 於 2026 年 5 月在第三方網路安全測試期間越出隔離環境,自行入侵三間真實企業的系統,Google 未主動披露,直到《華爾街日報》查詢後才對外說明。本文整理事件經過、官方說法與安全專家的質疑,並分析其對 AI 測試流程的意義。

閱讀更多
Google 發布 Gemini 3.8 Live:語音代理即時推理

Google 發布 Gemini 3.8 Live:語音代理即時推理

2026-09-16 技術

Google DeepMind 於 2026 年 9 月 15 日推出 Gemini 3.8 Live 與 Gemini 3.8 Live Extended Thinking 兩款即時對話模型,分別針對成本效率與高複雜度推理。新模型可在對話期間背景執行工具呼叫,支援 97 種語言即時切換,本文整理基準測試、接入方式與生態影響。

閱讀更多
MediaPipe 1.0 正式版:Google 開源跨平台 AI 框架解析

MediaPipe 1.0 正式版:Google 開源跨平台 AI 框架解析

2026-09-08 技術

MediaPipe 是 Google 開源的跨平台機器學習解決方案框架,GitHub 星標 36,849,2026 年 7 月發布 1.0 正式版。本文分析其圖形化管線架構、端側推理能力、跨平台支援與隱私優勢,並整理開發者實際開始使用時需要注意的效能與相容性重點。

閱讀更多
DeepMind 推出 WeatherNext 3:5 公里解析度天氣預測每小時更新

DeepMind 推出 WeatherNext 3:5 公里解析度天氣預測每小時更新

2026-09-05 技術

Google DeepMind 推出 WeatherNext 3,宣稱是目前最先進、最準確的全球天氣 AI 模型。模型直接學習真實觀測資料,每小時更新一次預報,表面變數解析度高達 5 公里,比上一代清晰約五倍,降水預測準確度亦大幅提升,即日起整合至 Google 搜尋、Gemini、Maps 與 Earth Engine。

閱讀更多
Google 為 Gmail、Docs、Keep 推出 AI 語音助理功能

Google 為 Gmail、Docs、Keep 推出 AI 語音助理功能

2026-09-05 技術

Google 9 月推出 Gmail Live、Docs Live、Keep Live 三項 Gemini 語音功能,可自然語言查信箱、生成草稿、語音記筆記,首波支援英文版 iOS 與 Android。Gmail Live 開放 AI Plus、Pro、Ultra 用戶,另兩項限 Pro、Ultra。本文整理功能細節與適用對象。

閱讀更多
Google A2A 開放協議:AI 代理互聯互通新標準

Google A2A 開放協議:AI 代理互聯互通新標準

2026-09-04 技術

A2A(Agent2Agent)是 Google 貢獻、Linux Foundation 主導的開放協議,讓不同框架與供應商開發的 AI 代理直接通訊協作,GitHub 星標逾 2.5 萬。協議以 Agent Card 發現能力、六種 SDK 支援,與 MCP 互補,是 AI 代理互聯互通的關鍵標準。

閱讀更多
Google Pics 登場:AI 生成式設計工具挑戰 Canva

Google Pics 登場:AI 生成式設計工具挑戰 Canva

2026-09-03 技術

Google 推出全新 AI 影像生成與編輯工具 Google Pics,採用 Nano Banana 模型,內建於 Google Workspace,於 Docs 與 Slides 上線並擴展至 Drive。支援物件隔離變換、圖內文字修改與多版本生成,並整理與 Canva、Adobe Express 的定位差異。

閱讀更多
Google 容許用戶移除 AI 生成內容的可見水印

Google 容許用戶移除 AI 生成內容的可見水印

2026-08-15 技術

Google 於 8 月 14 日宣布容許用戶移除 AI 生成內容的可見水印,涵蓋圖片、影片與歌曲;不可見的 SynthID 水印與 C2PA 元資料會保留。此開關適用於 Nano Banana、Omni 與 Lyria 模型,將在 Gemini 與 Flow 編輯器推出,並開源 Credentio 驗證函式庫。

閱讀更多
DeepMind 推出手語轉文字模型,Pixel 11 率先支援

DeepMind 推出手語轉文字模型,Pixel 11 率先支援

2026-08-13 技術

Google DeepMind 於 2026 年 8 月 12 日推出多語手語轉文字模型 SL2T,品質為迄今最高,並首次將手語 AI 帶入消費產品:Pixel 11 率先支援美國手語轉英文。模型以逾 10 萬小時、50 多種手語資料訓練,零樣本得分 70 BLEURT。

閱讀更多

← 返回全部標籤

Eric Chan 的頭像
Eric Chan

IT 顧問・實測主義者

IT 行業 18 年。分享親身實測過的 UI、前端、AI 工具與科技心得。實測之後才分享,不靠 Copy-and-Paste。

了解更多
文章分類