Google 開源 EmbeddingGemma 2:740M 多模態嵌入模型
2026-10-08 技術
Google DeepMind 於十月六日發布 EmbeddingGemma 2,一款原生支援文字、圖像、音訊與影片的開源嵌入模型,採 Apache 2.0 授權,具備七億四千萬參數。它建基於 Gemma 4,文字工作負載最低只需二億七千萬參數,並以 Matryoshka 學習把向量截斷至 128 維。
閱讀更多以下是帶有「Google DeepMind」標籤的全部文章,共 4 篇。
2026-10-08 技術
Google DeepMind 於十月六日發布 EmbeddingGemma 2,一款原生支援文字、圖像、音訊與影片的開源嵌入模型,採 Apache 2.0 授權,具備七億四千萬參數。它建基於 Gemma 4,文字工作負載最低只需二億七千萬參數,並以 Matryoshka 學習把向量截斷至 128 維。
閱讀更多
2026-09-02 技術
Google DeepMind 推出 Gemini Omni 1.1 Flash,經由 Gemini API 與 Google AI Studio 開放生成式影片功能。新版本支援場景延伸至總長 40 秒、360p 草稿快 60%、成本僅三分之一,並新增 4K 輸出。本文整理新功能細節與對開發者的影響。
閱讀更多
2026-09-02 技術
Google DeepMind 推出 Agentic Video 影片理解功能,讓 Gemini 3.7 Flash 等模型以更少 token 分析長影片,支援次秒級時刻檢索、異常偵測與動作計數,開發者可透過 Gemini API 設定 processing 參數啟用,費用沿用標準 token 定價。
閱讀更多
2026-08-15 技術
Google DeepMind 8 月 13 日推出 Gemini 3.7 Flash,是 Flash 系列最智能的編程與代理模型,FrontierCode 基準大幅超越 3.6 Flash,輸入定價減半至每百萬 Token 0.75 美元,Gemini Spark 即日採用,開發者可經 AI Studio 使用。
閱讀更多