共 470 篇報道,現顯示第 241–260 篇(第 13 / 24 頁)

16萬星開源項目:Stable Diffusion WebUI 一鍵本地 AI 繪圖

16萬星開源項目:Stable Diffusion WebUI 一鍵本地 AI 繪圖

2026-09-03

Stable Diffusion WebUI 是 GitHub 累積 16.4 萬星的開源 AI 繪圖網頁介面,以 Gradio 建構,支援文字生圖、圖片生圖、局部重繪、Textual Inversion 與 LoRA 訓練,最低 4GB 顯示卡即可本機運行,提供一鍵安裝與超過百款社群擴充功能,是本地部署 AI 繪圖的標準工具。

閱讀 →
Claude 電腦操作新增背景模式 macOS 用戶可多工處理

Claude 電腦操作新增背景模式 macOS 用戶可多工處理

2026-09-03

Anthropic 宣佈 Claude 的電腦操作功能新增 macOS 背景執行模式,Pro 與 Max 用戶可讓 Claude 在背景自動操作應用程式,同時繼續處理自己的工作。這項升級將 AI 代理從佔用滑鼠的互動模式,轉變為真正可並行的多工助手,對開發者與知識工作者帶來實際效率提升。

閱讀 →
Grok-1 全面開源:314B 參數 MoE 權重釋出

Grok-1 全面開源:314B 參數 MoE 權重釋出

2026-09-03

xAI 開源 314B 參數 MoE 模型 Grok-1 的完整權重,採 Apache 2.0 授權,GitHub 逾 5.2 萬星,是大廠開放權重的標誌性事件。本文分析其模型規格、JAX 推理架構與開源生態影響,並提供下載指引,適合關注自托管 LLM 與開源 AI 策略的開發者。

閱讀 →
Ollama 開源 18 萬星:本地模型工具如何變成 AI Agent 中樞?

Ollama 開源 18 萬星:本地模型工具如何變成 AI Agent 中樞?

2026-09-03

開源項目 Ollama 以超過 17.9 萬顆星標成為本地 AI 部署的事實標準,從一指令運行大型語言模型的執行工具,進化為可連接 Claude Code、Codex、Copilot 等編程 Agent 的中樞。本文深入分析其技術架構、Agent 中樞功能、模型生態與社群規模,並提供實際部署建議,協助讀者規劃本地 AI 方案。

閱讀 →
Anthropic 開源 Claude Code 外掛目錄:35.8k 星

Anthropic 開源 Claude Code 外掛目錄:35.8k 星

2026-09-03

Anthropic 官方開源 Claude Code 外掛目錄,收錄內部開發與第三方合作夥伴的高品質外掛,涵蓋程式碼審查、LSP 語言伺服器整合、專案管理與技能捆綁等功能,提供官方託管、經安全審核的單一安裝來源,並採用 Apache 2.0 許可證,一鍵即可在 Claude Code 內安裝使用。

閱讀 →
Google Pics 登場:AI 生成式設計工具挑戰 Canva

Google Pics 登場:AI 生成式設計工具挑戰 Canva

2026-09-03

Google 推出全新 AI 影像生成與編輯工具 Google Pics,採用 Nano Banana 模型,內建於 Google Workspace,於 Docs 與 Slides 上線並擴展至 Drive。支援物件隔離變換、圖內文字修改與多版本生成,並整理與 Canva、Adobe Express 的定位差異。

閱讀 →
Cherry Studio 開源:51K 星標的 AI 桌面客戶端

Cherry Studio 開源:51K 星標的 AI 桌面客戶端

2026-09-03

Cherry Studio 是擁有 51,363 星標的開源 AI 桌面客戶端,支援 OpenAI、Gemini、Anthropic 等多間大型語言模型供應商,內建 300 多款預設 AI 助手、文件處理與 MCP 伺服器整合,提供 Windows、Mac 與 Linux 三平台一站式 AI 生產力方案。

閱讀 →
Gemini Omni 1.1 Flash:影片生成新增 4K 與場景延伸

Gemini Omni 1.1 Flash:影片生成新增 4K 與場景延伸

2026-09-02

Google DeepMind 推出 Gemini Omni 1.1 Flash,經由 Gemini API 與 Google AI Studio 開放生成式影片功能。新版本支援場景延伸至總長 40 秒、360p 草稿快 60%、成本僅三分之一,並新增 4K 輸出。本文整理新功能細節與對開發者的影響。

閱讀 →
Qwen3 開源:阿里巴巴 235B MoE 模型登頂開源推理

Qwen3 開源:阿里巴巴 235B MoE 模型登頂開源推理

2026-09-02

阿里巴巴 Qwen 團隊開源 Qwen3 系列大語言模型,涵蓋 0.6B 至 235B-A22B 多種規模,支援思考與非思考模式切換、256K 長上下文擴展至 100 萬 tokens,並以 Apache 2.0 授權釋出。本文分析其架構創新、生態支援與部署路徑,值得開發者留意。

閱讀 →
OpenAI Astra 首個 Critical 級模型:網絡攻擊能力達標

OpenAI Astra 首個 Critical 級模型:網絡攻擊能力達標

2026-09-02

OpenAI 宣布其新一代模型 Astra 成為旗下首個網絡安全能力達到 Critical 門檻的模型,在 Preparedness Framework 下被認定能自主發掘未知漏洞並開發攻擊鏈。公司在評估中發現 Astra 能建立完整的瀏覽器逃逸鏈與本機權限提升鏈,同時在防禦性安全措施上亦領先前代模型。

閱讀 →
Meta 推 Muse Voice Transcribe:即時語音轉錄模型

Meta 推 Muse Voice Transcribe:即時語音轉錄模型

2026-09-02

Meta 推出首個即時音訊感知模型 Muse Voice Transcribe,提供多語言串流語音轉錄、20 位以上說話者辨識與自動斷句,以每千分鐘 3 美元開放予開發者使用。模型以超過 70 種語言訓練,已內建於 Meta AI for Mac 與 Muse Code,Mac 用戶按住 Fn 鍵即可在任意應用程式聽寫。

閱讀 →
Gemini 推出 Agentic Video:長影片理解成本大減

Gemini 推出 Agentic Video:長影片理解成本大減

2026-09-02

Google DeepMind 推出 Agentic Video 影片理解功能,讓 Gemini 3.7 Flash 等模型以更少 token 分析長影片,支援次秒級時刻檢索、異常偵測與動作計數,開發者可透過 Gemini API 設定 processing 參數啟用,費用沿用標準 token 定價。

閱讀 →
Anthropic 推出 Claude Fable 5.1:代理任務成本大減 45%

Anthropic 推出 Claude Fable 5.1:代理任務成本大減 45%

2026-09-02

Anthropic 於 2026 年 9 月推出 Claude Fable 5.1,這是 Mythos 級別的最新旗艦模型,重點在於大幅降低代理式任務的運行成本。官方表示典型工作量下成本較 Fable 5 減少約 25%,高度代理化工作最多可節省約 45%,同時在編碼、知識工作與長期問題解決任務上表現更佳。

閱讀 →
SGLang 開源推理框架:每秒萬億 Token 的 AI 服務引擎

SGLang 開源推理框架:每秒萬億 Token 的 AI 服務引擎

2026-08-31

SGLang 是 LMSYS 旗下高效能大語言模型推理框架,全球超過 40 萬顆 GPU 部署,每日生產萬億級 Token,獲 xAI、NVIDIA、Cursor 等企業採用。本文解析 RadixAttention、推斷解耦、推測解碼等核心技術與市場影響力,是了解開源 AI 推理基礎設施現況的完整指南。

閱讀 →
Meta 測試數據中心機器人:傳可取代 80% 員工工作量

Meta 測試數據中心機器人:傳可取代 80% 員工工作量

2026-08-31

Meta 正低調測試能插線、重啟伺服器的數據中心機器人,供應商包括 Watney Robotics、Kinova 與 ABB。有數據中心員工估計,一旦成功機器人可取代部分人員最多 80% 的工作量,衝擊基礎設施維運人力生態。本文拆解測試細節、產業背景與對就業結構的影響。

閱讀 →
Anthropic 推硬件標準:讓 AI 代理控制實體設備

Anthropic 推硬件標準:讓 AI 代理控制實體設備

2026-08-31

Anthropic 發佈 Model Hardware Standard(MHS)研究預覽:一套標準化驅動介面,讓 AI 代理透過 MCP 控制任意實體設備,實驗設備整合時間從數週縮短至數小時,未來計劃開源並與 AWS、Hugging Face、Raspberry Pi 等合作。本文拆解 MHS 原理、應用場景與生態影響。

閱讀 →