16萬星開源項目:Stable Diffusion WebUI 一鍵本地 AI 繪圖
2026-09-03
Stable Diffusion WebUI 是 GitHub 累積 16.4 萬星的開源 AI 繪圖網頁介面,以 Gradio 建構,支援文字生圖、圖片生圖、局部重繪、Textual Inversion 與 LoRA 訓練,最低 4GB 顯示卡即可本機運行,提供一鍵安裝與超過百款社群擴充功能,是本地部署 AI 繪圖的標準工具。
閱讀 →共 470 篇報道,現顯示第 241–260 篇(第 13 / 24 頁)
2026-09-03
Stable Diffusion WebUI 是 GitHub 累積 16.4 萬星的開源 AI 繪圖網頁介面,以 Gradio 建構,支援文字生圖、圖片生圖、局部重繪、Textual Inversion 與 LoRA 訓練,最低 4GB 顯示卡即可本機運行,提供一鍵安裝與超過百款社群擴充功能,是本地部署 AI 繪圖的標準工具。
閱讀 →
2026-09-03
Anthropic 宣佈 Claude 的電腦操作功能新增 macOS 背景執行模式,Pro 與 Max 用戶可讓 Claude 在背景自動操作應用程式,同時繼續處理自己的工作。這項升級將 AI 代理從佔用滑鼠的互動模式,轉變為真正可並行的多工助手,對開發者與知識工作者帶來實際效率提升。
閱讀 →
2026-09-03
xAI 開源 314B 參數 MoE 模型 Grok-1 的完整權重,採 Apache 2.0 授權,GitHub 逾 5.2 萬星,是大廠開放權重的標誌性事件。本文分析其模型規格、JAX 推理架構與開源生態影響,並提供下載指引,適合關注自托管 LLM 與開源 AI 策略的開發者。
閱讀 →
2026-09-03
Google DeepMind 於 2026 年 9 月 2 日發布 Gemini 3.8 Flash 與 3.8 Flash Cyber,六週內第三款 Flash 模型。3.8 Flash 推理與程式碼大幅超越前代,每百萬 token 0.75...
閱讀 →
2026-09-03
開源項目 Ollama 以超過 17.9 萬顆星標成為本地 AI 部署的事實標準,從一指令運行大型語言模型的執行工具,進化為可連接 Claude Code、Codex、Copilot 等編程 Agent 的中樞。本文深入分析其技術架構、Agent 中樞功能、模型生態與社群規模,並提供實際部署建議,協助讀者規劃本地 AI 方案。
閱讀 →
2026-09-03
Anthropic 官方開源 Claude Code 外掛目錄,收錄內部開發與第三方合作夥伴的高品質外掛,涵蓋程式碼審查、LSP 語言伺服器整合、專案管理與技能捆綁等功能,提供官方託管、經安全審核的單一安裝來源,並採用 Apache 2.0 許可證,一鍵即可在 Claude Code 內安裝使用。
閱讀 →
2026-09-03
Google 推出全新 AI 影像生成與編輯工具 Google Pics,採用 Nano Banana 模型,內建於 Google Workspace,於 Docs 與 Slides 上線並擴展至 Drive。支援物件隔離變換、圖內文字修改與多版本生成,並整理與 Canva、Adobe Express 的定位差異。
閱讀 →
2026-09-03
RTK(Rust Token Killer)是 GitHub 上 7.8 萬星的開源 CLI 代理工具,以單一 Rust 二進位檔壓縮 shell 指令輸出,在進入 LLM 上下文前減少最多 90% 的 bash 輸出量。支援超過 100 種指令與 16...
閱讀 →
2026-09-03
Cherry Studio 是擁有 51,363 星標的開源 AI 桌面客戶端,支援 OpenAI、Gemini、Anthropic 等多間大型語言模型供應商,內建 300 多款預設 AI 助手、文件處理與 MCP 伺服器整合,提供 Windows、Mac 與 Linux 三平台一站式 AI 生產力方案。
閱讀 →
2026-09-02
Google DeepMind 推出 Gemini Omni 1.1 Flash,經由 Gemini API 與 Google AI Studio 開放生成式影片功能。新版本支援場景延伸至總長 40 秒、360p 草稿快 60%、成本僅三分之一,並新增 4K 輸出。本文整理新功能細節與對開發者的影響。
閱讀 →
2026-09-02
阿里巴巴 Qwen 團隊開源 Qwen3 系列大語言模型,涵蓋 0.6B 至 235B-A22B 多種規模,支援思考與非思考模式切換、256K 長上下文擴展至 100 萬 tokens,並以 Apache 2.0 授權釋出。本文分析其架構創新、生態支援與部署路徑,值得開發者留意。
閱讀 →
2026-09-02
OpenAI 宣布其新一代模型 Astra 成為旗下首個網絡安全能力達到 Critical 門檻的模型,在 Preparedness Framework 下被認定能自主發掘未知漏洞並開發攻擊鏈。公司在評估中發現 Astra 能建立完整的瀏覽器逃逸鏈與本機權限提升鏈,同時在防禦性安全措施上亦領先前代模型。
閱讀 →
2026-09-02
Meta 推出首個即時音訊感知模型 Muse Voice Transcribe,提供多語言串流語音轉錄、20 位以上說話者辨識與自動斷句,以每千分鐘 3 美元開放予開發者使用。模型以超過 70 種語言訓練,已內建於 Meta AI for Mac 與 Muse Code,Mac 用戶按住 Fn 鍵即可在任意應用程式聽寫。
閱讀 →
2026-09-02
Google DeepMind 推出 Agentic Video 影片理解功能,讓 Gemini 3.7 Flash 等模型以更少 token 分析長影片,支援次秒級時刻檢索、異常偵測與動作計數,開發者可透過 Gemini API 設定 processing 參數啟用,費用沿用標準 token 定價。
閱讀 →
2026-09-02
Segment Anything Model(SAM)是 Meta AI 開源的提示式圖像分割基礎模型,GitHub 獲 5.48 萬星標,以 1,100 萬張圖片與 11 億個遮罩訓練,實現零樣本分割。本文分析其架構、SA-1B 資料集、ONNX 部署與 SAM 2 的影片分割升級。
閱讀 →
2026-09-02
Anthropic 於 2026 年 9 月推出 Claude Fable 5.1,這是 Mythos 級別的最新旗艦模型,重點在於大幅降低代理式任務的運行成本。官方表示典型工作量下成本較 Fable 5 減少約 25%,高度代理化工作最多可節省約 45%,同時在編碼、知識工作與長期問題解決任務上表現更佳。
閱讀 →
2026-09-02
MinerU 是由 OpenDataLab 開發的高精度文檔解析引擎,將 PDF、DOCX、PPTX、XLSX 與圖片轉換為 LLM 可用的 Markdown 與 JSON,GitHub 獲 7.9 萬星標。本文分析其架構、109 種語言 OCR、MCP Server 整合與應用場景。
閱讀 →
2026-08-31
SGLang 是 LMSYS 旗下高效能大語言模型推理框架,全球超過 40 萬顆 GPU 部署,每日生產萬億級 Token,獲 xAI、NVIDIA、Cursor 等企業採用。本文解析 RadixAttention、推斷解耦、推測解碼等核心技術與市場影響力,是了解開源 AI 推理基礎設施現況的完整指南。
閱讀 →
2026-08-31
Meta 正低調測試能插線、重啟伺服器的數據中心機器人,供應商包括 Watney Robotics、Kinova 與 ABB。有數據中心員工估計,一旦成功機器人可取代部分人員最多 80% 的工作量,衝擊基礎設施維運人力生態。本文拆解測試細節、產業背景與對就業結構的影響。
閱讀 →
2026-08-31
Anthropic 發佈 Model Hardware Standard(MHS)研究預覽:一套標準化驅動介面,讓 AI 代理透過 MCP 控制任意實體設備,實驗設備整合時間從數週縮短至數小時,未來計劃開源並與 AWS、Hugging Face、Raspberry Pi 等合作。本文拆解 MHS 原理、應用場景與生態影響。
閱讀 →