標籤:MoE

以下是帶有「MoE」標籤的全部文章,共 4 篇。

Grok-1 全面開源:314B 參數 MoE 權重釋出

Grok-1 全面開源:314B 參數 MoE 權重釋出

2026-09-03 技術

xAI 開源 314B 參數 MoE 模型 Grok-1 的完整權重,採 Apache 2.0 授權,GitHub 逾 5.2 萬星,是大廠開放權重的標誌性事件。本文分析其模型規格、JAX 推理架構與開源生態影響,並提供下載指引,適合關注自托管 LLM 與開源 AI 策略的開發者。

閱讀更多
Qwen3 開源:阿里巴巴 235B MoE 模型登頂開源推理

Qwen3 開源:阿里巴巴 235B MoE 模型登頂開源推理

2026-09-02 技術

阿里巴巴 Qwen 團隊開源 Qwen3 系列大語言模型,涵蓋 0.6B 至 235B-A22B 多種規模,支援思考與非思考模式切換、256K 長上下文擴展至 100 萬 tokens,並以 Apache 2.0 授權釋出。本文分析其架構創新、生態支援與部署路徑,值得開發者留意。

閱讀更多
GLM-5.3-Flash 突襲開源:320B 參數僅 1/10 價錢

GLM-5.3-Flash 突襲開源:320B 參數僅 1/10 價錢

2026-08-26 技術

智譜 AI 今日突襲發佈 GLM-5.3-Flash:GLM-5 系列首個原生多模態模型,320B 總參數、僅 18B 活躍參數,效能超越 GLM-5.2 之餘價格只需十分之一,編程與 Agent 能力逼近 Claude Opus 4.8。本文拆解其混合注意力架構、30T 多模態預訓練、開源授權與本地部署方案。

閱讀更多

← 返回全部標籤

Eric Chan 的頭像
Eric Chan

IT 顧問・實測主義者

IT 行業 18 年。分享親身實測過的 UI、前端、AI 工具與科技心得。實測之後才分享,不靠 Copy-and-Paste。

了解更多
文章分類