nanoGPT 開源:6.2 萬星的極簡 GPT 訓練框架
2026-08-31
OpenAI 前研究科學家 Andrej Karpathy 開發的 nanoGPT 在 GitHub 累積 6.2 萬星標,以約 300 行 train.py 與 model.py 重現 GPT-2 訓練,8 張 A100 四天完成...
閱讀 →共 470 篇報道,現顯示第 261–280 篇(第 14 / 24 頁)
2026-08-31
OpenAI 前研究科學家 Andrej Karpathy 開發的 nanoGPT 在 GitHub 累積 6.2 萬星標,以約 300 行 train.py 與 model.py 重現 GPT-2 訓練,8 張 A100 四天完成...
閱讀 →
2026-08-31
Apple 首款 AI 智能眼鏡預計 2027 年推出,主打 Visual Intelligence 視覺智慧與 Siri 結合,用相機理解真實世界、翻譯路牌、辨識環境。本文整理已知功能、款式設計、健康定位與發佈時間表,並分析它與 Meta Ray-Ban 眼鏡的策略差異。
閱讀 →
2026-08-31
開源 LLM 應用開發平台 Dify 在 GitHub 已獲得 15.4 萬星標與 2.4 萬次 fork,透過視覺化 AI 工作流、完整 RAG 管線、Agent 能力與多模型整合,讓團隊從原型到生產部署無須重構技術棧。本文分析其核心架構、與同類平台的差異、生態影響,以及最適合採用 Dify 的團隊類型。
閱讀 →
2026-08-31
GraphRAG 是微軟研究院推出的開源知識圖譜 RAG 框架,在 GitHub 上累積超過 3.57 萬星標,以大型語言模型從非結構化文本建構知識圖譜,解決傳統向量檢索難以回答全域性問題的缺陷。本文分析其架構原理、與傳統 RAG 的差異、實際應用場景,以及微軟宣布進入維護模式後的生態影響與替代方案。
閱讀 →
2026-08-31
騰訊正式發布並開源新一代大型語言模型 Hy4 預覽版,採用 770B 總參數、49B 活躍參數的架構,上下文窗口超過 100 萬 tokens,並以每百萬輸入 tokens 0.834 美元的價格開放 API。本文分析其技術規格、應用場景、定價策略與開源意義,幫助開發者判斷是否值得採用。
閱讀 →
2026-08-30
OpenAI 正式為 ChatGPT 與 Codex 加入多帳戶支援,Gmail、Google 日曆與聯絡人外掛現在可以同時連接多個不同帳戶,個人與工作信箱可在同一對話介面中並存。本文說明更新內容、設定步驟、實際應用情境與注意事項,幫助使用多個 Google 帳戶的開發者與工作者提升效率。
閱讀 →
2026-08-30
Tabby 是一個開源自託管 AI 程式助手,提供 GitHub Copilot 的落地替代方案,支援消費級 GPU、無需外部資料庫,已累積 33,841 顆星標。本文分析其核心架構、與 Copilot 的差異、快速部署方式與生態定位,適合重視程式碼隱私的企業團隊參考。
閱讀 →
2026-08-30
索尼音樂與華納查普爾等大型音樂出版商,入稟美國法院控告 Anthropic 及其創辦人,指控非法下載與爬取數千份受版權保護的作品訓練 Claude 模型,形容為肆無忌憚的侵權行動。繼 Bartz 案 15 億美元判賠後,這宗範圍更廣的訴訟將如何影響 AI 訓練資料合法性爭議,本文整理重點與產業影響。
閱讀 →
2026-08-30
Home Assistant 是 GitHub 上 90,178 星標的開源智能家居自動化平台,以 Python 開發並由 Open Home Foundation 維護,主打本地控制與隱私優先。本文分析其模組化架構、整合生態與自動化能力,說明如何在 Raspberry Pi 或本地伺服器部署,協助讀者評估自建智能家居方案。
閱讀 →
2026-08-30
Awesome DESIGN.md 是 GitHub 上 111,248 星標的開源設計系統文件收藏庫,收集 Apple、Stripe、Linear 等 73 個知名網站的 DESIGN.md 分析文件,讓 AI 編程代理生成視覺一致的 UI。本文分析核心概念與用法,探討 DESIGN.md 如何成為 AI 生成介面的新標準。
閱讀 →
2026-08-30
Qdrant 是一個以 Rust 撰寫的開源向量資料庫,目前累積超過 34,000 顆星標,主打高效能向量相似度搜尋,並提供雲端託管版本。本文深入分析其核心架構、稠密與稀疏向量混合搜尋技術、可節省 97% 記憶體的量化壓縮功能、與 Milvus 等競品的差異,以及適合採用 Qdrant 的團隊類型與實際應用場景。
閱讀 →
2026-08-29
llama.cpp 是 GitHub 上 126,107 顆星的開源專案,以純 C/C++ 實作本地 LLM 推理,支援從 1.5-bit 到 8-bit 的整數量化與 CPU、GPU、NPU 等多元硬件後端。本文深入分析其核心架構、硬件支援版圖、量化技術原理與生態影響力。
閱讀 →
2026-08-29
FAISS 是 Meta 開發的高效能向量相似度搜索庫,在 GitHub 獲得 40,813 顆星與 4,508 個 fork。本文深入分析其核心架構、十億級索引技術、GPU 加速原理,以及 Meta FAIR 團隊在 RAG 與推薦系統生態中的關鍵定位。
閱讀 →
2026-08-29
OpenAI Agents SDK 是 OpenAI 官方推出的開源多智能體框架,GitHub 累積逾 2.9 萬星標,支援 100 多種 LLM,提供 Agents、Guardrails、Handoffs 等核心機制,並延伸 Sandbox、Realtime 與 Voice 能力,本文分析其架構設計與適用團隊。
閱讀 →
2026-08-28
LlamaIndex 是 GitHub 上擁有 5.19 萬星標的開源資料框架,專為大型語言模型應用設計,提供資料連接器、索引結構與檢索查詢介面,可串接 OpenAI、Ollama 等模型及超過 300 個整合套件,被視為 RAG 應用的標準起點。本文分析其核心架構、與 LangChain 的差異及商業化路徑。
閱讀 →
2026-08-28
Open WebUI 是 GitHub 上 15 萬星標的自託管 AI 介面平台,支援 Ollama 與所有 OpenAI 相容 API,提供本地 RAG、插件系統、多模型對話與企業級權限管理,被視為本地 AI 部署最受歡迎的入口工具。本文分析其核心架構、生態系統與實際部署方式。
閱讀 →
2026-08-28
One API 是 36,590 星的開源 LLM API 管理系統,以統一 OpenAI 格式訪問 OpenAI、Claude、Gemini、DeepSeek 等主流大模型,支援負載均衡、令牌管理與多機部署,是開發者管理多模型 API 的實用工具。
閱讀 →
2026-08-28
6.8 萬星開源項目 Oh My OpenAgent 以 ultrawork 單一指令協調多個專業 AI 代理並行完成複雜程式任務。支援 OpenCode、Codex CLI 與獨立三種版本,內建 Team Mode 多人協作與 LSP、AST-Grep 工具整合,並引發 Anthropic 封鎖 OpenCode 的產業爭議。...
閱讀 →
2026-08-27
OpenAI 公布自研推理晶片 Jalapeño 首批測試結果,每瓦效能比業界領先系統高 1.5 至 1.9 倍,端到端延遲低 1.7 至 3.6 倍。晶片針對語言模型推理設計,在 GPT-OSS、DeepSeek R1 與 Kimi K2.5 三個公開模型上均居 Pareto 前沿,預計年底部署。
閱讀 →
2026-08-26
智譜 AI 今日突襲發佈 GLM-5.3-Flash:GLM-5 系列首個原生多模態模型,320B 總參數、僅 18B 活躍參數,效能超越 GLM-5.2 之餘價格只需十分之一,編程與 Agent 能力逼近 Claude Opus 4.8。本文拆解其混合注意力架構、30T 多模態預訓練、開源授權與本地部署方案。
閱讀 →