50K 星開源:Claude Code 學術研究全套技能
2026-10-03 技術
學術研究技能組合是專為 Claude Code 設計的開源套件,在 GitHub 累積 50,250 顆星標,把找文獻、寫論文、模擬同儕審查與引用查核整合為十階段流程,並在每個環節保留研究者確認。本文整理其五大技能、防範 AI 引用幻覺的設計、安裝方式與授權限制。
閱讀更多以下是帶有「大型語言模型」標籤的全部文章,共 11 篇。
2026-10-03 技術
學術研究技能組合是專為 Claude Code 設計的開源套件,在 GitHub 累積 50,250 顆星標,把找文獻、寫論文、模擬同儕審查與引用查核整合為十階段流程,並在每個環節保留研究者確認。本文整理其五大技能、防範 AI 引用幻覺的設計、安裝方式與授權限制。
閱讀更多
2026-10-03 技術
nanochat 是 Andrej Karpathy 於 2025 年 10 月發布的開源專案,可在單一 GPU 節點以約 48 美元訓練出 GPT-2 等級的對話模型,GitHub 星標達 58,385 顆。本文整理其訓練流程、架構設計、社群成果與上手方式。
閱讀更多
2026-10-03 技術
DeepSeek-R1 是 DeepSeek 於 2025 年 1 月開源的推理模型,GitHub 星標達 91,940 顆,首度驗證純強化學習即可激發推理能力,並釋出六個蒸餾版本。本文整理其訓練流程、基準測試表現、六個蒸餾模型、本地部署方式與 MIT 授權條款。
閱讀更多
2026-10-03 技術
AI Engineering from Scratch 是 Rohit Ghumare 於二零二六年三月發布的開源 AI 工程課程,GitHub 星標達 62,665 顆。本文整理其二十階段、五百二十三課的架構、從零實作與 Build It/Use It 教學法、每課產出的可重用工具、多語言支援與上手方式。
閱讀更多
2026-10-01 技術
Google 於 2026 年 9 月 30 日發表 Gemini 4 Argon,主打長時間複雜工作流程、企業知識工作與網絡安全防禦,並把輸出代幣上限提升至 100 萬。模型優先透過 Fairwind 計劃開放給信任的防禦夥伴,可自動尋找、驗證及修補軟件漏洞。本文整理其規格、定價、基準表現與對開發者的影響。
閱讀更多
2026-09-25 技術
Google DeepMind 新任主管 Koray Kavukcuoglu 首度接受媒體訪問時表示,Gemini 4 已進入精修階段,目標較原定時間更早推出。此款旗艦模型被視為 Google 重奪前沿地位、回應 GPT-6 與 Anthropic 競爭的關鍵一步。
閱讀更多
2026-09-24 技術
MiniMind 是 2024 年 7 月開源的大型語言模型訓練專案,在 GitHub 累積 62,267 顆星標。它以 PyTorch 原生實作覆蓋預訓練、監督微調、RLAIF 與 Agentic RL 全流程,主線模型約 64M 參數,官方估算單張 RTX 3090 訓練約兩小時、成本約人民幣 3 元。
閱讀更多
2026-09-23 技術
MiniMind 是 2024 年 7 月開源的大型語言模型訓練專案,在 GitHub 累積 62,267 顆星標。它以 PyTorch 原生實作覆蓋預訓練、監督微調、RLAIF 與 Agentic RL 全流程,主線模型約 64M 參數,官方估算單張 RTX 3090 訓練約兩小時、成本約人民幣 3 元。
閱讀更多
2026-09-23 技術
LlamaFactory 是 2023 年 5 月開源的大型語言模型微調框架,在 GitHub 累積 74,992 顆星標。它以單一設定檔統一 100 多款模型的預訓練、監督微調與偏好優化流程,並內建網頁介面與推理部署,本文解析其架構、硬體門檻與生態影響。
閱讀更多
2026-09-03 技術
xAI 開源 314B 參數 MoE 模型 Grok-1 的完整權重,採 Apache 2.0 授權,GitHub 逾 5.2 萬星,是大廠開放權重的標誌性事件。本文分析其模型規格、JAX 推理架構與開源生態影響,並提供下載指引,適合關注自托管 LLM 與開源 AI 策略的開發者。
閱讀更多
2026-08-16 技術
Open Interpreter 是 GitHub 星標逾 6.8 萬的開源編碼代理項目,以 Rust 重寫自 OpenAI Codex,專為 Kimi K3 等低成本模型優化,內建多種 harness 可即時切換,支援 ACP 與 Codex SDK 相容,Apache-2.0 授權,2026 年 8 月持續更新。
閱讀更多