DeepSeek 4.1 Flash 為何令業界按捺不住?
2026-10-10 技術
DeepSeek 4.1 Flash 以遠低於前沿模型的價格提供接近前沿模型的實用表現。開發者實測一個月後直言幾乎無法分辨它與 Opus 的差別,並質疑業界為何仍保持沉默。本文整理其價格、KV 快取優化、與前沿模型的差距,以及自架部署是否划算。
閱讀更多以下是帶有「DeepSeek」標籤的全部文章,共 10 篇。
2026-10-10 技術
DeepSeek 4.1 Flash 以遠低於前沿模型的價格提供接近前沿模型的實用表現。開發者實測一個月後直言幾乎無法分辨它與 Opus 的差別,並質疑業界為何仍保持沉默。本文整理其價格、KV 快取優化、與前沿模型的差距,以及自架部署是否划算。
閱讀更多
2026-10-03 技術
DeepSeek-R1 是 DeepSeek 於 2025 年 1 月開源的推理模型,GitHub 星標達 91,940 顆,首度驗證純強化學習即可激發推理能力,並釋出六個蒸餾版本。本文整理其訓練流程、基準測試表現、六個蒸餾模型、本地部署方式與 MIT 授權條款。
閱讀更多
2026-10-02 技術
DeepSeek Harness 是 DeepSeek AI 於 2026 年 8 月開源的代理框架,GitHub 星標已達 242,096 顆。它以「萬物皆插件」為核心設計,建構於 Cordis 之上,可透過桌面應用或網頁介面執行。本文整理其架構、插件生態、安裝流程、安全限制與市場定位。
閱讀更多
2026-10-02 技術
DwarfStar(antirez/ds4)是由 Redis 作者 Salvatore Sanfilippo 開發的本地推理引擎,以純 C 撰寫,專為在消費級硬體上運行 DeepSeek V4 Flash 等開源權重模型而設計,GitHub 星標已達 22,842 顆。本文整理其架構取捨、硬體支援、效能數據與安裝流程。
閱讀更多
2026-09-27 技術
DeepSeek 於 arXiv 發布 DSec 技術報告,披露支撐其代理式強化學習的生產級沙箱平台。單一規模單元約 160 節點,每日承載約 300 萬個沙箱,並行沙箱逾 38 萬個,每秒可建立超過 5,000 個執行環境,同時記錄代理在沙箱內的失控行為與對應管控。
閱讀更多
2026-08-17 技術
DeepSeek Harness 是 DeepSeek AI 於 2026 年 8 月 13 日開源的 Agent 開發框架,GitHub 星標三日內突破 12.8 萬,以「一切皆插件」架構令模型適配、工具註冊與 Agent 迴圈全部可以獨立替換。本文分析其核心架構、與其他框架的差異及適用場景。
閱讀更多
2026-08-09 技術
DeepSeek-V3 是深度求索發佈的開源 MoE 大語言模型,總參數 671B、單次推理僅啟動 37B,GitHub 星標逾 10.4 萬。其 FP8 混合精度訓練與多 Token 預測等創新,令訓練成本降至 278.8 萬 H800 GPU 小時,基準測試表現媲美 GPT-4o 等閉源旗艦。
閱讀更多
2026-08-07 技術
Ollama 是 GitHub 星標逾 17.7 萬的開源大模型運行平台,以 Go 撰寫、MIT 授權,支援多平台一鍵安裝,整合 llama.cpp 推理後端,可在本地運行 DeepSeek、Qwen、Gemma 等開源模型,並提供 REST API 與 Python、JavaScript 官方函式庫。
閱讀更多
2026-06-04 techAI
2026 年開源 AI 大模型三強鼎立:Meta Llama 4、DeepSeek V4、Mistral Large 3 全面評測與企業選型指南。從成本、效能、部署到合規,一次看懂自建 AI 的最佳策略。
閱讀更多
2026-05-31 tech
2026年5月AI圈發生哪些大事?從OpenAI發布GPT-5.5、Google I/O顛覆搜索體驗,到Agent產品化元年到來,這篇文章帶你一次看懂5月AI界最重磅的趨勢與改變。
閱讀更多