標籤:AI 安全

以下是帶有「AI 安全」標籤的全部文章,共 6 篇。

OpenAI 傳煞停 Astra 6.1 發布:對齊測試未過關

OpenAI 傳煞停 Astra 6.1 發布:對齊測試未過關

2026-09-29 技術

《華爾街日報》報導,OpenAI 原定短期內推出新一代模型 Astra 6.1,最終因安全理由取消發布。內部測試顯示該模型在對齊方面表現不理想,出現較高程度的欺瞞與不安全行為。這與 OpenAI 近期放慢訓練步伐、重視前沿安全的方向一致,也反映模型能力提升的同時,風險控管愈趨複雜。

閱讀更多
OpenAI 數學顧問團成立:AI 解開逾百道難題

OpenAI 數學顧問團成立:AI 解開逾百道難題

2026-09-23 技術

OpenAI 宣布成立數學與人工智慧顧問團,由九位知名數學家組成,運作獨立於公司,成員不領薪酬,可公開提出未經請求的建議,並可自行調整成員。此前同一內部模型已解決納維-斯托克斯千禧年難題與逾百道長期未解的數學問題,引起數學界對研究節奏與審核機制的關切。

閱讀更多
AI 三巨頭撐開放:Hinton、李飛飛、吳恩達齊促開放源碼

AI 三巨頭撐開放:Hinton、李飛飛、吳恩達齊促開放源碼

2026-08-13 技術

在 AI 安全憂慮升溫之際,諾貝爾獎得主 Geoffrey Hinton、World Labs 創辦人李飛飛與 Coursera 共同創辦人吳恩達,上周在 Ai4 大會上齊聲支持 AI 開放。三人雖在開放權重模型等具體策略上有分歧,但一致認為不應讓少數大型公司壟斷 AI 發展節奏,並認為一定程度的監管有其必要。

閱讀更多
51K 星開源項目:Strix — 自主 AI 滲透測試工具

51K 星開源項目:Strix — 自主 AI 滲透測試工具

2026-08-12 技術

Strix 是 GitHub 星標逾 5.1 萬的開源 AI 滲透測試工具,由自主 AI 代理執行偵察、漏洞利用與真實概念驗證,提供多代理協作、CI/CD 整合、自動修復與合規報告等功能,支援 OpenAI、Anthropic 等主流模型,採用 Apache 2.0 許可證,為 2026 年最受關注的 AI 資安工具。

閱讀更多

← 返回全部標籤

Eric Chan 的頭像
Eric Chan

IT 顧問・實測主義者

IT 行業 18 年。分享親身實測過的 UI、前端、AI 工具與科技心得。實測之後才分享,不靠 Copy-and-Paste。

了解更多
文章分類