跳到主要內容
AI 武林

AI 安全與治理

AI Safety & Governance ・ 141 筆內容

對齊、風險、法規與政策。

也叫做:AI 安全、AI safety、alignment、對齊、对齐、AI 治理、AI governance、AI 法規、AI 政策、AI regulation、AI policy

學習路徑

由淺入深:入門 → 進階 → 高階

  1. 入門初窺門徑

  2. 進階登堂入室

  3. 高階爐火純青

排行前 50 名

依相關、人氣、新鮮度綜合排序;站長推薦的加成

  1. ※ 摘要僅根據標題與說明

  2. 8影片Best Partners TV進階中文

    递归自我改进AI正在拿人类命运下注 | Anthropic研究员Jacob Coxon辞职警告 | AI安全 | 超级智能 | AI对齐 | Hugging Face事件 | 诸神黄昏(在新分頁開啟原站)

    探討 AI 安全與人類命運的關聯,特別聚焦於 Anthropic 研究員 Jacob Coxon 因 AI 風險而辭職的事件,並分析超級智慧可能帶來的深遠影響。

    1.1 萬次觀看

    ※ 摘要僅根據標題與說明

  3. 15影片Best Partners TV進階中文

    AI 2040计划:为超级智能争取时间​ | 超级智能 | AI安全 | AI对齐 | AI控制 | Daniel Kokotajlo | Thomas Larsen | AI预测 | AI 2027(在新分頁開啟原站)

    本影片深度解析了 AI 2040 計劃,探討如何為超級智慧到來爭取安全視窗。內容涵蓋 AI 經濟自主增長、通用與專業模型之爭,並分析中美如何執行 AI 減速協議,最終迴歸 AI 是否仍屬正常技術的根本問題。

    1.1 萬次觀看

    ※ 摘要僅根據標題與說明

  4. 17影片The AI Daily Brief: Artificial Intelligence News入門EN

    The Real Risks of AI Agents(在新分頁開啟原站)

    探討 AI 代理的潛在風險,包括安全漏洞與許可權限制,並指出當代理執行使用者指令時可能破壞人類摩擦機制。內容涵蓋了近期 AI 安全事件、中美 AI 對話以及 Google 與 Microsoft 的新功能,並分析這些發展對系統穩定性的影響。

    8,068次觀看

    ※ 摘要僅根據標題與說明

  5. 20影片Best Partners TV入門中文

    能力过剩时代,AI瓶颈已不在模型 | 萨提亚·纳德拉 | 微软 | All-In Summit | AI减速 | AI安全 | 奖励黑客 | 互操作标准 | Copilot | 开源AI | MAI(在新分頁開啟原站)

    薩提亞·納德拉在 All-In Summit 上指出,AI 發展進入能力過剩時代,模型效能已達天花板,真正的挑戰在於如何安全、高效地部署 AI 應用。

    ※ 摘要僅根據標題與說明

  6. 23文章Armin Ronacher(部落格)進階EN

    P(doom)

    探討了 AI 安全中的「末日恐懼」,作者認為當前 AI 模型(特別是閉源模型)可能對人類社會構成威脅,例如被用於網路攻擊或控制武器。作者強調,雖然 AI 不會導致人類滅絕,但會大幅增加社會成本,並可能引發新的技術不平等。

  7. 35Podcast80,000 Hours Podcast進階EN

    #251 – The UK's former head AI safety scientist on how to solve alignment before superintelligence arrives | Geoffrey Irving

    Geoffrey Irving 指出政府應在「現在」而非過去採取行動,因為人類尚未具備理解 AI 行為的能力。他認為 AI 安全的核心在於建立可自我監督的系統,透過「能力爬坡」與「可擴充套件監督」來逐步解決問題,而非等待超智慧體出現。

  8. 48PodcastMachine Learning Street Talk進階EN

    AI 2040: Plan A report - Daniel Kokotajlo & Thomas Larsen(在新分頁開啟原站)

    本訪談探討 AI 2040 計畫,提出在超強智之前先暫停發展以建立安全基礎設施的觀點。訪談者檢視了預測的侷限與 AI 自主研究的可能性,並討論了控制與對齊的區別,以及不同國家是否可能透過政策強制慢速發展。

    ※ 摘要僅根據標題與說明

最新

依發布時間

  1. PodcastTBPN入門EN

    White House AI Accord, Model Welfare, Ken Griffindor School of Market Wizardry | Ali Golshan, Mike Intrator, Vlad Tenev, Pari Singh, Minna Song, Dev Ittycheria, Daragh Murphy, Noah Friedman

    探討了白宮關於超級智慧的協議、模型福利問題以及肯·格里菲諾市場魔法學校。內容涵蓋了超級智慧的定義、開源模型的風險、AI 雲的未來趨勢、以及金融與消費領域的 AI 應用。