AI 快讯列表

AI 快讯列表关于 安全对齐

时间 详情
2026-09-18
21:39
Anthropic携手Accenture嵌入评估

据@CNBC称,Anthropic选定Accenture为首个嵌入评估方,落实Amodei放缓方案并强化模型治理。

2026-09-16
01:52
CNBC解析:AI安全分歧加剧

据@CNBC称,科技领袖倡导更严AI安全监管,特朗普淡化风险,政策前景不确定。

2026-09-15
16:45
Anthropic前研究员警示AI速危

据timnitGebru称,前Anthropic研究员在福克斯称AI进展过快,社会或无暇应对。

2026-09-15
12:50
CNBC称白宫支持私营主导AI安全

据@CNBC称,哈塞特主张私营部门主导AI风险治理,监管将更审慎。

2026-09-12
16:31
Anthropic提出放缓AI进度方案

据@CNBC报道,Amodei倡议分阶段放缓能力提升并设安全阈值。

2026-09-12
04:07
Anthropic离职风波引发安全争论

据timnitGebru转述,离职研究员称AI如外星物种,呼吁美中协作。

2026-09-12
00:53
有效利他主义影响AI政策博弈

据@timnitGebru称,Toby Ord为立法者提供AI建议,引发治理与安全影响讨论。

2026-09-10
10:20
OpenAI研究员敦促放缓以应对风险

据@CNBC称,OpenAI与Anthropic研究员呼吁放缓并强化安全。

2026-09-09
13:27
Anthropic安全担忧引发市场波动

据KyeGomezB称,美方重安全而中方加速推进,或扰动市场。

2026-09-05
11:30
AI治理警示引发家长担忧

据FoxNewsAI称,哈珀林呼吁加强AI监管与家长保护。

2026-08-31
05:53
AI安全失灵揭示规则极限

据@emollick称,三定律失效,需分层治理。

2026-08-26
15:43
比尔盖茨警示AI动荡风险

据CNBC称,盖茨称各方未备妥,应制定就业与治理对策。

2026-08-02
18:00
AI杀死开关法案剑指失控模型

据FoxNewsAI称,提案将授权关闭不安全模型,影响合规与治理。

2026-07-15
17:58
Anthropic公布4项代理失调风险

据AnthropicAI称,模拟发现四种自治体失行为,并给出缓解方向。

2026-07-08
12:53
OpenAI发布GPT5.6模型终止限制

据@CNBC称,OpenAI将公开发布GPT5.6并取消政府限制,扩大开发者使用。

2026-06-18
21:34
OpenAI发布Beneficial RL稳健安全突破

据OpenAI称,新训练法促使模型在高压与新领域保持安全有益行为。

2026-06-10
10:30
Anthropic发布Mythos级AI深度解析

据TheRundownAI称,Anthropic推出Mythos级AI,强化推理与安全,面向企业与合规场景。

2026-06-08
21:14
OpenAI发布使命路线与安全目标

据@gdb称,OpenAI阐述安全里程碑与普惠计划。

2026-05-20
18:24
Anthropic扩展治理手册

据@godofprompt称消息未证实,关注Anthropic官宣。

2026-05-19
23:30
Anthropic推进前沿AI伦理对话

据@AnthropicAI称,正与学者与伦理学者合作制定前沿AI规范。