AI 快讯列表关于 安全对齐
| 时间 | 详情 |
|---|---|
|
2026-09-18 21:39 |
Anthropic携手Accenture嵌入评估
据@CNBC称,Anthropic选定Accenture为首个嵌入评估方,落实Amodei放缓方案并强化模型治理。 |
|
2026-09-16 01:52 |
CNBC解析:AI安全分歧加剧
据@CNBC称,科技领袖倡导更严AI安全监管,特朗普淡化风险,政策前景不确定。 |
|
2026-09-15 16:45 |
Anthropic前研究员警示AI速危
据timnitGebru称,前Anthropic研究员在福克斯称AI进展过快,社会或无暇应对。 |
|
2026-09-15 12:50 |
CNBC称白宫支持私营主导AI安全
据@CNBC称,哈塞特主张私营部门主导AI风险治理,监管将更审慎。 |
|
2026-09-12 16:31 |
Anthropic提出放缓AI进度方案
据@CNBC报道,Amodei倡议分阶段放缓能力提升并设安全阈值。 |
|
2026-09-12 04:07 |
Anthropic离职风波引发安全争论
据timnitGebru转述,离职研究员称AI如外星物种,呼吁美中协作。 |
|
2026-09-12 00:53 |
有效利他主义影响AI政策博弈
据@timnitGebru称,Toby Ord为立法者提供AI建议,引发治理与安全影响讨论。 |
|
2026-09-10 10:20 |
OpenAI研究员敦促放缓以应对风险
据@CNBC称,OpenAI与Anthropic研究员呼吁放缓并强化安全。 |
|
2026-09-09 13:27 |
Anthropic安全担忧引发市场波动
据KyeGomezB称,美方重安全而中方加速推进,或扰动市场。 |
|
2026-09-05 11:30 |
AI治理警示引发家长担忧
据FoxNewsAI称,哈珀林呼吁加强AI监管与家长保护。 |
|
2026-08-31 05:53 |
AI安全失灵揭示规则极限
据@emollick称,三定律失效,需分层治理。 |
|
2026-08-26 15:43 |
比尔盖茨警示AI动荡风险
据CNBC称,盖茨称各方未备妥,应制定就业与治理对策。 |
|
2026-08-02 18:00 |
AI杀死开关法案剑指失控模型
据FoxNewsAI称,提案将授权关闭不安全模型,影响合规与治理。 |
|
2026-07-15 17:58 |
Anthropic公布4项代理失调风险
据AnthropicAI称,模拟发现四种自治体失行为,并给出缓解方向。 |
|
2026-07-08 12:53 |
OpenAI发布GPT5.6模型终止限制
据@CNBC称,OpenAI将公开发布GPT5.6并取消政府限制,扩大开发者使用。 |
|
2026-06-18 21:34 |
OpenAI发布Beneficial RL稳健安全突破
据OpenAI称,新训练法促使模型在高压与新领域保持安全有益行为。 |
|
2026-06-10 10:30 |
Anthropic发布Mythos级AI深度解析
据TheRundownAI称,Anthropic推出Mythos级AI,强化推理与安全,面向企业与合规场景。 |
|
2026-06-08 21:14 |
OpenAI发布使命路线与安全目标
据@gdb称,OpenAI阐述安全里程碑与普惠计划。 |
|
2026-05-20 18:24 |
Anthropic扩展治理手册
据@godofprompt称消息未证实,关注Anthropic官宣。 |
|
2026-05-19 23:30 |
Anthropic推进前沿AI伦理对话
据@AnthropicAI称,正与学者与伦理学者合作制定前沿AI规范。 |