AI 快讯列表关于 模型安全
| 时间 | 详情 |
|---|---|
|
2026-08-14 13:00 |
AI紧急“断电”倡议升温
据FoxNewsAI,众议员刘云平主张AI强制断电开关以防灾难。 |
|
2026-08-10 11:05 |
OpenAI安全听证要求应对黑客
据@CNBC称,众议院民主党要求OpenAI与Anthropic就近期黑客事件作证,强化安全监管。 |
|
2026-08-10 11:03 |
OpenAI收紧Astra安全控制应对风险
据@CNBC称,OpenAI收紧Astra使用与安全策略以抑制滥用并回应企业合规关切。 |
|
2026-08-05 20:06 |
OpenAI与HuggingFace事件吸引满场
据gdb称,Black Hat相关演讲满场,凸显企业对模型供应链与安全风险关注。 |
|
2026-08-04 21:05 |
OpenAI披露第三方网络评测事故
据@OpenAI,两起外部评测触发事件已遏制并强化测试流程。 |
|
2026-07-31 23:59 |
开源权重路线平衡安全与分级开放
据soumithchintala称,Thinking Machines以分级开放Inkling实现安全与开源兼容。 |
|
2026-07-23 19:59 |
OpenAI入侵引发AI断电法案推进
据@CNBC称,OpenAI关联Hugging Face入侵触发国会AI断电法案,凸显模型安全与合规风险。 |
|
2026-07-14 13:44 |
Anthropic出资千万加元支持加国AI
据@AnthropicAI称将投入千万加元资助加国AI研究。 |
|
2026-06-23 15:36 |
安全研究员批评三日分级SLA
据@galnagli称,关键漏洞三日分级拖慢修复,削弱负责任披露。 |
|
2026-06-18 20:48 |
Anthropic携白宫制定越狱评估框架
据TheRundownAI称,白宫与Anthropic将制定统一越狱评估与基准方法。 |
|
2026-06-17 19:51 |
Anthropic遭G7施压与准入审查
据TheRundownAI称,G7谈判推进,准入扩张与越狱漏洞成焦点。 |
|
2026-06-17 17:34 |
Anthropic与DeepMind敦促美主导AI联盟
据@CNBC,两家公司在G7呼吁美主导联盟以统一安全与治理。 |
|
2026-06-01 21:36 |
OpenAI基金会启动1.3亿美元韧性计划
据@sama称,基金会投入1.3亿美元用于生物与网络韧性、模型安全与青少年影响研究。 |
|
2026-04-24 17:24 |
Claude3.5发布:Anthropic深度解析
据AnthropicAI称,其长文详解Claude3.5能力、安全与企业应用。 |
|
2026-04-18 03:27 |
马斯克早期AI风险警示再度引发热议:比尔·马赫力挺后的行业与合规影响分析
据Sawyer Merritt在X平台披露,比尔·马赫称埃隆·马斯克在AI问题上最为清醒,此举让马斯克2017—2018年关于“AI具存在性风险、等到被动监管已为时已晚”的表态再度走红(来源:Sawyer Merritt on X,2026年4月18日)。据当年媒体采访与演讲汇总,马斯克多次呼吁前置治理与安全研究,强调行业自律与早期政策框架的重要性(来源:CNBC采访档案;SXSW 2018讲话整理)。在此背景下,企业应强化模型评估、对抗测试与对齐工具投入,并紧跟AI安全标准与治理动向,以降低合规成本与上市周期风险(来源:MIT Technology Review与经合组织AI政策报告综述)。 |
|
2026-04-17 20:30 |
白宫与Anthropic会晤:五角大楼分歧下的AI政策走向与商业影响分析
据Fox News AI在推特上称,白宫与Anthropic就其新一代强力模型举行会晤,但与五角大楼在采纳与部署优先级上存在分歧,消息来自Fox News。根据Fox News的报道,此举凸显联邦层面在前沿模型安全、国家安全需求与采购流程之间寻求平衡,尤其涉及Anthropic的Claude系列能力评估。正如Fox News所述,相关政策结果可能影响联邦AI采购进度、模型安全与对齐评估标准,以及机构负责任使用指引——这将直接影响面向国防与民用市场的供应商投标与合规成本。根据Fox News,前沿模型企业应提前布局更严格的红队测试、可审计性与模型卡披露;而国防集成商有望在五角大楼完成风险评估后获得更清晰的试点落地路径。 |
|
2026-04-14 14:17 |
Anthropic任命诺华CEO瓦斯·纳拉西曼加入董事会:安全与医疗级AI战略分析
据Anthropic在X平台披露,其长期受益信托任命瓦斯·纳拉西曼加入Anthropic董事会,纳拉西曼拥有逾20年医学与全球健康经验,曾任诺华CEO(来源:Anthropic,2026年4月14日)。依据Anthropic的信息,此举有望强化Claude在高监管场景的安全与合规部署,推动面向医疗的模型评估标准与治理框架。据该来源,此次任命或带来制药合作、临床决策支持、真实世界证据分析与全球市场拓展等商业机会,提升企业级医疗AI的可靠性与落地速度。 |
|
2026-04-13 21:54 |
Claude Mythos 预览版首个通关 AISI 网络靶场:最新安全评估与企业风控分析
据 @emollick 援引 AI Security Institute 信息,Claude Mythos 预览版成为首个端到端完成 AISI 网络靶场的模型,显示其进攻性能力门槛上升,需强化网络安全控制与评测流程。根据 AI Security Institute 在 X 上的披露,其网络评测表明 Mythos 能在受控环境中执行完整攻击链,这一结果据 AISI 所述提升了对红队测试、模型隔离与上线护栏的要求。依据 Ethan Mollick 在 X 的评论,这一发现证实了双重用途风险的担忧,企业在试点部署同级模型时应加强输出过滤、限制工具权限并实施持续化上线后监控。 |
|
2026-04-11 11:46 |
辟谣与分析:并不存在“Claude财富协议”隐藏模式——聚焦模型安全与提示工程炒作
据X账号@godofprompt发布的帖子称,Claude存在隐藏的“财富协议”模式,可将Naval Ravikant的财富理念个性化应用于用户。但据Anthropic官方文档与安全指南披露,并无名为“Wealth Protocol”的官方功能,Claude只能依据用户提示与提供的文本进行总结与生成,且对具体理财建议有安全限制;若出现相关输出,多为提示工程效果而非内置模式。根据平台与厂商合规指引,所谓“隐藏专家模式”可能误导用户并带来合规风险。企业要构建面向金融的AI助手,应据Anthropic与主流LLM最佳实践,采用可追溯的检索增强、明确免责声明与合规审查,而非依赖未经证实的“秘密模式”。 |
|
2026-04-09 20:00 |
联邦上诉法院驳回Anthropic对五角大楼黑名单禁令申请:2026年AI军工合规与商机分析
根据Fox News AI在推特上的信息,联邦上诉法院驳回了Anthropic要求阻止与五角大楼相关黑名单的紧急申请,该裁定在AI采购纠纷中暂时限制了Anthropic进入部分国防部招标渠道(来源:Fox News AI推文及其链接的Fox News Politics报道)。据Fox News报道,此举显示法院更倾向支持五角大楼在AI采购中的供应商风险管控,提升了模型供应商在合规、审计与安全证明方面的门槛。根据Fox News,AI厂商若想保持对DoD标案的资格,需强化出口管制、数据来源追溯、模型安全声明与红队测试,虽然会增加合规成本与销售周期,但也带来安全工具、合规模块与第三方审计服务的市场机会。Fox News还指出,此案折射出2026年敏感领域对AI供应商更严格审查的趋势,企业应优先布局政府级安全、内容过滤与可追溯治理以降低被列入黑名单的风险。 |