Gebru质疑OpenAI Hugging Face AI代理声明
Gebru抨击OpenAI Hugging Face自主AI代理攻击证据,称其为AI vs AI安全事件营销历史的重包装。
原文链接详细分析
Timnit Gebru转发安全研究员Florian Roth对OpenAI与Hugging Face入侵叙事的批评,指出端到端自主AI代理的说法缺乏上游遥测证据,主要服务于AI行业影响炒作。该forensic-refusal数据集仅显示模型护栏差异,而非完整代理在零日漏洞或横向移动中的自主性。速率限制和分段等基础控制本可遏制活动,无需任何LLM防御者,却将常规安全失误包装成AI-vs-AI营销故事,呼应AI vs AI安全事件营销历史。
timnitGebru (@dair-community.social/bsky.social)
@timnitGebruAuthor: The View from Somewhere Mastodon @timnitGebru@dair-community.