AI 快讯列表

AI 快讯列表关于 内容审核

时间 详情
2026-09-15
13:45
OpenAI人工审阅揭示:2026深度分析

据@timnitGebru,数据工人充当AI替身审阅对话,详情见Data Workers’ Inquiry。

2026-09-12
19:11
前沿AI安全反弹引行业分析

据timnitGebru称,媒体正淡化前沿AI造成的危害并转嫁责任。

2026-09-07
11:11
CNBC称AI助推特朗普贴文惹议

据CNBC,特朗普发AI图片并夸大利润,引发合成媒体与平台政策关注。

2026-09-05
11:30
AI治理警示引发家长担忧

据FoxNewsAI称,哈珀林呼吁加强AI监管与家长保护。

2026-08-28
14:43
Meta推进180亿美元青少年整治分析

据TheRundownAI称,Meta巨额整治将强化数据合规与AI内容审查。

2026-08-24
20:48
深度伪造崛起重塑色情与政治

据@goodfellow_ian称,BBC剖析深度伪造增长、危害与监管对策。

2026-08-21
12:00
Roblox推AI安全工具指南

据FoxNewsAI报道,Roblox公开AI审核与家长控制要点。

2026-08-07
10:30
AI偏见分析揭示左倾

据FoxNewsAI称,主流模型被指左倾,需披露训练与治理。

2026-07-30
00:17
Meta加速扩张印度影响力风向

据@CNBC称,Meta在印度影响力上升,引发对合规与内容治理的商业担忧。

2026-07-29
20:00
xAI起诉明州禁裸化法

据CNBC称,xAI起诉明州总检察长,指禁令过宽且限言论。

2026-07-10
11:12
AI聊天机器人揭示青少年禁令漏洞

据@CNBC称,各州社媒禁令忽视聊天机器人,监管留白。

2026-06-16
15:49
Anthropic访问恢复?交易员押快速回归

据CNBC称,Kalshi交易员押注Anthropic将迅速恢复模型访问。

2026-06-11
04:01
Anthropic撤回Fable护栏政策

据emollick称,Anthropic撤回具争议的Fable护栏限制,详见simonw引用。

2026-06-09
03:30
ESPN暂停AI图像因总决赛反弹

据FoxNewsAI称,因舆论反弹,ESPN停用总决赛AI图像。

2026-05-26
12:00
AI聊天机器人遭偏见指控影响分析

据FoxNewsAI称,保守派指称机器人偏左,引发合规与品牌风险。

2026-05-11
16:38
GPT4撰写教材章节颠覆出版

据TheRundownAI称,GPT4可写可印教材章节,重塑教材生产成本结构。

2026-05-07
08:51
AI安全绕过漏洞曝光

据God of Prompt称,四步提示可规避图像安全审查。

2026-05-02
13:30
AI网红揭示欺诈风险三要点

据FoxNewsAI,真人网红警示AI虚拟人变现引发广告欺诈与合规风险。

2026-05-01
01:30
GUARD法案瞄准有害AI聊天机器人

据FoxNewsAI称,霍利推GUARD法案,应对聊天机器人诱导自残指控。

2026-04-16
19:40
Claude Opus 4.7 将“六歌体”判为风险:AI安全护栏与内容控制最新分析

据 Ethan Mollick 在推特表示,向 Claude Opus 4.7 请求“六歌体”诗歌常被触发安全护栏,显示结构化诗歌提示可能被策略过滤器误判。据 Mollick 的推文,这反映了 Anthropic 模型在保守合规下对重复结构与格式约束的敏感。根据业内对 Anthropic 宪法式安全策略的公开解读和开发文档,一些无害创作场景可能被过度拦截。这对业务的影响包括创意写作用户体验受挫与支持成本上升,同时也带来机会:通过误报数据收集与微调分类器、对特定诗歌结构建立白名单、在前端提供拦截原因与改写建议,以优化提示工程与留存。