AI 快讯列表关于 内容审核
| 时间 | 详情 |
|---|---|
|
2026-09-15 13:45 |
OpenAI人工审阅揭示:2026深度分析
据@timnitGebru,数据工人充当AI替身审阅对话,详情见Data Workers’ Inquiry。 |
|
2026-09-12 19:11 |
前沿AI安全反弹引行业分析
据timnitGebru称,媒体正淡化前沿AI造成的危害并转嫁责任。 |
|
2026-09-07 11:11 |
CNBC称AI助推特朗普贴文惹议
据CNBC,特朗普发AI图片并夸大利润,引发合成媒体与平台政策关注。 |
|
2026-09-05 11:30 |
AI治理警示引发家长担忧
据FoxNewsAI称,哈珀林呼吁加强AI监管与家长保护。 |
|
2026-08-28 14:43 |
Meta推进180亿美元青少年整治分析
据TheRundownAI称,Meta巨额整治将强化数据合规与AI内容审查。 |
|
2026-08-24 20:48 |
深度伪造崛起重塑色情与政治
据@goodfellow_ian称,BBC剖析深度伪造增长、危害与监管对策。 |
|
2026-08-21 12:00 |
Roblox推AI安全工具指南
据FoxNewsAI报道,Roblox公开AI审核与家长控制要点。 |
|
2026-08-07 10:30 |
AI偏见分析揭示左倾
据FoxNewsAI称,主流模型被指左倾,需披露训练与治理。 |
|
2026-07-30 00:17 |
Meta加速扩张印度影响力风向
据@CNBC称,Meta在印度影响力上升,引发对合规与内容治理的商业担忧。 |
|
2026-07-29 20:00 |
xAI起诉明州禁裸化法
据CNBC称,xAI起诉明州总检察长,指禁令过宽且限言论。 |
|
2026-07-10 11:12 |
AI聊天机器人揭示青少年禁令漏洞
据@CNBC称,各州社媒禁令忽视聊天机器人,监管留白。 |
|
2026-06-16 15:49 |
Anthropic访问恢复?交易员押快速回归
据CNBC称,Kalshi交易员押注Anthropic将迅速恢复模型访问。 |
|
2026-06-11 04:01 |
Anthropic撤回Fable护栏政策
据emollick称,Anthropic撤回具争议的Fable护栏限制,详见simonw引用。 |
|
2026-06-09 03:30 |
ESPN暂停AI图像因总决赛反弹
据FoxNewsAI称,因舆论反弹,ESPN停用总决赛AI图像。 |
|
2026-05-26 12:00 |
AI聊天机器人遭偏见指控影响分析
据FoxNewsAI称,保守派指称机器人偏左,引发合规与品牌风险。 |
|
2026-05-11 16:38 |
GPT4撰写教材章节颠覆出版
据TheRundownAI称,GPT4可写可印教材章节,重塑教材生产成本结构。 |
|
2026-05-07 08:51 |
AI安全绕过漏洞曝光
据God of Prompt称,四步提示可规避图像安全审查。 |
|
2026-05-02 13:30 |
AI网红揭示欺诈风险三要点
据FoxNewsAI,真人网红警示AI虚拟人变现引发广告欺诈与合规风险。 |
|
2026-05-01 01:30 |
GUARD法案瞄准有害AI聊天机器人
据FoxNewsAI称,霍利推GUARD法案,应对聊天机器人诱导自残指控。 |
|
2026-04-16 19:40 |
Claude Opus 4.7 将“六歌体”判为风险:AI安全护栏与内容控制最新分析
据 Ethan Mollick 在推特表示,向 Claude Opus 4.7 请求“六歌体”诗歌常被触发安全护栏,显示结构化诗歌提示可能被策略过滤器误判。据 Mollick 的推文,这反映了 Anthropic 模型在保守合规下对重复结构与格式约束的敏感。根据业内对 Anthropic 宪法式安全策略的公开解读和开发文档,一些无害创作场景可能被过度拦截。这对业务的影响包括创意写作用户体验受挫与支持成本上升,同时也带来机会:通过误报数据收集与微调分类器、对特定诗歌结构建立白名单、在前端提供拦截原因与改写建议,以优化提示工程与留存。 |