2026-08-18 18:00 TechCrunch
在 Hugging Face 遭入侵后,OpenAI 公布了新的安全防护措施,包括在模型开发阶段加强监控,并在后训练阶段更重视对齐与安全,以防范此类攻击再度发生,体现其对模型安全的重视。
2026-08-18 13:00 Ars Technica
研究人员发现微软 Copilot 存在一个隐藏的秘密参数,攻击者可借此在用户点击链接时窃取密码。该漏洞揭示了主流 AI 助手在输入处理上的安全隐患,引发业界对提示注入防护的担忧。
2026-08-17 06:57 The Verge
Anthropic 澄清了其对 Claude 生成文本应用不可见水印的具体方案,以符合监管要求。水印可标记经 Claude 处理的任何内容,且能抵抗编辑篡改,为 AI 内容溯源提供了技术路径。
2026-08-18 09:00 MIT Technology Review
分析指出,AI 行业宣称的“自我改进、几乎无需人类监督”的愿景可能被夸大。受数据、算力与验证瓶颈制约,递归自我改进的落地进程或远慢于预期,为过热预期提供了冷静视角。
2026-08-18 13:50 TechCrunch
OpenAI 正式发布 ChatGPT 青少年模式,内置与年龄匹配的安全措施、家长控制和辅助学习工具,旨在引导青少年正确、安全地使用 AI。此举在无数未成年人早已使用该产品多年后补上了安全短板。
2026-08-18 09:00 The Verge
Mozilla 为 Firefox 推出 Smart Window AI 浏览模式,让 AI 对话可直接调用实时网页信息并显示来源链接。这标志着 AI 浏览器从“聊天窗口”迈向与实时网络深度融合的新阶段。