iFeeling Daily
每天精选值得关注的 AI 动态
皮尤研究:ChatGPT 发布后超三分之一网页疑似 AI 撰写

皮尤研究显示,ChatGPT 发布后超三分之一的网页带有 AI 撰写痕迹,.com 域名比例是教育或政府域名的 10 倍。
Google 追踪三个俄罗斯网络间谍集群滥用合法认证流程

Google 追踪到三个俄罗斯背景的钓鱼集群,专攻滥用合法认证流程,从应用密码到设备代码,手法隐蔽且针对性强。
OpenAI 推出客户隐私保护新服务,叫板 Anthropic

OpenAI 推出不保留数据的滥用监控服务,直接对标 Anthropic 的 30 天数据保留政策,企业客户隐私竞争再升级。
OpenAI 因技术故障撤回部分安全员受限网络项目访问

OpenAI 撤回了一批安全研究员 TAC 的访问权限,官方承认是技术错误,但要求重新验证身份,影响者全部在美国和欧洲以外。
OpenAI 为零数据保留部署预览私有安全处理

OpenAI 预览 Private Safety Processing:在不牺牲零数据保留承诺的前提下,用客户控制密钥的加密存储和自动化信号,跨交互识别AI滥用风险。
LLM 的类人行为:多维分析模型行为、用户因素与系统提示

这项研究分析了4个主流模型2.1万段对话,发现类人行为普遍存在但可控,且用户认为模型维持边界比人类更合适。
强化国家安全中AI应用的民主监督

OpenAI准备投资500万美元,给政府监督机构提供培训、技术和AI积分,同时试点可查看AI决策输入输出与工具调用的审计工具,并声明证据由监督机构掌控。
面向网络关键能力时代的AI开发节奏调整

Anthropic因AI网络攻击能力增强而放慢训练,强化监控、对齐和安全,监控开销约占推理算力20%。
OpenAI在Hugging Face事件后推出新安全措施

OpenAI在Hugging Face事件后公布新安全措施:监控系统30分钟告警,消耗约20%算力,最大前沿强化学习运行仍暂停。