iFeeling Daily
每天精选值得关注的 AI 动态
OpenAI新推理技术引发AI安全警报

OpenAI新推理技术让AI思维链变“黑箱”,安全专家集体警告:若不控制,可能彻底摧毁可监控性。
Pangram CEO:互联网已濒临“死亡”

Pangram CEO 预警:互联网已接近“死互联网理论”成真,900 万美元融资的 AI 检测工具正成为信任层,与 Substack 合作识别 AI 创作内容。
使用Mantis框架入门:发现和修复漏洞

Google开源了Mantis框架,用agentic技术自动发现、复现和修补漏洞,减少超85% token开销,真阳性率远高于传统方法。
HiddenLayer获1亿美元B轮融资,企业AI安全需求爆发

HiddenLayer融资1亿美元,ARR增长10倍以上,企业争相为AI部署买保险。AI安全市场今年预计达28亿美元。
亚马逊购物AI新增消息诈骗检测功能

亚马逊的Alexa for Shopping现在能帮你判断收到的消息是不是诈骗,每年36万用户已无需再打电话问客服,直接问AI就行。
OpenAI 因枪击案再遭 30 起诉讼,首次指控协助教唆

OpenAI 因 Tumbler Ridge 枪击案再遭 30 起诉讼,首次指控公司协助教唆而非仅过失,直指安全决策被公关主导。
OpenAI Astra模型即将发布,擅长攻破计算机系统

OpenAI透露Astra模型能自主发现并利用零日漏洞,在ExploitBench上拿了满分,但安全评估尚未获得第三方验证,测试者身份不明。
BenchMIRT:LLM基准测试到底在衡量什么?

新方法BenchMIRT利用多维IRT揭示LLM基准测试中混合的能力信号,发现安全性与推理是两大核心维度。
Astra 之路:关键能力与前沿安全保障

OpenAI 公布 Astra 模型达到关键网络安全阈值:能自主发现零日漏洞并构建利用链,同时部署了拒接率91.5%等严格保护措施。