iFeeling Daily
每天精选值得关注的 AI 动态
AI 如何改变人们的工作内容

新研究揭示了 AI 正在如何重塑工作边界:超四成职业特定任务正在被跨领域完成。
如何看待新一轮中国AI恐慌?

硅谷对中国AI模型新一轮恐慌本质是周期性的保护主义表演,背后是少数大厂想借监管关门。
DeepSWE: 抗污染的编码基准测试详解

DeepSWE 基准测试用 113 个原创任务彻底区分了模型真实编码能力。James Shi 展示了 Claude 和 GPT 在任务上的显著行为差异,并解释了怎样设计验证器才能防止作弊。适合关心模型评估和编码 agent 的开发者。
SonderMind:评估驱动开发构建心理健康AI教练

SonderMind 工程师详细拆解了如何为心理健康 AI 构建评估驱动的开发流程:模块化 guardrail、临床反馈循环、治疗师标注转化成 CI 中的 eval,并开源了 300 个经临床审查的测试场景。对构建安全 AI 应用极有参考价值。
Monday.com 最新因AI裁员,另有20家科技公司

Monday.com 裁员600人加入AI裁员潮,FT分析显示引用AI裁员的公司股价跑输纳指10%,而AI公司却在抢人。
视频评估不靠打分:成对比较才是出路

Character.ai 的 Maor Bril 揭秘 AI 视频评估的坑:CLIP 评分抓不住帧间漂移,人工看片不靠谱。他们放弃打分、改用成对比较,训练 Qwen3-VL 裁判在 CI 管道里拦 slop,比跑完再修便宜得多。
从研究到现实:DeepMind VP谈代码生成与模型推理

Benoit Schillings 在 DeepMind 演讲中直指核心:代码生成不再是瓶颈,架构和验证才是。他揭秘 DeepMind 正在用自对弈训练更聪明的模型,并提出未来模型需要具备规划和迁移知识的能力。如果你关心 AI 如何从研究走向真实应用,这 20 分钟干货满满。
代码行动,证明信任:Erik Meijer的AI Agent形式化安全方案

Erik Meijer(Haskell/LINQ/Rx 之父)说现在的 AI agent 就像没系安全带的跑车。他正在用形式化证明给 agent 加装刹车——Automind 框架要求 agent 在执行任何操作前提交机器可验证的证明,从根源杜绝删库、乱报价、装木马。硬核但极度务实。
AI 模型进化后,我们到底该建什么

Theo Browne 在 AI Engineer World's Fair 闭幕 keynote 里喊话:模型都能编排了,你还搁那折腾 Git 和终端?他拿 iOS 拟物化转型做对比,提出新分层法——小需求用 Markdown+cron 搞定,大项目直接对标 AWS。不换思路就别玩了。