iFeeling Daily
每天精选值得关注的 AI 动态
AI 替代浪潮:当开源模型跨过足够好门槛

当所有公司都在抱怨模型变贵时,头部玩家已经在通过模型路由和后训练两种方式,一边保持 token 指数级增长一边把成本死死压住,甚至能做到效果更好成本只剩十分之一。
Claude Fable 5 正式上架 Google Cloud

Google Cloud 正式上架了 Anthropic 最新的旗舰模型 Claude Fable 5,主打复杂多步推理。
Project Glasswing 扩大规模

Anthropic的Project Glasswing将合作伙伴从50家扩展到150家,已发现超1万个高危漏洞。文章探讨了如何让AI从漏洞发现走向自动修复,以及未来网络安全格局的深刻变化。适合关注AI安全与基础设施防护的人。
FFmpeg 与 VLC 开发者揭秘互联网视频技术栈

VLC 和 FFmpeg 的核心开发者对谈,揭秘互联网视频技术栈的底层逻辑。拒绝广告收入保持开源纯粹、与 Google 的持续摩擦、手写汇编优化性能,这些硬核细节让这期节目成为理解开源多媒体基础设施的最佳入口。
使用gcs-analytics-core优化Iceberg和Spark工作负载

新开源库通过并行读取和智能预取,大幅提升GCS上Iceberg查询性能,TPC-DS测试扫描时间降低最高71.5%。
Google 把图算法原生集成进 Spanner 数据库

Google 把图算法直接做到了 Spanner 数据库里,解决了以前跑图分析必须建 ETL 管道、或者影响线上性能的难题。核心是把计算和存储解耦,用独立资源跑算法,数据不动、结果直接写回,号称十亿边规模分钟级跑完。
实测:GKE 多集群推理网关 + TPU + 托管 DRANET 跨区域容灾

Google Cloud 在 GKE 上做了一个跨区域 TPU 推理容灾的实测,用托管 DRANET + Inference Gateway 验证了主集群宕机后流量自动切换的效果。
Trustpilot 如何用 Gemma 构建实时评论数据丰富化架构

Trustpilot 用微调 Gemma 构建了一个日处理百万评论的实时流处理 pipeline。核心思路是把业务逻辑和 LLM 推理解耦成两个独立端点,用 Gemini 做教师模型生成高质量微调数据,最终用 9B 参数的轻量模型跑出了接近大模型的效果和成本可控的推理。
GKE standby buffers:用挂起节点让 autoscaling 更快更便宜

Google 给 GKE 增加了 standby buffers 功能,节点预热后进入挂起状态节省成本,流量来时快速恢复。实测延迟从分钟级降到秒级,成本降低 90%,解决了 autoscaling 性能和费用不可兼得的老大难问题。