iFeeling Daily
每天精选值得关注的 AI 动态
OpenAI 联合博通发布 LLM 专用推理芯片 Jalapeño

OpenAI 联合 Broadcom 为其旗舰模型量身打造的专用推理芯片 Jalapeño 发布,实现了远超现有方案的能效比,并用9个月刷新了芯片开发记录。这不是又一个AI芯片新闻,而是软硬一体全栈整合的终极案例。
OpenAI联手Linux基金会,补AI安全的底层信任层

AI安全的真正瓶颈不是技术不行,而是没人敢信谁的话。OpenAI联手Linux基金会成立Appia,目标是把国际标准翻译成一套开源技术规范,让产业链上下游能对同一套检查标准互认结果,补齐AI治理中缺失的信任层。
创投圈最安静角落并不安静

当所有人说 Crypto 已死时,稳定币却在闷声成为全球 Top 10 美债持有者。这篇文章点出一个被忽视的结构性变化:Crypto 正从投机叙事转向真实交易清算基础设施,而 Allium 这种数据基建公司才是最大受益者。
AI时代的可验证信任:机密计算最新进展

Google Cloud放了个大招:把机密计算和旗舰GPU深度绑定,让敏感数据从CPU到GPU全程加密运行。最硬核的是Prompt Encryption SDK开源,用户和模型之间建立了端到端加密通道。这意味着金融、医疗行业可以放心在云端跑AI推理和微调,不用再担心数据泄露了。
统一日志与追踪:Observability Analytics 支持 SQL 查询

Google Cloud 把日志和追踪数据统一到一个 SQL 查询入口,不用导出数据就能做复杂关联分析。对 AI agent 调试尤其有用:一条语句算清上千次工具调用的失败率和 P95延迟,彻底告别手工翻 trace 图的低效。
Cross-Origin Storage API 在 Transformers.js 中的试验
浏览器跨域缓存隔离让同一份模型权重在不同网站间反复下载,多花 177 MB。交叉存储 API 用 SHA-256 哈希代替 URL 做缓存标识,从根源上解决浪费。Transformers.
IBM CUGA:用两打生产级示例,教你真正写好智能体应用

IBM开源了CUGA智能体运行环境,终于有人把脏活扛了。你只要写工具列表和提示词,规划、状态、安全策略全内置。两打单文件应用直接可跑,还有从笔记本到生产治理的一条路——这才是做智能体的务实姿势。
用本地模型免费实时分类开源仓库的Issue和PR
作者手拿128GB内存的NVIDIA GB10,硬是用gemma和qwen跑出了一套能实时过滤开源项目几百个Issue/PR的本地分类系统。核心思路是半智能体架构:分类走LLM推理,告警走确定性规则,再用vLLM的NVFP4量化把吞吐拉到每秒400+ token。一条7.
BigQuery Managed Python UDF 正式 GA

BigQuery直接把Python运行时塞进SQL引擎,你写个查询就能调NumPy或调外部API,再也不用为了一点Python逻辑维护容器集群了。向量化处理和可配置资源让这玩意儿真能扛生产负载。