iFeeling Daily
每天精选值得关注的 AI 动态
一行命令跑起vLLM服务器
一行命令,在 Hugging Face 上拉起一个私有、按秒计费的 vLLM 端点,兼容 OpenAI API,无需任何基础设施配置。从单卡小模型到多卡122B,再到 SSH 调试和挂载编码代理,每一步都有实操命令,适合快速测试和批量推理。
Agent 正在如何改变工作方式

80%用户用Agent完成超30分钟,OpenAI内部99.8%的Token走Codex。非开发者涨了137倍。知识工作从“问问题”变成“交任务”。
Claude Tag:把AI作为团队成员接入Slack

AI 工具终于不再单打独斗了。Claude Tag 让 Claude 作为团队的一个成员常驻 Slack 频道,共享上下文、异步执行任务、甚至能主动提醒未完成的工作。Anthropic 内部 65% 的代码已经用它生成,不是概念产品,是已经在用的协作方式。
Cross-Origin Storage API 在 Transformers.js 中的试验
浏览器跨域缓存隔离让同一份模型权重在不同网站间反复下载,多花 177 MB。交叉存储 API 用 SHA-256 哈希代替 URL 做缓存标识,从根源上解决浪费。Transformers.
GPT-5 Pro 如何破解免疫学家三年未解之谜

免疫学家Unutmaz用一个困扰实验室三年、传统方法无法解释的T细胞分化谜题,验证了GPT-5 Pro的推理能力。AI不仅指出关键蛋白IL-2的作用,还正确预测了未发表的实验结果。这不再是信息检索,而是真正的科学协作。
开源模型+行业数据:AT&T与GSMA用Gemma给电信AI趟路

电信行业有张自己的“考卷”,通用大模型几乎得零分。GSMA和AT&T用谷歌的Gemma开源模型做了一次教科书式的示范:用行业私域数据微调出的小模型,准确率碾压通用巨无霸,还把幻觉控制住了。这条路径对所有垂直行业都有直接参考价值。
Omio 如何用 AI 打造对话式旅行体验

Omio 将 ChatGPT 接入3000多家交通供应商,打造对话式旅行体验,内部开发效率提升5倍。
用本地模型免费实时分类开源仓库的Issue和PR
作者手拿128GB内存的NVIDIA GB10,硬是用gemma和qwen跑出了一套能实时过滤开源项目几百个Issue/PR的本地分类系统。核心思路是半智能体架构:分类走LLM推理,告警走确定性规则,再用vLLM的NVFP4量化把吞吐拉到每秒400+ token。一条7.
用Codex跑长期任务的实操指南

很多AI教程只教你怎么写单次prompt,但这篇文章告诉你当任务要跑几小时甚至几天时该怎么维持上下文不断裂。它把Codex当工作台用,核心是拆解出可验证的小步骤、设检查点、并明确什么时候该让人来判断。很务实的一套协作手册,适合每个被长任务搞崩溃的人。