iFeeling Daily
每天精选值得关注的 AI 动态
OpenAI 自研芯片 Jalapeño 实测成绩公布

OpenAI 首颗自研推理芯片 Jalapeño 交出实测成绩:每瓦吞吐更高、延迟更低。GPT-5.6 Sol 还比对手少用 54% 输出 token——效率就是这么变成真金白银的。
Keenable获2600万美元融资,为AI重建搜索基础设施

Keenable 获 2600 万美元种子轮融资,要为 AI 时代重建搜索基础设施,让大模型直接检索网页而非返回链接列表。
Hugging Face 如何用三类云服务为 Papers with Code 构建混合搜索
Hugging Face 用 Jobs、Buckets、Inference Endpoints 搭了混合检索搜索架构,让 Papers with Code 能按语义找论文,还分享了冷启动降级、向量契约等实战经验。
量化感知修复:4 位模型性能反超全精度原版

一篇关于量化感知恢复(QAH)的论文:把模型压缩到 4 位后,通过蒸馏原始教师模型,让缩小版模型在多数基准上超过其全精度版本。
AI牛鞭效应

AI硬件瓶颈沿GPU、内存、CPU、存储依次传导,牛鞭效应正在推高数据中心成本,泡沫风险隐现。
大型机曾走向个人电脑,你的数据中心也会如此

本地AI已能回答89%的日常问题,能耗与成本却大幅下降,大模型推理正加速走向边缘。
语音识别基准优化现象的量化测量
利用三种新探针测试11个开源ASR模型,发现多个高分模型会复现基准错误转录、恢复静音数字并切换拼写,即使音频与之矛盾。
Starcloud 融资 2.5 亿美元打造轨道 AI 数据中心,应对发射资源紧张

Starcloud 再融 2.5 亿美元造轨道数据中心,估值 23 亿,已锁定 Nvidia 投资,正抢购发射能力应对火箭短缺。
AI数据初创Micro1年运行率达5亿美元

AI训练数据需求爆发,Micro1八个月将年运行率从1亿做到5亿美元,合成数据可多次销售,毛利率高达90%,净年运行率约1.5亿-2亿美元。