本周推荐系统研究围绕三条技术主线展开。 工业级知识蒸馏进入迁移率量化时代: 字节跳动、Meta、微软、阿里分别展示了大规模蒸馏框架。字节的Rec-Distill(24B教师、20K序列)实现蒸馏迁移率>60%,阿里GPlan将LLM推理压缩为隐式token,Meta的LoopFM通过结构化中间表示让蒸馏迁移率翻倍,微软HARNESS-LM以190M参数恢复教师98%精度。四篇的共同指向是——蒸馏已经不只是模型压缩手段,而是把大模型能力“货币化”为可量化的业务指标。 生成式推荐从项目生成走向意图序列与条件生成: 阿里QGS在Quark搜索部署conditional next-item预测,Netflix揭示1B参数生成式推荐中不同任务的缩放天花板,清华SID碰撞分析发现Hit@10被高估103%。三篇共同说明——生成式推荐正在进入精细化评估和条件控制阶段。 推荐系统缩放从“堆参数”转向多维协同与测试时计算: Coupang系统研究CVR模型在骨干、嵌入、数据三个维度的可加缩放效应;阿里UTTSI首次将test-time compute引入CTR,无模型修改下CTR提升5.3%;Meta的rank-aware decomposition使DLRM吞吐量提升87.5%。缩放的核心矛盾已从“能不能大”变为“怎么用得巧”。
今日 AI 领域迎来格局性转折:Anthropic 以 9650 亿美元估值超越 OpenAI,并发布 Claude Opus 4.8 与动态工作流,预告 Mythos 模型即将上线。同时,xAI 发布 grok-build-0.1 API 公测,Step 3.7 Flash 在多平台上线,Cursor 推出 auto-review 模式。论文方面,Anthropic 首次将稀疏自编码器成功扩展到生产级模型 Claude 3 Sonnet,Meta 提出利用历史 FM 中间表示进行知识蒸馏的 LoopFM 框架。开源社区方面,DeepSWE 编程 Agent 基准发布,vLLM 集成 fast
今日 AI 领域迎来历史性转折:Anthropic 以 9650 亿美元估值超越 OpenAI,完成 650 亿美元 H 轮融资,同步发布旗舰模型 Claude Opus 4.8,在编码和 Agent 基准上全面领先。融资与产品双线突破标志着竞争格局的深刻变化。与此同时,Step 3.7 Flash 以 198B MoE 开源、SpaceX 自研 C 语言训练栈声称比 JAX 快 10 倍、Meta 发布推荐系统新范式 SilverTorch,技术路线呈现多元化。Agent 安全与工程实践成为焦点——华为 BeSafe-Bench 揭示所有主流 Agent 安全完成率不足 40%,AWS 分享
今日 AI 领域资本与技术创新双线爆发:Cognition 以 260 亿美元估值完成 10 亿美元融资,Fireworks AI 同步冲刺 150 亿美元估值,AI 编程与推理基础设施赛道热度空前。技术层面,MiniMax 发布 M2.5 模型在 SWE-Bench 达 80.2%,同时开源 M2 技术报告揭示全注意力与 128 专家 MoE 的设计哲学;Hugging Face 实现 Delta Weight Sync 将异步 RL 训练带宽降低 97%,NVIDIA 推出 Polar 框架对 Agent 工具进行 GRPO 训练。此外,ESMFold2 用 LLM 方法在蛋白质折叠领域超
今日 AI 领域迎来多个产业里程碑:Anthropic 年化收入被曝反超 OpenAI 至少 35%,AI 商业格局生变;推理基础设施诞生新独角兽,Fireworks 与 Baseten 估值双双破百亿,标志市场从“训练模型”转向“规模化推理”。同时,Figure 与 JCPenney 运营商签约大规模部署人形机器人,AWS 发布首个托管式 Agent 支付服务 AgentCore Payments,xAI 推出 Grok Build/Skills/Connectors 三件套正面竞争 Claude Code。学术方面,微软提出 ECHO 让终端 Agent 从环境反馈中免费学习世界模型,阿里