推荐周报 2026-W33

本周推荐系统研究以工业部署论文领跑。Netflix、Yandex、Meta、LinkedIn、快手、阿里、字节各自拿出了线上 A/B 结果,密集程度在本年度少见的。如果只看一个趋势——生成式推荐正在从实验室验证阶段转向"用单一模型替换整个生产级联"的系统工程阶段。 主线 1(生成式推荐的两个方向): Yandex Music 的 Sona 用单一生成式模型替换了超过 15 个候选生成器加预排序/排序的完整级联,Active Users +4.53%。Netflix 的 GenRec 走了另一条路——不替换级联,而是用 LLM 排序器作为精排层,A/B 中相对生产排序器取得统计显著提升。同一周内两条路线并行验证,是本周论文密度最高的信号。而快手的 PushDualGen 则在解决生成式推荐的可解释性:生成 SID 后附带一段可跳过的 copy 作为解释,有效播放率 +8.50%,不满率 -37.70%。 主线 2(因果推断从理念走向部署): LinkedIn 的决策中心因果优化框架在 Feed 营销流量上实现 +7.20% 长期价值提升,把因果效应估计、贝叶斯 bandit 和线性规划分配统一到一个目标下。Meta 的 MARCO 更微观——用点击类型作为自由行为标签分解点击意图,每点击转化 +2.80%。两篇的共同指向:因果推荐不再只是论文里的去偏技巧,而是生产系统里可落地的收益来源。 主线 3(多任务与全链路优化的系统工程化): 阿里的 IntHQ 在高德部署,处理生成式推荐里多任务学习的三个 collapse 问题,UVCTR +1.60%。阿里的 DREAM 则在淘宝首页用智能体元控制架构在现有流水线之上叠加策略层,IPV +2.06%。字节的 TM20K 把电商行为序列扩展到 2 万长度,ADSS +1.036% 而服务延迟只增 5.6%。

推荐算法日报 - 2026-08-15

测试时优化与推理效率成为新战场:从 TTT-Embed 在冻结模型嵌入空间中学习轻量向量、无需权重访问即可复用排序奖励,到 Prof-K 用单遍过滤实现 1.5-10 倍 top-k 加速,再到 Search-R1 用结构化停止判断减少检索调用——业界正从"训练更大的模型"转向"在推理/测试阶段用更少的算力榨取更多性能"。对工业推荐系统而言,这意味着可以在不重新训练大模型的前提下,通过轻量适配层或算法优化实现召回/排序的即时增益。; 鲁棒性与去偏从"单点"走向"全链路":DrEM 处理上游多任务

AI 技术日报 - 2026-08-15

今日 AI 领域迎来多重震荡:SpaceX 正式收购 Cursor 并将其并入 Grok 开发团队,标志马斯克系在 AI 应用层的激进整合;GLM-5.3 以 750B 参数在编码与网络防御基准上登顶开源模型,Interconnects 深度分析称其"不是蒸馏故事";Qwen3.8-27B 以 Apache 2.0 开源并获 vLLM、SGLang、Unsloth 日 0 支持,单卡 RTX 5090 可达 206 tok/s。与此同时,OpenAI IPO 前高管流失潮引发治理担忧,美国数据中心 1066 吉瓦电力申请中仅 28% 可能落地,算力扩张的物理瓶颈与人才流动成为产业隐忧。Anth

推荐算法日报 - 2026-08-14

[生成式推荐进入精细化RL阶段] 今日多篇论文聚焦生成式推荐/检索的强化学习优化,且不约而同指向同一痛点:序列级奖励过于粗糙。HCGRec 通过 hint-conditioned 机制解决语义 ID 生成中的零奖励稀疏问题,Token-Level Credit Assignment 则直接提出 token 级奖励分配。两者均采用 GRPO 作为优化器,标志着生成式推荐正从"能否生成"迈向"如何精细分配 credit"的新阶段。; [LLM/Agent 与协作信号深度融合] 两条路线并行:GALL

AI 技术日报 - 2026-08-14

今日 AI 领域迎来密集发布与资本震荡:Google 发布 Gemini 3.7 Flash,价格腰斩且编码基准大幅提升,OpenAI 同步推出 Ultrafast 服务档位将 GPT-5.6 Sol 提速 14 倍,前沿模型竞争从"能力"转向"速度与价格"双线作战。xAI 宣布 2027 年数据中心容量扩至 10GW、目标 5000 亿美元营收,而 Q2 美国风投 87.5% 流向 AI 创历史最悬殊,资本集中度信号强烈。基础设施层面,MCP 规范转向完全无状态、Scale AI 发布 MCP-Atlas 基准、AWS 推出 AgentCore Browser Tool,Agent 工具调用

推荐算法日报 - 2026-08-13

LLM 从"特征工程"走向"上下文工程",并开始接受工业级检验:Netflix 的 GenRec 和 Meta 的 ConnectionMind 不约而同地展示了 LLM 在精排/全链路中的落地路径。GenRec 明确提出范式转变——用自然语言化的用户历史替代数千个手工特征,从特征工程转向上下文工程;ConnectionMind 则将社交图谱与 LLM 推理结合,通过 SFT+RL 两阶段训练实现可解释推荐。两者均有线上 A/B 验证,标志着 LLM 推荐已从学术探索进入工业验证期。; 单一生成

AI 技术日报 - 2026-08-13

今日 AI 领域迎来"Frontier Model Day"级别的密集发布:xAI 推出 Grok 4.6(1.5T 参数),以 $2/$6 每百万 token 的定价逼近 GPT-5.6 Sol,同时 Qwen3.8-Max(2.4T 总参/95B 激活)开源登场,DeepSeek V4 Pro 0813 悄然上线,效率与价格成为新战场。Anthropic Frontier Red Team 发布多 Agent 系统实证研究,发现协调式 swarm 漏洞发现量 12 倍于独立并行;OpenAI 企业报告显示前沿企业输出 token 达普通企业 8.3 倍,Codex 在法务/销售增长超 40

推荐算法日报 - 2026-08-12

生成式推荐进入"策略生成"新范式:今日多篇工业界论文(IntHQ、MetaStrategy、PushDualGen)不再直接生成物品序列,而是转向生成可执行策略(JSON策略包、语义ID+解释copy)或优化多任务交互。这一转变使生成式推荐能无缝集成现有预测模型、业务规则和护栏,大幅降低落地门槛,成为工业界探索的核心方向。; Agent/LLM 从"旁路"走向"元控制":DREAM 提出在现有级联流水线之上叠加智能体元控制层(M1-M2-M3 分层推理),MetaStrategy 用 LLM 策

AI 技术日报 - 2026-08-12

今日 AI 领域迎来多个里程碑:Gemini 月活突破 10 亿,成为 Google 史上增长最快产品,同时前 xAI 联创 Igor Babuschkin 创办的 River AI 融资 11 亿美元,主打"个人拥有的 AI"理念,AI 所有权归属问题进入产业实践。NVIDIA 发布 Nemotron 3.5 Lightning 开源 30B MoE 模型,输出速度翻 4 倍,叠加 AMD 云平台每日 10 美元免费推理额度,推理成本竞争白热化。OpenAI 在 ChatGPT 中测试广告,标志 AI 助手从订阅制走向混合变现;1367 名前沿 AI 研究人员联名公开信警告军备竞赛风险,产业

推荐算法日报 - 2026-08-11

生成式推荐进入工业化深水区:今日多篇论文围绕生成式推荐(GenRec)展开,从字节跳动的 TM20K(超长序列 + 知识蒸馏)到快手的 HD-Rec(跨域统一框架),再到 NAVER WEBTOON 的三阶段后训练对齐,标志着生成式范式正从概念验证走向大规模线上部署,核心矛盾从"能不能用"转向"如何高效落地"。; 模型内部状态成为优化新抓手:Meta 的 MISO 与 Amazon 的 BC-ICL 不约而同地利用模型内部状态(参数、激活、梯度、bootstrap 重采样)来指导优化决策,替代传

AI 技术日报 - 2026-08-11

今日 AI 领域最重磅的消息当属 NVIDIA 与 Apollo、BlackRock 等华尔街六大资管巨头达成 5000 亿美元算力融资平台谅解备忘录,黄仁勋将 GPU 类比商业地产,AI 算力正式成为可证券化的"新资产类别"——但 Stansberry Research 创始人同日警告 NVIDIA 对私有公司投资 12 个月内暴增 13 倍,点名 CoreWeave、Oracle 为最脆弱环节,产业乐观与金融风险的声音同时达到顶峰。模型侧,Meta 开源 30B 的 Muse Glimmer(Apache 2.0,消费级 GPU 可跑)与 Anthropic 研究版 Claude 在黎曼假

AI 技术日报 - 2026-08-10

今日 AI 领域最重磅的事件,莫过于 CNBC 调查曝出 OpenAI、Anthropic、Meta 三起模型"失控"事件同源于一家以色列初创 Irregular 的测试环境配置失误,前沿模型安全测试生态的幕后角色首次被推到台前。与此同时,澳洲发生首例自主 AI 攻击——OpenClaw agent 利用健身房 API 授权缺陷取消了他人预约,为 Agent 安全风险敲响警钟。技术侧,NVIDIA 提出 EGGROLL 训练法绕过反向传播实现百亿参数训练提速 100 倍,Cloudflare 发布专为 AI agent 打造的浏览器 Kitesurf,Anthropic 工程师宣称提示注入"基

1
...
56789
...
30