推荐算法日报 - 2026-08-27

生成式推荐进入"动态语义ID"时代:今日多篇论文(TAGR、Tlow、PRQ-KMeans、CodeHID)聚焦语义ID(Semantic ID)的构建与优化。从静态SID到TAGR的时序动态LSID、Tlow的flow-based分布变换、PRQ-KMeans的投影残差量化,业界正从"如何生成ID"转向"如何让ID适应动态变化的工业场景"。核心矛盾是ID的稳定性(保证自回归生成可学习)与时效性(追踪直播、新品等动态内容)之间的权衡。; 冷启动与检索效率成为双塔/向量召回的核心战场:Retrie

AI 技术日报 - 2026-08-27

今日 AI 领域迎来开源模型的"效率革命"双响炮:智谱揭晓神秘模型 Ox Alpha 实为 GLM-5.3-Flash,320B-A18B MoE 架构训练成本仅为 Qwen3.7-Plus 的 1/9,且已在国产 AI 芯片集群上实现 3 倍推理效率提升;阿里同步开源 Qwen3.8-Flash,125B 参数仅 6B 激活,超前预览 Qwen4 架构。产业侧,AWS 与 NVIDIA 宣布 2027-2028 年新增 200 万 GPU 的算力军备扩容,ChatGPT Work 新增浏览器/电脑操作能力,Salesforce 推出 Claudeforce 让 Claude 原生跑在 CRM

推荐算法日报 - 2026-08-26

LLM 与生成式推荐进入"反思期":今日多篇论文(DuELRec、The Laws of Context Allocation、Spotify 推理轨迹研究)不再盲目堆叠 LLM 能力,而是深入剖析其失效模式——负迁移、注意力稀释、推理质量与效果脱节。工业界开始用因果推断、门控机制、闭环调度等"外科手术式"手段精准修复 LLM 在推荐中的短板,而非简单替换传统模型。; 从"点估计"到"分布建模"的深化:HEGM 对观看时长分布建模、WARP 用 Wasserstein 距离校准意见分布、N2DC

AI 技术日报 - 2026-08-26

今日 AI 领域最重磅的信号来自芯片与算力格局:OpenAI 自研推理芯片 Jalapeño 公布首份实测数据,700W 功耗下每千瓦吞吐量比 NVIDIA GB300 高 1.9 倍、延迟低 3.6 倍,16 个月完成流片,首次在能效维度对 NVIDIA 形成实质性挑战。与此同时,SemiAnalysis 创始人 Dylan Patel 预测到 2028 年 Anthropic 与 OpenAI 将控制全球大部分算力,超 10 万亿美元资本开支或引发主权债务危机。Agent 生态持续走向生产级:Perplexity 发布完全本地化的 Portable Computer 运行时,Andrew

推荐算法日报 - 2026-08-25

Semantic ID 统一化与动态化:今日三篇工业界论文(快手、DoorDash)不约而同聚焦 Semantic ID 的工程化升级。快手用单级大码本替代多级残差量化,DoorDash 用单一层次化 SID 同时支撑推荐排序与搜索改写。共同趋势是:从"多级小码本"走向"单级大码本",从静态码本走向曝光感知的动态更新,以解决码本漂移、解码开销大、跨任务表示割裂等落地痛点。; LLM 与知识增强的"轻量化"落地:无论是百度 Clarify-Then-Search 的澄清-重写-检索链路,还是 CA

AI 技术日报 - 2026-08-25

今日 AI 基础设施领域迎来密集发布:Meta 双线并进,推出首款专为推荐系统训练设计的 MTIA 300 芯片与全新 RDMA 网络协议 MetaRoCE;NVIDIA 则在 Hot Chips 2026 前后三连发,Vera Rubin NVL72 实测每兆瓦吞吐量提升最高 30 倍,并开放 NVLink Fusion 允许自研 XPU 接入。产业格局层面,Hugging Face 探索以 130 亿美元估值出售,较 2023 年增长近 3 倍;中国开源模型已成研究默认,约 40% 论文提及。Agent 生态持续演进,AWS 发布 Agentic Resource Discovery 开放

AI 技术日报 - 2026-08-24

今日 AI 领域呈现"成本分化"与"效率革命"双主线:Anthropic 旗舰模型 Fable 5 因成本高企采用率仅 8%,而 DeepSeek V4-Pro 峰值定价暴涨 355%,"免费午餐"时代正式终结,混合模型策略成为 Agent 工程新常态。开源侧则迎来爆发——FlashML 发布 FreeToken 推理引擎,让 20GB 模型在 16GB VRAM 上跑出 ~100 tok/s;NVIDIA 开源 ACES 技能评估框架,为 Agent 生产级部署提供量化标尺。美光警告 AI 内存墙加剧(算力每两年超出 HBM 带宽 3 倍),X 推出广告 MCP 服务器标志 MCP 生态向垂

AI 技术日报 - 2026-08-23

今日 AI 领域迎来多个标志性事件:NVIDIA 发布 AVO 架构,在 ARC-AGI-3 基准上将 Claude Opus 5 从 30% 提升至 100% 满分,首次以定量证据证明"系统设计 > 模型能力";Anthropic 被曝 IPO 拟募资超 1000 亿美元、估值或达 2 万亿美元,抢跑 OpenAI 上市,AI 资本市场进入倒计时。Meta 以 0.2 美元/百万 token 的激进定价发布 Muse Code 编程代理,直接冲击 Claude Code 与 Codex 市场。Gemini 3.7 Flash 成谷歌增长最快模型,ARC-AGI-2 达 84.6%;a16z

AI周报 2026-W34

本周 AI 领域有一条清晰的主线:能力的增长节奏正在逼迫评估、治理和安全体系同步提速。Sam Altman 宣布暂停部分前沿 RL 训练(本周最重磅的产业事件),理由是能力进步超出了安全和对齐的节奏。与此同时,NVIDIA 的 AVO agent 在 ARC-AGI-3 上完成全部 183 关拿下 100%,Ornith-1.5 通过自我改进训练追平 Claude Opus 4.8——能力端与安全端在同一步频上加速,形成张力。 第二条线是评测与训练环境的范式转移:从静态、零样本的基准走向实时、长时程、自生成的环境。本周的 FM-Bench(AnalogyAI)用 20 年足球管理模拟检验长期决策,EnvHarness(Google)让静态环境学会自适应演化,Wuying-Browser-Agent(阿里云)则直接引入平均 37.9 步的 BrowserBench——评测不再测"能不能",而是测"能否长期稳定地做"。 第三条线是推理优化进入工程精细阶段:LFM2.5-DSpark(Liquid AI)的推测解码带来 3.2 倍加速,LMSYS 的权重缓存守护进程把引擎加载从 495 秒压到 0.63 秒。成本曲线在多个层面被压低。

推荐周报 2026-W34

本周(2026-08-16 ~ 2026-08-22)推荐系统研究围绕三条主线展开:工业级系统从"分场景模型"走向"统一架构"、生成式推荐从"能离线跑"转向"可上线服务"、Agent 化推荐进入工程化和评估规范化阶段。 主线1:统一架构加速整合多业务流。 小红书的 OneModel 用单个模型统一自然推荐、广告和商家三条流量线,线上广告侧 CTR 提升 8.18%;Meta 的 UniDot 从 FM 点积视角统一序列建模与特征交互。两篇工作的共同指向是——存储和算力红利消退后,多场景碎片化部署的工程成本成为主要矛盾。 主线2:生成式推荐加速落地。 快手的 OGR 实现了端到端生成有序 slate,线上 Effective Views 提升 1.120%,NDCG@5 在工业数据上提升 48.2%。EchoRec 将多 token 预测从效率工具拓展为密集监督信号。生成式推荐本周的关键词是"产出物"——不只是生成单个 item,而是生成有序列表。 主线3:Agent 化推荐系统的工程化。 阿里巴巴的 PILOT 将 LLM agent 用于实验管理和策略搜索,搜索效率从 53.3% 提升到 93.3%;微软的 AdsWorldEngine 在对话广告场景让 agent 与工具协同进化,线上 RPM 提升 22%。Agent 推荐正在从单点推理走向流程治理。

推荐算法日报 - 2026-08-22

[量化压缩成为检索系统降本增效的核心战场]:今日多篇论文聚焦 Embedding 量化压缩,但思路已从"均匀比特分配"转向"结构感知"。Microsoft 提出基于 Matryoshka 几何结构的可变比特分配(PQ 提升 8%、SQ 提升 18%),Virginia Tech 的 CrossQ 则通过任务对齐的跨 token 条件量化,在 4 B/token 下实现 64x 存储压缩且保留 98% 全精度 MRR@10。核心洞察:量化不应只最小化重建误差,而应服务于检索排序目标——"winne

AI 技术日报 - 2026-08-22

今日 AI 领域迎来多重里程碑:NVIDIA 以 120 亿美元"反向执行收购"Poolside,创始人留任获 10 亿美元、员工获 60 亿美元,同时微软确认首批生产型 Vera Rubin 芯片交付,算力饥渴正在重塑产业边界。模型侧,DeepSeek 发布多模态新模型对标 Opus 4.8,Harvey 推出法律专用模型 Tenet,Gemma 4 31B 以约 1/40 成本匹敌 Sonnet 5 回答质量。基础设施层面,乌兰察布 12.5GW 数据中心承诺超 Stargate,中国 AI 产业首次大规模自建基础设施;Percy Liang 启动 535B 参数全程开源训练,UC Ber

1
...
34567
...
30