推荐算法日报 - 2026-06-13

生成式检索从概念走向工业落地:今日两篇高分论文均聚焦于用生成式模型统一或替代传统多阶段召回。快手的 OneRetrieval 首次在电商搜索中实现可编辑的生成式检索,统一多分支召回并显著提升订单量。这表明生成式检索正从学术概念向解决工业级“可编辑性”和“大规模部署”等核心痛点演进。; 向量检索系统架构向成本效率倾斜:小红书的 Helmsman 系统挑战了内存图索引(HNSW)的主导地位,通过构建基于全闪存服务器的聚类ANNS,结合用户态存储栈和GPU加速,将硬件成本降低90%。这揭示了在数据规模

AI 技术日报 - 2026-06-13

今日 AI 领域迎来多个重磅发布:MiniMax 开源 428B MoE 模型 M3,搭载自研稀疏注意力实现 1M 上下文 14 倍加速;Kimi 发布 K2.7-Code,编码 agent 能力提升超 30% 且推理 token 减少 30%。同时,Sapient 公司声称以约 1500 美元从零训练出 1B 基座模型 HRM-Text,直接挑战预训练 Scaling Law。MCP Dev Summit 2026 释放协议无状态化与 'Shadow MCP' 治理挑战等关键信号。产业层面,Q1 AI 融资 242B 美元中四大公司吸走 65%,资本集中度持续加剧。

推荐算法日报 - 2026-06-12

LLM 深度融入推荐系统全链路:今日多篇论文展示了 LLM 不再仅是辅助工具,而是直接参与推荐核心环节。从 Google 的实时用户画像生成(召回/排序特征),到 CompRank 的 LLM 重排序,再到 TAA-k 优化 RAG 上下文选择,LLM 正在渗透召回、排序、重排等各个阶段,且开始关注工业级部署的效率和成本问题。; 生成式模型成为解决推荐顽疾的新范式:DiffCold 使用扩散模型解决冷启动中的“跷跷板困境”,通过生成式方法统一冷热物品的表示空间。这表明生成式模型(扩散模型、LLM

AI 技术日报 - 2026-06-12

今日 AI 领域迎来多个重磅事件:Jeff Bezos 首次公开其 AI 创业公司 Prometheus,以 120 亿美元融资和 410 亿美元估值成为 2026 年最大 AI 融资事件。模型竞争格局突变,GPT-5.5 在全新 Agents' Last Exam 基准上意外击败 Claude Fable 5,而 Anthropic 因社区抗议撤回对 Claude Fable 5 的隐形限制政策。OpenAI 收购云编排公司 Ona 为 Codex Agent 构建持久化企业环境,AWS 发布 Agent-EvalKit 开源评估工具,Agent 基础设施正加速走向生产级。学术方面,阿里 Q

推荐算法日报 - 2026-06-11

LLM 的工业级落地:从"能不能用"到"怎么用好":今日多篇论文聚焦于将 LLM 的语义理解能力以低延迟、低成本的方式融入工业推荐系统。快手提出的 AIR 框架通过离线推理+在线检索组合实现 400 倍加速,是 LLM 在跨域推荐场景中成功落地的典型案例,证明了 LLM 在工业界不再是"空中楼阁"。; 长序列建模的"记忆革命":从压缩到解耦:针对长序列推荐中线性注意力导致的语义状态沉没问题,快手提出的 SinkRec 通过外部化记忆模块,将重复行为模式从状态中解耦出来,让模型专注于动态变化。这种

AI 技术日报 - 2026-06-11

今日 AI 领域迎来多项重磅发布与深刻洞察:Google DeepMind 发布 DiffusionGemma,以扩散模型替代自回归解码实现 4 倍推理加速,标志非自回归文本生成新范式;NVIDIA 与 Apple、Google 合作将机密计算引入 Apple Private Cloud Compute,为 AI 隐私基础设施树立里程碑。同时,MIT 研究揭示 AI 依赖悖论——用 LLM 验证新闻反而降低独立辨伪能力,Cursor 从 15 人增长至 700 人并覆盖 60% 财富 500 强,Anthropic CEO 发文警示 AI 进展远超政策制定速度。多篇工业界论文聚焦 Agent

推荐算法日报 - 2026-06-10

生成式推荐进入精细化调优阶段:今日多篇论文聚焦于生成式推荐(GR)的落地痛点。从京东的AdaGRPO(自适应门控GRPO解决奖励模型噪声)到Yandex的Gryphon(统一SID生成与物品级评分解决序列似然与相关性目标不一致),再到山大的PRO(理论分析索引-解码间隙),业界正从“能否用GR”转向“如何让GR更鲁棒、更精准、更简化系统”。核心趋势是:在GR框架内引入更精细的控制机制(门控、评分、理论指导),而非推翻范式。; 长序列建模与语义化ID成为工业级推荐标配:Meta的论文展示了在十亿用

AI 技术日报 - 2026-06-10

今日 AI 领域迎来重磅发布:Anthropic 正式推出 Claude Fable 5 与 Mythos 5,被 Andrej Karpathy 称为“值得大版本号跳跃的阶跃式进步”,在 CursorBench 上以 72.9% 创下新纪录,Stripe 用其将 5000 万行 Ruby 代码迁移从数月缩短至一天。与此同时,OpenAI 提交 IPO 保密文件,估值 8520 亿美元,与 Anthropic(估值 9650 亿美元)竞逐公开市场。FrontierCode 基准发布揭示编码 Agent 真实能力远低于 SWE-Bench 表现,最难的第三级任务最佳模型仅 13% 成功率。Goo

推荐算法日报 - 2026-06-09

生成式推荐进入深水区:动态语义ID成为核心战场 今日多篇论文(SSRLive、DREAM、CaLIR)聚焦于生成式推荐中的语义ID(SID)问题。业界共识已从“能否用SID做推荐”转向“如何让SID动态适应内容变化和冷启动”。SSRLive提出动态SID解决直播内容快速变化,DREAM通过三阶段框架解决冷启动SID分配,CaLIR则用类别引导的隐式意图推理弥补查询与SID的语义鸿沟。这表明生成式推荐正从静态范式向动态、自适应范式演进。; LLM+RAG成为跨域冷启动的标配方案 DoorDash的

AI 技术日报 - 2026-06-09

今日 AI 领域迎来多个里程碑事件:DeepSeek 启动 74 亿美元首轮融资,估值达 520-590 亿美元,中国大模型竞争格局生变。同时,OpenAI 与 Anthropic 均提交机密 S-1 文件,启动 IPO 准备。Agent 生态全面走向生产级——Kimi 发布支持 300 个并行代理的桌面端 Kimi Work,Perplexity Computer 与哈佛合作研究显示任务耗时降 87%、成本降 94%,AWS 推出云端托管编码 Agent 方案 Bedrock AgentCore。技术层面,FrontierCode 新基准揭示半数 SWEBench 结果不可合并,vLLM-O

AI 技术日报 - 2026-06-08

今日 AI 领域呈现"中美模型竞争白热化"与"硬件生态深度绑定"两大主线:中国模型在 OpenRouter 上首次全面超越美国模型,Kimi K2.5、MiniMax M2.5 和 DeepSeek V4 成为关键驱动力。硬件层面,NVIDIA 与 SK Hynix 达成多年内存技术合作,黄仁勋警告芯片短缺将持续数年。同时,OpenAI 定制芯片负责人 Clive Chan 跳槽 Anthropic,AI 芯片人才争夺战升级。Codex 推出"每日一人 10 倍用量"挑战,Slack 揭秘万亿级消息搜索架构,GPU Direct Storage 实战指南展示检查点从 5 分钟降至 40 秒的突

AI 技术日报 - 2026-06-07

今日 AI 领域在安全、效率与融资三个维度齐头并进。OpenAI 推出 ChatGPT Lockdown Mode,以确定性机制阻断 Prompt 注入数据窃取,为 Agent 安全提供关键防线。MiniMax M3 在代码审计中以 $0.07 成本与 Claude Opus 持平,再次验证低成本模型潜力。AI 编码初创公司 Lovable 以 120 亿美元估值融资,AI 债务融资市场预计达 2500-3000 亿美元,产业金融化趋势加速。同时,DeployBench 基准揭示 Agent 在自主部署上的显著差距,而 Agentic AI Worm 概念则敲响自适应恶意软件的新警钟。