AI 技术日报 - 2026-08-26

今日 AI 领域最重磅的信号来自芯片与算力格局:OpenAI 自研推理芯片 Jalapeño 公布首份实测数据,700W 功耗下每千瓦吞吐量比 NVIDIA GB300 高 1.9 倍、延迟低 3.6 倍,16 个月完成流片,首次在能效维度对 NVIDIA 形成实质性挑战。与此同时,SemiAnalysis 创始人 Dylan Patel 预测到 2028 年 Anthropic 与 OpenAI 将控制全球大部分算力,超 10 万亿美元资本开支或引发主权债务危机。Agent 生态持续走向生产级:Perplexity 发布完全本地化的 Portable Computer 运行时,Andrew

推荐算法日报 - 2026-08-25

Semantic ID 统一化与动态化:今日三篇工业界论文(快手、DoorDash)不约而同聚焦 Semantic ID 的工程化升级。快手用单级大码本替代多级残差量化,DoorDash 用单一层次化 SID 同时支撑推荐排序与搜索改写。共同趋势是:从"多级小码本"走向"单级大码本",从静态码本走向曝光感知的动态更新,以解决码本漂移、解码开销大、跨任务表示割裂等落地痛点。; LLM 与知识增强的"轻量化"落地:无论是百度 Clarify-Then-Search 的澄清-重写-检索链路,还是 CA

AI 技术日报 - 2026-08-25

今日 AI 基础设施领域迎来密集发布:Meta 双线并进,推出首款专为推荐系统训练设计的 MTIA 300 芯片与全新 RDMA 网络协议 MetaRoCE;NVIDIA 则在 Hot Chips 2026 前后三连发,Vera Rubin NVL72 实测每兆瓦吞吐量提升最高 30 倍,并开放 NVLink Fusion 允许自研 XPU 接入。产业格局层面,Hugging Face 探索以 130 亿美元估值出售,较 2023 年增长近 3 倍;中国开源模型已成研究默认,约 40% 论文提及。Agent 生态持续演进,AWS 发布 Agentic Resource Discovery 开放

AI 技术日报 - 2026-08-24

今日 AI 领域呈现"成本分化"与"效率革命"双主线:Anthropic 旗舰模型 Fable 5 因成本高企采用率仅 8%,而 DeepSeek V4-Pro 峰值定价暴涨 355%,"免费午餐"时代正式终结,混合模型策略成为 Agent 工程新常态。开源侧则迎来爆发——FlashML 发布 FreeToken 推理引擎,让 20GB 模型在 16GB VRAM 上跑出 ~100 tok/s;NVIDIA 开源 ACES 技能评估框架,为 Agent 生产级部署提供量化标尺。美光警告 AI 内存墙加剧(算力每两年超出 HBM 带宽 3 倍),X 推出广告 MCP 服务器标志 MCP 生态向垂

AI 技术日报 - 2026-08-23

今日 AI 领域迎来多个标志性事件:NVIDIA 发布 AVO 架构,在 ARC-AGI-3 基准上将 Claude Opus 5 从 30% 提升至 100% 满分,首次以定量证据证明"系统设计 > 模型能力";Anthropic 被曝 IPO 拟募资超 1000 亿美元、估值或达 2 万亿美元,抢跑 OpenAI 上市,AI 资本市场进入倒计时。Meta 以 0.2 美元/百万 token 的激进定价发布 Muse Code 编程代理,直接冲击 Claude Code 与 Codex 市场。Gemini 3.7 Flash 成谷歌增长最快模型,ARC-AGI-2 达 84.6%;a16z

推荐算法日报 - 2026-08-22

[量化压缩成为检索系统降本增效的核心战场]:今日多篇论文聚焦 Embedding 量化压缩,但思路已从"均匀比特分配"转向"结构感知"。Microsoft 提出基于 Matryoshka 几何结构的可变比特分配(PQ 提升 8%、SQ 提升 18%),Virginia Tech 的 CrossQ 则通过任务对齐的跨 token 条件量化,在 4 B/token 下实现 64x 存储压缩且保留 98% 全精度 MRR@10。核心洞察:量化不应只最小化重建误差,而应服务于检索排序目标——"winne

AI 技术日报 - 2026-08-22

今日 AI 领域迎来多重里程碑:NVIDIA 以 120 亿美元"反向执行收购"Poolside,创始人留任获 10 亿美元、员工获 60 亿美元,同时微软确认首批生产型 Vera Rubin 芯片交付,算力饥渴正在重塑产业边界。模型侧,DeepSeek 发布多模态新模型对标 Opus 4.8,Harvey 推出法律专用模型 Tenet,Gemma 4 31B 以约 1/40 成本匹敌 Sonnet 5 回答质量。基础设施层面,乌兰察布 12.5GW 数据中心承诺超 Stargate,中国 AI 产业首次大规模自建基础设施;Percy Liang 启动 535B 参数全程开源训练,UC Ber

推荐算法日报 - 2026-08-21

LLM 从"编码器"走向"推理体":今日多篇论文(PILOT、TTP、GateDiffInt、rEDMRec)不再将 LLM 当作静态文本编码器,而是让其扮演主动推理、意图解耦、实验设计等角色。LLM 正从特征提取工具升级为推荐系统的"大脑",通过推理蒸馏、Agent 协作等方式在控制成本的前提下注入深度语义理解。; 多模态与多场景走向"大一统":Netflix 用多模态嵌入统一五类画布资产模型,小红书 OneModel 统一自然推荐/广告/商家三大业务流排序。业界正从"每个场景/模态一个模型"

AI 技术日报 - 2026-08-21

今日 AI 领域最重磅的消息当属 NVIDIA 以 60 亿美元收购 Poolside 的"模型工厂"业务,芯片巨头亲自下场整合模型生产能力,研究员普遍收到 NVIDIA offer。与此同时,Z.ai CEO 唐杰宣告"参数规模已死",GLM 5.3 的飞跃全部来自长时程环境 RL 训练,后训练 Scaling Law 成为新范式。医疗 AI 迎来里程碑:Moderna/Merck 个性化 mRNA 癌症疫苗 III 期成功,1137 人入组双终点均优于单药。开源生态方面,社区发布最激进 Qwen3.8-27B 无审查版,18/18 红队通过,引发开源 vs 安全激烈讨论。此外,Harvey

推荐算法日报 - 2026-08-20

[生成式推荐从"生成候选"走向"端到端生成结果":今日多篇论文(OGR、DEPT)不再将生成式模型局限于召回阶段,而是直接端到端生成最终推荐结果(有序 Slate)或统一"查询扩展+检索"。核心挑战从"如何生成"转向"如何让生成目标与最终排序/检索目标对齐"——OGR 用列表级偏好规划 + 奖励引导策略优化,DEPT 用文档嵌入保持微调解决"移动目标"问题。工业落地价值极高,尤其 OGR 已在快手线上验证。; [紧凑 LLM 成为落地主角,效率与效果之争进入新阶段:FLEXRec、CARA 等论

AI 技术日报 - 2026-08-20

今日 AI 领域围绕"隐私安全"与"Agent 工程化"双主线展开。OpenAI 预览 Private Safety Processing,试图调和 Zero Data Retention 承诺与跨交互安全监控的矛盾,正面回应 Anthropic 的企业客户隐私优势;同时 CFO 确认 2027 年上市时间表,商业化路径进一步清晰。开源侧,Ornith-1.5 以自改进策略训练发布三档模型,比肩 Claude Opus 4.8;Qwen3.8-27B 发布 4 天登顶 Cline 本地模型榜首。地缘政治层面,美国出口管制漏洞曝光——中国 AI 公司借道东南亚远程租用 Nvidia 算力,RAS

推荐算法日报 - 2026-08-19

[工业级系统落地成为主旋律]:今日多篇重磅论文来自 Google、Meta、Amazon、PayPal 等一线大厂,且均已在生产环境部署验证。Google Discover 的 SDF 系统将内容过时问题分解为 supersession 和 decay 两种机制并分别建模,两年部署用户投诉下降 54.9%;Meta 的 UniDot 统一特征交互与序列建模,斩获 KDD Cup 2026 工业赛道亚军。工业界正从"单点模型优化"转向"全链路系统级问题拆解",且更强调可部署性和推理成本控制。; [

1
...
34567
...
26