- 标签:
- 日报 (307)
- 推荐系统 (188)
- 技术趋势 (184)
- AI (180)
- 周报 (52)
- 论文 (32)
- 思考 (7)
- 推荐 (6)
- LLM (6)
- Agentic Engineering (5)
- 深度学习 (4)
- 工具 (3)
- Transformer (3)
- Harness Engineering (3)
- 强化学习 (1)
- 思维模型 (1)
- 管理 (1)
- 生成式 (1)
今日 AI 基础设施领域迎来密集发布:Meta 双线并进,推出首款专为推荐系统训练设计的 MTIA 300 芯片与全新 RDMA 网络协议 MetaRoCE;NVIDIA 则在 Hot Chips 2026 前后三连发,Vera Rubin NVL72 实测每兆瓦吞吐量提升最高 30 倍,并开放 NVLink Fusion 允许自研 XPU 接入。产业格局层面,Hugging Face 探索以 130 亿美元估值出售,较 2023 年增长近 3 倍;中国开源模型已成研究默认,约 40% 论文提及。Agent 生态持续演进,AWS 发布 Agentic Resource Discovery 开放
今日 AI 领域呈现"成本分化"与"效率革命"双主线:Anthropic 旗舰模型 Fable 5 因成本高企采用率仅 8%,而 DeepSeek V4-Pro 峰值定价暴涨 355%,"免费午餐"时代正式终结,混合模型策略成为 Agent 工程新常态。开源侧则迎来爆发——FlashML 发布 FreeToken 推理引擎,让 20GB 模型在 16GB VRAM 上跑出 ~100 tok/s;NVIDIA 开源 ACES 技能评估框架,为 Agent 生产级部署提供量化标尺。美光警告 AI 内存墙加剧(算力每两年超出 HBM 带宽 3 倍),X 推出广告 MCP 服务器标志 MCP 生态向垂
今日 AI 领域迎来多重里程碑:NVIDIA 以 120 亿美元"反向执行收购"Poolside,创始人留任获 10 亿美元、员工获 60 亿美元,同时微软确认首批生产型 Vera Rubin 芯片交付,算力饥渴正在重塑产业边界。模型侧,DeepSeek 发布多模态新模型对标 Opus 4.8,Harvey 推出法律专用模型 Tenet,Gemma 4 31B 以约 1/40 成本匹敌 Sonnet 5 回答质量。基础设施层面,乌兰察布 12.5GW 数据中心承诺超 Stargate,中国 AI 产业首次大规模自建基础设施;Percy Liang 启动 535B 参数全程开源训练,UC Ber
今日 AI 领域最重磅的消息当属 NVIDIA 以 60 亿美元收购 Poolside 的"模型工厂"业务,芯片巨头亲自下场整合模型生产能力,研究员普遍收到 NVIDIA offer。与此同时,Z.ai CEO 唐杰宣告"参数规模已死",GLM 5.3 的飞跃全部来自长时程环境 RL 训练,后训练 Scaling Law 成为新范式。医疗 AI 迎来里程碑:Moderna/Merck 个性化 mRNA 癌症疫苗 III 期成功,1137 人入组双终点均优于单药。开源生态方面,社区发布最激进 Qwen3.8-27B 无审查版,18/18 红队通过,引发开源 vs 安全激烈讨论。此外,Harvey
今日 AI 领域围绕"隐私安全"与"Agent 工程化"双主线展开。OpenAI 预览 Private Safety Processing,试图调和 Zero Data Retention 承诺与跨交互安全监控的矛盾,正面回应 Anthropic 的企业客户隐私优势;同时 CFO 确认 2027 年上市时间表,商业化路径进一步清晰。开源侧,Ornith-1.5 以自改进策略训练发布三档模型,比肩 Claude Opus 4.8;Qwen3.8-27B 发布 4 天登顶 Cline 本地模型榜首。地缘政治层面,美国出口管制漏洞曝光——中国 AI 公司借道东南亚远程租用 Nvidia 算力,RAS