每日 AI 速递|2026-06-08:5 件你必须知道的事
今日要闻:DeepSeek-R1 推理解剖引发行业反思 / LightningLM 0.1V 单 8 卡 120B MoE / DuMate-DeepResearch 拿下 DRB 58% / GitHub Trending Top 5 全是 Agent / Anthropic...
DeepLab tag – model
今日要闻:DeepSeek-R1 推理解剖引发行业反思 / LightningLM 0.1V 单 8 卡 120B MoE / DuMate-DeepResearch 拿下 DRB 58% / GitHub Trending Top 5 全是 Agent / Anthropic...
DeepSeek V3 / Qwen3 / GLM-4.5 / Kimi K2 / 文心 4.5 / 豆包 2.0 全面横评。在 8 个维度上找出真实差距,给中文 AI 找 3 个差异化机会。
本周国产 5 件大事:月之暗面 B 轮 / 智谱港股 IPO / 深度求索融资 / 百川智能 B+ / DuMate-DeepResearch 拿下 DRB 58%。
2026-W23 投融资:Anthropic 新一轮 $4000 亿估值融资 / OpenAI ARR 200 亿 / 月之暗面 B 轮 50 亿 / 智谱 IPO 推进。
本周 5 篇影响深远的论文:DeepSeek-R1 推理解剖、LightningLM 120B MoE、DuMate-DeepResearch、CapCode 防作弊、本地语言文化优势。
本周 5 大事件:LightningLM 0.1V 单 8 卡训 120B MoE / DuMate-DeepResearch 拿下 DRB 58% / Hermes-Agent 原生支持 MCP / DeepSeek-R1 推理质疑 / GitHub Trending...
DeepSeek-R1 在 AIME 2025 上是「拓扑模仿」而非真推理。这给中国大模型路线图敲响警钟——长 CoT 不等于强推理。
中文 AI 圈里程碑:开源深度研究代理 DuMate-DeepResearch 在 DRB 上拿到 58.03%,与 OpenAI Deep Research 差距缩小到 6 个百分点。
研究者把 DeepSeek-R1 在 AIME 2025 的 10247 个推理步骤全部标注分类:模型频繁在「回访中间结果」上打转,缺乏真正的回溯修正能力。
arXiv 2606.07299(2026-06-05):国产团队推出开源深度研究代理,在公认最难的 DeepResearch Bench 上拿到 58.03%,与 OpenAI Deep Research 差距缩小到 6 个百分点。
arXiv 2606.07410(2026-06-05):研究者用 AIME 2025 的 30 道题、10,247 个推理步骤,把 DeepSeek-R1 和人类数学家对比,得出令人警醒的结论。
本周 AI 圈 10 条最值得记住的事:GPT-5 SWE-bench 突破 80%、Claude 4 系列发布、Llama 4 重回开源、Mamba-3 长上下文新方案、欧盟 AI Act 半年观察。
DeepSeek R1 是当前最值得本地部署的开源推理模型之一。本文用 Mac M3 Pro / Linux 4C8G 两套环境实测,给出从 0 到能用的最小路径。