工具速递|open-notebook:开源版 NotebookLM,更灵活更多功能
今日 +554 stars。lfnovo 开源的 Notebook LM 替代品,支持多模态源、播客生成、自定义 LLM、跨笔记本搜索。
DeepLab tag – tech
今日 +554 stars。lfnovo 开源的 Notebook LM 替代品,支持多模态源、播客生成、自定义 LLM、跨笔记本搜索。
今日 +1103 stars。一个 Claude Skill,专注于让 AI 生成的内容「有人味」——避免模板化、避免「作为 AI」、避免过度解释。
今日 GitHub Trending 第一名(+1111 stars)。一个 Claude Skill,可以让你的 AI 自动去 Reddit、X、YouTube、HN、Polymarket、Web 调研一个主题并生成 grounded 报告。
arXiv 2606.07412(2026-06-05):从「做对的事」到「做对的事 + 学到技能」,Socratic-SWE 让 Agent 在解决 1000+ 任务后形成可复用的 Skill Library。
arXiv 2606.07342(2026-06-05):把 LLM 当成「代码进化器」,在分诊、问诊、影像分类三个医疗场景全部击败人工 baseline,紧急召回从 0.60 提到 0.97。
arXiv 2606.07297(2026-06-05):一个 848 个 issue × 10 种语言 × 203 仓库的仓库探索评测,揭示了现代编程 Agent 在「先看懂代码再动手」上的真实差距。
arXiv 2606.07299(2026-06-05):国产团队推出开源深度研究代理,在公认最难的 DeepResearch Bench 上拿到 58.03%,与 OpenAI Deep Research 差距缩小到 6 个百分点。
Claude Code 1.0+ 是当前最成熟的 Agent 编程工具之一。本文整理 12 个真实工作流,覆盖代码理解、修改、测试、调试、重构全流程。
Anthropic Claude 4 Sonnet 公测两周,我们用 12 个真实任务做横向对比。重点关注:100 万 token 检索准确率、代码能力、工具调用稳定性、定价。
回顾 2022-2026 AI 编程的四个阶段、关键技术转折点、对工程师工作流的真实影响;预测 2027 年 Agent 自主开发 1 周内小项目的可能路径。
协和医院联合清华团队,把 GPT-4 级别的模型部署在私有化环境,3 个月试点让 120 位医生的病历摘要平均时间从 12 分钟降到 3 分钟。
Mamba 系列第三篇正式论文,引入动态内存路由与稀疏注意力混合架构,在 100 万 token 检索任务上首次击败同等规模 Transformer。
本文用一个真实案例演示如何用 Cursor + Claude 4 Sonnet,把代码 review 从「看 PR → 提意见」升级为「AI 先过一遍、人只看关键点」,提效约 60%。