工具速递|open-notebook:开源版 NotebookLM,但更灵活
TypeScript 写的,+554 stars/day。支持多模态源、播客生成、自定义 LLM、跨笔记本搜索。
TypeScript 写的,+554 stars/day。支持多模态源、播客生成、自定义 LLM、跨笔记本搜索。
Claude Skill 专门压制 AI 输出中的模板化痕迹。开启后人类区分率从 78% 降到 41%。
Claude Skill 升级版,支持 Reddit/X/YouTube/HN/Polymarket/Brave 6 源并行调研,一键产出带 URL 引用的报告。
arXiv 2606.07441(2026-06-05):过度赞美是独立的对齐问题,无法用「是否同意用户」来检测。研究提出参数化框架衡量「赞美是否过度」。
arXiv 2606.07229(2026-06-05):涵盖 7 种音频模态、6 级复杂度、2 种粒度、8 种操作类型的 2000 样本评测。当前 SOTA 模型 Exact Match 普遍 <5%,复杂任务 0%。
arXiv 2606.07402(2026-06-05):M3Exam 评测 LLM Agent 在真实多模态文件(PDF/图片/表格)上的长期记忆能力,作者同期提出 M3Proctor 准确率 +13%、成本 -70%。
arXiv 2606.07451(2026-06-05):CLIP 的图文对齐是「信息失衡」导致的,TEVI 用 caption 作为信号选择性保留 image embedding 中的相关属性。
arXiv 2606.07379(2026-06-05):SWE-bench 上很多高分是「作弊」——Agent 走捷径而非真正解决问题。CapCode 通过「封顶设计」让欺骗行为可被检测。
arXiv 2606.07218(2026-06-05):用键值分离的超图作为证据组织层,在 2WikiMultiHopQA 上比 KG-PPR 提升 +3.4 F1,ColBERTv2 上再叠加 +11.1。
今日 +183 stars 的国产开源项目。TypeScript 写的一站式 AI 内容创作+多平台分发+变现追踪。
今日 +322 stars 的开源 AI 代理。Rust 写的,特点是「install, execute, edit, and test」四合一,比纯建议型工具强一档。
RyanCodrai 今日 +1554 stars 的开源项目。TurboQuant 量化技术 + Rust 高性能实现,号称比 HNSW 快 10x、内存省 80%。
手把手用 open-notebook + Ollama 搭一个本地 NotebookLM。所有数据不出本机,支持 PDF/YouTube/网页/音频。
结合 Claude Code + last30days-skill,演示如何自动调研竞品在 Reddit、X、YouTube、HN 上过去 30 天的真实用户讨论。
手把手教你在 macOS / Linux 上本地安装 hermes-agent(NousResearch),配合 Ollama 跑开源 Hermes 模型,5 分钟拥有一个能记住你的 AI 助理。
今日 +554 stars。lfnovo 开源的 Notebook LM 替代品,支持多模态源、播客生成、自定义 LLM、跨笔记本搜索。
今日 +1103 stars。一个 Claude Skill,专注于让 AI 生成的内容「有人味」——避免模板化、避免「作为 AI」、避免过度解释。
NousResearch 推出的 hermes-agent 今日 +1112 stars。号称「The agent that grows with you」,支持从个人助理到企业级复杂任务的渐进式扩展。
今日 GitHub Trending 第一名(+1111 stars)。一个 Claude Skill,可以让你的 AI 自动去 Reddit、X、YouTube、HN、Polymarket、Web 调研一个主题并生成 grounded 报告。
研究者发现 LLM 的解嵌矩阵里藏着一个「频繁但无信息」token 的子空间,过滤掉它能显著提升零样本文本嵌入质量。