工具速递|last30days-skill 升级:7 平台调研 + 自动生成 Markdown 报告
Claude Skill 升级版,支持 Reddit/X/YouTube/HN/Polymarket/Brave 6 源并行调研,一键产出带 URL 引用的报告。
DeepLab tag – model
Claude Skill 升级版,支持 Reddit/X/YouTube/HN/Polymarket/Brave 6 源并行调研,一键产出带 URL 引用的报告。
arXiv 2606.07379(2026-06-05):SWE-bench 上很多高分是「作弊」——Agent 走捷径而非真正解决问题。CapCode 通过「封顶设计」让欺骗行为可被检测。
今日 +322 stars 的开源 AI 代理。Rust 写的,特点是「install, execute, edit, and test」四合一,比纯建议型工具强一档。
结合 Claude Code + last30days-skill,演示如何自动调研竞品在 Reddit、X、YouTube、HN 上过去 30 天的真实用户讨论。
手把手教你在 macOS / Linux 上本地安装 hermes-agent(NousResearch),配合 Ollama 跑开源 Hermes 模型,5 分钟拥有一个能记住你的 AI 助理。
今日 +1103 stars。一个 Claude Skill,专注于让 AI 生成的内容「有人味」——避免模板化、避免「作为 AI」、避免过度解释。
今日 GitHub Trending 第一名(+1111 stars)。一个 Claude Skill,可以让你的 AI 自动去 Reddit、X、YouTube、HN、Polymarket、Web 调研一个主题并生成 grounded 报告。
arXiv 2606.07412(2026-06-05):从「做对的事」到「做对的事 + 学到技能」,Socratic-SWE 让 Agent 在解决 1000+ 任务后形成可复用的 Skill Library。
arXiv 2606.07297(2026-06-05):一个 848 个 issue × 10 种语言 × 203 仓库的仓库探索评测,揭示了现代编程 Agent 在「先看懂代码再动手」上的真实差距。
2026 H1 AI 编程工具完整榜单。基于 150+ 工具实测、200+ 开发者调研、10+ 维度评分。Cursor / Claude Code / Codex / Windsurf 谁是真王者?
Claude Code 1.0+ 是当前最成熟的 Agent 编程工具之一。本文整理 12 个真实工作流,覆盖代码理解、修改、测试、调试、重构全流程。
Anthropic Claude 4 Sonnet 公测两周,我们用 12 个真实任务做横向对比。重点关注:100 万 token 检索准确率、代码能力、工具调用稳定性、定价。
回顾 2022-2026 AI 编程的四个阶段、关键技术转折点、对工程师工作流的真实影响;预测 2027 年 Agent 自主开发 1 周内小项目的可能路径。
本文用一个真实案例演示如何用 Cursor + Claude 4 Sonnet,把代码 review 从「看 PR → 提意见」升级为「AI 先过一遍、人只看关键点」,提效约 60%。