教程|arXiv 2606.07412 Socratic-SWE 思路:让 Agent 学会『技能』
Socratic-SWE 论文核心:让 Agent 从历史轨迹中提炼可复用技能.本教程演示如何在企业内部落地.
DeepLab tag – model
Socratic-SWE 论文核心:让 Agent 从历史轨迹中提炼可复用技能.本教程演示如何在企业内部落地.
arXiv 2606.07379 提出的封顶设计可以借鉴到企业内部 Agent 评测.本教程演示如何落地.
Claude Code 1.0 推出的 Subagent 让你在一个任务里调度多个 AI 实例.本教程讲清原理 + 实战 + 限制.
arXiv 2026-06-05 单日投稿 70+ 篇 cs.AI/CL/LG.热点:持续学习,Agent 安全,多模态对齐,深度研究代理.
昨日要闻:hermes-agent + MCP 标准化 / last30days-skill 7 平台调研 / taste-skill 解决 AI 味 / arXiv CapCode 防 Agent 作弊 / 国产 AI 融资回暖.
研究者从 frozen LLM 的 hidden representation 提取「人类 vs AI」分离方向。在跨域、跨模型、跨编辑攻击下表现稳健。
研究者提出对抗方法构建配对数据,训练 AI 生成的社媒内容检测器。在 OOD 数据上显著优于现有模型。
研究者把 LLM 串接建模为 Online Pandora's Box 问题,给出最优策略。在预算约束下 5-15% 性能提升。
AI 安全从「对齐税」走向「可审计 AI」。本文 6000 字:4 大风险、4 大方案、4 个落地步骤。CapCode / Sycophantic Praise / 数据安全 全部覆盖。
MCP(Model Context Protocol)已经成为 AI 工具调用的事实标准。本文 5000 字:协议原理、生态现状、Server 开发、最佳实践。
2026 是 AI Agent 元年。本文 8000 字深度:从范式定义、技术栈、产品形态、创业机会、未来趋势 5 个维度,彻底讲透 Agent。
2026-W23 投融资:Anthropic 新一轮 $4000 亿估值融资 / OpenAI ARR 200 亿 / 月之暗面 B 轮 50 亿 / 智谱 IPO 推进。
对齐技术三代演进:RLHF 奖励人类反馈、Constitutional AI 宪法对齐、Process Supervision 过程监督。2026 最新趋势。
研究者把「阿谀式赞美」作为独立对齐问题。客服 AI「亲,请问还有其他问题吗?」背后的对齐漏洞。
研究者发现 13 种本地语言、80 个模型的跨文化能力差异:本地语言在文化特定问题上反而更强。中文 AI 不必总跟英文比。
arXiv 2606.07441(2026-06-05):过度赞美是独立的对齐问题,无法用「是否同意用户」来检测。研究提出参数化框架衡量「赞美是否过度」。
arXiv 2606.07402(2026-06-05):M3Exam 评测 LLM Agent 在真实多模态文件(PDF/图片/表格)上的长期记忆能力,作者同期提出 M3Proctor 准确率 +13%、成本 -70%。
arXiv 2606.07412(2026-06-05):从「做对的事」到「做对的事 + 学到技能」,Socratic-SWE 让 Agent 在解决 1000+ 任务后形成可复用的 Skill Library。
本周 AI 圈 10 条最值得记住的事:GPT-5 SWE-bench 突破 80%、Claude 4 系列发布、Llama 4 重回开源、Mamba-3 长上下文新方案、欧盟 AI Act 半年观察。
Anthropic Claude 4 Sonnet 公测两周,我们用 12 个真实任务做横向对比。重点关注:100 万 token 检索准确率、代码能力、工具调用稳定性、定价。