教程|arXiv 2606.07412 Socratic-SWE 思路:让 Agent 学会『技能』
Socratic-SWE 论文核心:让 Agent 从历史轨迹中提炼可复用技能.本教程演示如何在企业内部落地.
DeepLab tag – industry
Socratic-SWE 论文核心:让 Agent 从历史轨迹中提炼可复用技能.本教程演示如何在企业内部落地.
arXiv 2606.07379 提出的封顶设计可以借鉴到企业内部 Agent 评测.本教程演示如何落地.
arXiv 2026-06-05 单日投稿 70+ 篇 cs.AI/CL/LG.热点:持续学习,Agent 安全,多模态对齐,深度研究代理.
本周 arXiv 三大类 70+ 论文(cs.AI/CL/LG),全部 2026-06-05.GitHub Trending 12 个项目全部是 AI Agent / 工具相关.
今日 +65 stars。4.x 全面支持 Transformer 模型导出,可直接调用 Hugging Face 上的 CV 模型。
研究者从 frozen LLM 的 hidden representation 提取「人类 vs AI」分离方向。在跨域、跨模型、跨编辑攻击下表现稳健。
研究者提出对抗方法构建配对数据,训练 AI 生成的社媒内容检测器。在 OOD 数据上显著优于现有模型。
研究者把 LLM 串接建模为 Online Pandora's Box 问题,给出最优策略。在预算约束下 5-15% 性能提升。
研究者去掉 MoE 专家的非线性,单神经元作为专家,可解释性大幅提升。Language modeling 性能更好。
研究者首次实现训练免费 + inversion 免费的音频编辑。FAD 降 15.9%,编辑速度提升 64.5%。
AI 安全从「对齐税」走向「可审计 AI」。本文 6000 字:4 大风险、4 大方案、4 个落地步骤。CapCode / Sycophantic Praise / 数据安全 全部覆盖。
中文 LLM 能记住正确发音,但「灵活使用」音韵知识仍是难题。研究者从同音 / 押韵 / 音近 3 维度建 benchmark。
研究者用 FishAudio-S2-Pro + 语言标签 prompt + RL 微调,在 IWSLT 2026 跨语言语音克隆上拿到 SOTA。
研究者提出 CoMetaPNS:能用序贯数据持续学习、不灾难性遗忘、还能识别新数据来源的个性化心脏模拟器。
本周 5 篇影响深远的论文:DeepSeek-R1 推理解剖、LightningLM 120B MoE、DuMate-DeepResearch、CapCode 防作弊、本地语言文化优势。
对齐技术三代演进:RLHF 奖励人类反馈、Constitutional AI 宪法对齐、Process Supervision 过程监督。2026 最新趋势。
SWE-bench 高分不等于真能力,「作弊」现象普遍。CapCode 用「封顶设计」让欺骗行为可被检测,给行业一条出路。
研究者发现 13 种本地语言、80 个模型的跨文化能力差异:本地语言在文化特定问题上反而更强。中文 AI 不必总跟英文比。
DeepSeek-R1 在 AIME 2025 上是「拓扑模仿」而非真推理。这给中国大模型路线图敲响警钟——长 CoT 不等于强推理。
研究者发现 LLM 的解嵌矩阵里藏着一个「频繁但无信息」token 的子空间,过滤掉它能显著提升零样本文本嵌入。