教程|用 turbovec 替代 Pinecone:单节点 1000 万向量的 RAG 索引
手把手用 turbovec(基于 TurboQuant)搭一个 1000 万向量的本地 RAG 索引,4GB 内存,p99 5ms。
DeepLab tag – model
手把手用 turbovec(基于 TurboQuant)搭一个 1000 万向量的本地 RAG 索引,4GB 内存,p99 5ms。
今日 +158 stars,llama.cpp 在 Apple Silicon、CPU、CUDA 上持续领先。新版本支持 MoE 量化、KV cache 压缩。
TypeScript 写的,+554 stars/day。支持多模态源、播客生成、自定义 LLM、跨笔记本搜索。
arXiv 2606.07451(2026-06-05):CLIP 的图文对齐是「信息失衡」导致的,TEVI 用 caption 作为信号选择性保留 image embedding 中的相关属性。
arXiv 2606.07218(2026-06-05):用键值分离的超图作为证据组织层,在 2WikiMultiHopQA 上比 KG-PPR 提升 +3.4 F1,ColBERTv2 上再叠加 +11.1。
手把手用 open-notebook + Ollama 搭一个本地 NotebookLM。所有数据不出本机,支持 PDF/YouTube/网页/音频。
手把手教你在 macOS / Linux 上本地安装 hermes-agent(NousResearch),配合 Ollama 跑开源 Hermes 模型,5 分钟拥有一个能记住你的 AI 助理。
今日 +554 stars。lfnovo 开源的 Notebook LM 替代品,支持多模态源、播客生成、自定义 LLM、跨笔记本搜索。
NousResearch 推出的 hermes-agent 今日 +1112 stars。号称「The agent that grows with you」,支持从个人助理到企业级复杂任务的渐进式扩展。
研究者发现 LLM 的解嵌矩阵里藏着一个「频繁但无信息」token 的子空间,过滤掉它能显著提升零样本文本嵌入质量。
LightningLM 0.1V 在单 8 卡节点上完成 120B 稀疏 MoE 全流程训练,激活参数只占 5%,训练 loss 1.78。
arXiv 2606.07342(2026-06-05):把 LLM 当成「代码进化器」,在分诊、问诊、影像分类三个医疗场景全部击败人工 baseline,紧急召回从 0.60 提到 0.97。
arXiv 2606.07500(2026-06-05):SETA 把 LoRA 类持续学习推上新台阶——在 LLaMA-2 7B 和 Qwen3-4B 上同时提升新任务性能和早期任务保留。
本周 AI 圈 10 条最值得记住的事:GPT-5 SWE-bench 突破 80%、Claude 4 系列发布、Llama 4 重回开源、Mamba-3 长上下文新方案、欧盟 AI Act 半年观察。