跳到正文

#RAG

今日 0 条
9月29日周二
  1. Hugging Face43

    面向 MCP 智能体的来源感知核验方法 ProvenanceGuard:确保来源与事实双重准确

    ProvenanceGuard 是一种面向 MCP 智能体的生成后事实核验层,旨在解决主张内容属实但归因于错误工具输出的跨来源混淆问题。该方法无需重训智能体,通过保留工具输出与来源 ID,依次执行主张拆解、来源定位、支持度校验与修复决策。在包含 361 项医疗主张的测试中,它成功拦截了专家判定不可通过的 139 项主张中的 138 项,可识别来源的匹配准确率达 86% 左右。

9月18日周五
  1. GitHub AI46

    GitHub 探讨 AI 热门争议:该不该审查代码、RAG 死了吗以及 Skills 是否取代 MCP

    GitHub 在播客中拆解了 AI 领域的多个热门争议,明确指出开发者仍须按风险级别审查 AI 生成的代码并对结果负责。针对技术路线冲突,GitHub 强调 Skills 并没有取代 MCP,MCP 负责提供工具和数据连接标准,Skills 则封装经验与规范;同时 RAG 也并未消亡,它依然是提供外部上下文的关键,可与 AI 智能体及 MCP 在同一工作流中协同互补。

9月3日周四
  1. Hugging Face68

    多模态原生多语言编码器 NeoMME 发布,开源 260M 与 800M 版本

    NeoMME 推出 260M 与 800M 参数的多模态原生多语言编码器,放弃传统独立视觉塔与自回归解码器架构,使用单一双向 Transformer 统一处理文本与图像 Patch。

    推荐理由:该模型采用单塔双向编码器同时输出稠密与后期交互向量,在保持高检索质量的同时大幅压低了多模态文档的索引存储开销与计算成本。

8月18日周二
5月15日周五
4月16日周四
  1. Hugging Face72

    使用 Sentence Transformers 训练与微调多模态嵌入与重排模型指南

    Hugging Face 介绍了使用 Sentence Transformers 训练和微调多模态嵌入与重排模型的完整流程,支持处理文本、图像、音频与视频等多模态数据。

    推荐理由:文章给出了使用 Sentence Transformers 微调多模态检索模型的完整范式,展示了如何通过梯度缓存与俄罗斯套娃损失低成本提升垂直领域表现。

4月9日周四
  1. Hugging Face74

    Sentence Transformers v5.4 发布:支持多模态嵌入与重排序模型

    Sentence Transformers 发布 v5.4 版本,正式支持通过统一 API 编码与比对文本、图像、音频和视频等多模态数据。新版本同时涵盖多模态嵌入(SentenceTransformer)与重排序(CrossEncoder)能力,原生适配 Qwen3-VL、Nemotron 等开源模型并支持混合输入。

    推荐理由:该更新统一了文本、图像与音视频的检索与重排序接口,便于开发者直接构建跨模态 RAG 管线。

3月21日周六
  1. Hugging Face61

    如何在一天内微调领域专属 Embedding 模型

    NVIDIA 推出一套端到端 Embedding 模型微调方案,利用单张 80GB GPU 和 NeMo 工具链,可在一天内将通用模型适配到垂直领域。该流程使用 LLM 自动生成包含多跳推理的合成数据并挖掘难负例,微调 Llama-Nemotron-Embed-1B-v2 后可直接导出 TensorRT 引擎并接入 NIM 部署。

    推荐理由:教程提供了一套从无标注文档自动生成问答对到难负例挖掘的完整方案,有助于开发者低成本提升垂直领域检索召回率。

10月1日周三
  1. Hugging Face49

    Hugging Face 推出检索评测基准 RTEB:检索评估新标准

    Hugging Face 推出检索嵌入评测基准 RTEB(Retrieval Embedding Benchmark)Beta 版,采用公开与私有数据集混合策略,旨在衡量 embedding 模型的真实检索泛化能力。该基准覆盖 20 种语言及法律、医疗、金融等企业领域,以 NDCG@10 为默认指标,私有数据集评测由 MTEB 团队负责以防刷榜过拟合。

9月4日周四
  1. Hugging Face72

    Google 发布轻量多语言嵌入模型 EmbeddingGemma

    Google 正式发布面向端侧场景的轻量多语言嵌入模型 EmbeddingGemma,拥有 308M 参数与 2K 上下文窗口,量化后内存占用低于 200MB。

    推荐理由:材料详细展示了基于 Gemma 3 改造的双向编码架构与 MRL 维度裁剪特性,读者可以据此评估其在端侧小显存环境下的检索替换可行性。

3月26日周三
  1. Hugging Face62

    使用 Sentence Transformers 训练与微调重排模型指南

    Hugging Face 发布使用 Sentence Transformers 训练和微调交叉编码器重排(Reranker)模型的实践指南,系统拆解了数据集准备、难负样本挖掘、损失函数选择与评估流程。

    推荐理由:文章系统拆解了重排模型微调中的难负样本挖掘与损失函数配置,展示了特定领域微调超越大尺寸通用模型的路径。

1月10日周五
7月9日周二
6月7日周五
5月28日周二
  1. Hugging Face69

    Sentence Transformers 嵌入模型训练与微调完整指南

    Hugging Face 发布了使用 Sentence Transformers 训练与微调嵌入模型的实用指南,系统解析了基于 SentenceTransformerTrainer 的训练架构。文章涵盖数据集列顺序与损失函数匹配、评估器设置以及多数据集混合训练策略,支持对不同业务场景定制语义相似度计算。新版本底层重构后原生支持分布式训练和监控回调,并完全兼容旧版 fit 方法。

    推荐理由:教程系统梳理了新版嵌入模型的训练与评估流程,读者可以掌握多数据集混训和损失函数匹配的具体实现规范。

2月23日周五
  1. Hugging Face78

    Matryoshka 嵌套嵌入模型原理解析与实战教程

    Hugging Face 博客详解了 Matryoshka 嵌入模型(MRL)的核心原理,并给出了基于 Sentence Transformers 的训练与推理实践指南。

    推荐理由:原文给出了在 Sentence Transformers 中使用 MatryoshkaLoss 训练和截断向量的具体代码,读者可以据此在检索场景中权衡存储成本与检索速度。

2月8日周四