跳到正文

教程实践

拿来就能用的实操内容:提示词技巧、工作流搭建、工具用法与踩坑经验。

最新精选

第 41–60 条 · 共 82 条
4月3日周四
  1. Hugging Face63

    Hugging Face 经典 NLP 课程升级更名为大语言模型课程

    Hugging Face 宣布将运行三年的 NLP 课程升级并更名为 The LLM Course,全面转向大语言模型前沿内容。新课程在保留实体识别与分类等经典 NLP 任务的基础上,增加了大模型微调和构建 DeepSeek R1 风格推理模型的章节。后续内容还将联合 LlamaIndex、LangChain 及 Unsloth 等社区开源工具,系统覆盖微调、推理与检索等实践模块。

    推荐理由:官方课程从传统 NLP 转向覆盖推理模型与主流微调工具,为开发者提供了贴合当前开源大模型生态的系统学习路径。

3月26日周三
  1. Hugging Face62

    使用 Sentence Transformers 训练与微调重排模型指南

    Hugging Face 发布使用 Sentence Transformers 训练和微调交叉编码器重排(Reranker)模型的实践指南,系统拆解了数据集准备、难负样本挖掘、损失函数选择与评估流程。

    推荐理由:文章系统拆解了重排模型微调中的难负样本挖掘与损失函数配置,展示了特定领域微调超越大尺寸通用模型的路径。

3月7日周五
  1. Hugging Face68

    Hugging Face 发布通过 React Native 在手机端本地运行大模型的实操指南

    Hugging Face 发布了一份使用 React Native 在手机端离线运行大语言模型的实操指南,并开源了配套代码仓库 EdgeLLM。该方案基于 llama.rn 加载 GGUF 量化格式模型,支持在 iOS 和 Android 设备上直接下载并本地运行 DeepSeek-R1-Distill-Qwen-1.5B 等端侧小模型。

    推荐理由:教程给出了利用 React Native 和 llama.rn 在手机本地加载 GGUF 模型的完整工程实现,适合跨平台端侧开发参考。

1月31日周五
  1. Hugging Face79

    Mini-R1:基于 GRPO 和数字倒计时游戏复现 DeepSeek-R1 顿悟时刻的强化学习教程

    作者通过 TRL、DeepSpeed 和 vLLM 在 4 张 NVIDIA H100 GPU 上运用 GRPO 算法微调 Qwen2.5-3B-Instruct,复现了类似 DeepSeek-R1 的纯强化学习自我验证顿悟现象。

    推荐理由:教程展示了用轻量开源方案跑通纯强化学习自我验证的可迁移流水线,有助于开发者评估小模型复现长链思考的算力与策略门槛。

1月27日周一
  1. Hugging Face77

    Diffusers 开源视频生成模型现状与显存优化指南

    Hugging Face 发布 Diffusers 开源视频生成模型现状综述与技术指南,系统梳理了 CogVideoX、HunyuanVideo 和 LTX-Video 等开源模型的架构设计与资源瓶颈。

    推荐理由:原文对比了主流开源视频模型的显存开销并给出优化方案,开发者可直接参考量化与分组卸载组合将大模型推断压至消费级显卡。

12月2日周一
  1. Hugging Face68

    面向开源开发者的欧盟人工智能法案合规指南

    Hugging Face 发布面向开源开发者的欧盟人工智能法案合规指南,梳理了有限风险系统与通用大模型的合规界限与义务要求。指南指出,非系统性风险开源通用模型需提供训练数据摘要并遵守版权退出机制,交互式或生成式系统则须标注 AI 生成内容。相关通用模型规定将于 2025 年 8 月起执行,开发者可借助模型卡片、Gradio 水印和 Spawning 退出工具提前适配。

    推荐理由:文章系统梳理了开源模型与系统在欧盟法规下的分级边界,并指明了训练数据披露与版权退出的具体落地路径。

10月16日周三
  1. Hugging Face68

    Hugging Face 修复 Transformers 梯度累加计算偏差

    Hugging Face 修复了 Transformers Trainer 中梯度累加与全 batch 训练不等价的计算偏差。因果语言模型等 token 级任务此前直接对每个 batch 的损失取平均,导致存在 padding 时计算失真,正确方法应将所有累加 batch 的总损失除以非 padding token 总数。

    推荐理由:原文拆解了梯度累加与全批次训练结果不一致的数学根源,并给出了针对非填充 token 归一化的具体修复逻辑。

9月23日周一
7月11日周四
  1. Hugging Face74

    Numina 与 Hugging Face 详解 NuminaMath 赢得首届 AIMO 进展奖的技术方案

    Numina 与 Hugging Face 合作开发的 NuminaMath 7B TIR 在首届 AI 数学奥林匹克竞赛(AIMO)进展奖中夺冠,并在私有测试集上解出 29/50 道题目。

    推荐理由:文章提供了在受限推理算力下结合工具调用与多阶段微调的完整工程方案,适合需要优化推理模型落地表现的团队参考。

7月10日周三
  1. Hugging Face69

    Hugging Face TRL 支持视觉语言模型 DPO 微调实践指南

    Hugging Face 宣布 TRL 库正式支持视觉语言模型(VLM)的直接偏好优化(DPO),用于对齐人类偏好并减少多模态幻觉。教程以 Idefics2-8b 为例,结合 bfloat16 与 LoRA 技术将全量训练所需的 160GB 显存降低至 32.3GB,并在 AMBER 幻觉基准测试中改善了表现。目前该流程还兼容 Llava 1.5 与 PaliGemma 等主流模型。

    推荐理由:原文给出了多模态模型进行偏好微调的显存计算与参数配置方案,便于开发者以单卡环境落地对齐训练。

6月24日周一
  1. Hugging Face67

    微调微软 Florence-2 视觉语言模型教程

    Hugging Face 发布在 DocVQA 数据集上微调微软 Florence-2 视觉语言模型的实操指南,将验证集 Levenshtein 相似度从 0 提升至 57.0。教程通过冻结 DaViT 视觉编码器,使 0.2B 与 0.7B 模型能够在单张 A100 或 T4 GPU 等低算力环境下完成训练,并公开了 Colab 代码与在线 Demo。

    推荐理由:教程展示了冻结视觉编码器在单卡环境微调小参数多模态模型的可行路径,为低算力条件下的文档问答任务提供了可迁移方案。

5月28日周二
  1. Hugging Face69

    Sentence Transformers 嵌入模型训练与微调完整指南

    Hugging Face 发布了使用 Sentence Transformers 训练与微调嵌入模型的实用指南,系统解析了基于 SentenceTransformerTrainer 的训练架构。文章涵盖数据集列顺序与损失函数匹配、评估器设置以及多数据集混合训练策略,支持对不同业务场景定制语义相似度计算。新版本底层重构后原生支持分布式训练和监控回调,并完全兼容旧版 fit 方法。

    推荐理由:教程系统梳理了新版嵌入模型的训练与评估流程,读者可以掌握多数据集混训和损失函数匹配的具体实现规范。

3月20日周三
  1. Hugging Face73

    Hugging Face 详解 Cosmopedia:如何构建用于大模型预训练的大规模合成数据集

    Hugging Face 详细介绍了大规模合成数据集 Cosmopedia 的构建方案,并同步开源了包含 250 亿 token 的数据集、全套生成管线代码及 1B 验证模型 Cosmo-1B。

    推荐理由:文章拆解了利用开源模型生成百亿级预训练合成数据的提示词设计与清洗流程,为探索合成数据训练小模型的团队提供了可落地的工程实践参考。

  2. Hugging Face68

    GaLore 如何助力消费级硬件训练大语言模型

    Hugging Face 介绍了内存高效训练方案 GaLore 的技术原理及其在 Transformers 库中的集成实践。GaLore 利用梯度的内在低秩特性,在优化器处理前将梯度投影到低维子空间,可减少超过 82.5% 的优化器状态显存占用,配合 8-bit 优化器和按层更新机制后,支持在 NVIDIA RTX 4090 等消费级 GPU 上训练 7B 参数模型。

    推荐理由:文章给出了 GaLore 结合 8-bit 优化器在消费级显卡上训练大模型的机制与 Transformers 代码实现。

2月26日周一
  1. Hugging Face60

    Hugging Face 详解 AI 水印技术与工具:覆盖图像、文本与音频全模态

    Hugging Face 发文梳理 AI 生成内容的水印与溯源技术,系统拆解图像、文本与音频三大模态的加水印机制与检测方案。文章对比了生成阶段直接嵌入与生成后标记两种实现路径,介绍了 Nightshade 数据投毒、Truepic C2PA 凭证、TGI 文本水印以及 AudioSeal 音频水印等工具。

    推荐理由:梳理了图像、文本和音频生成内容的水印与检测机制,读者可以据此系统了解不同模态防伪溯源的工程实现方案。

2月23日周五
  1. Hugging Face78

    Matryoshka 嵌套嵌入模型原理解析与实战教程

    Hugging Face 博客详解了 Matryoshka 嵌入模型(MRL)的核心原理,并给出了基于 Sentence Transformers 的训练与推理实践指南。

    推荐理由:原文给出了在 Sentence Transformers 中使用 MatryoshkaLoss 训练和截断向量的具体代码,读者可以据此在检索场景中权衡存储成本与检索速度。

  2. Hugging Face66

    在 Hugging Face 中微调 Gemma 模型的实践指南

    Hugging Face 官方发布了使用 Transformers 和 PEFT 库对 Google Gemma 模型进行高效微调的操作指南。教程演示了如何结合 bitsandbytes 的 QLoRA 4-bit 量化加载 gemma-2b,并使用 TRL 的 SFTTrainer 训练名言格式生成。

    推荐理由:原文提供了可直接复用的代码与配置,读者可以据此在消费级 GPU 或 TPU 上以低显存成本微调 Gemma 模型。

2月16日周五
  1. Hugging Face75

    Hugging Face 实践指南:如何用开源合成数据低成本训练专用小模型

    Hugging Face 发布实践方案,演示如何使用开源大模型 Mixtral-8x7B 生成合成标注数据,并通过 AutoTrain 蒸馏微调出约 0.13B 参数的专用 RoBERTa 模型。

    推荐理由:文章给出了用开源大模型生成合成数据并训练专用小模型的完整方案,展示了高并发文本任务大幅压降推理成本的可行路径。

2月1日周四
  1. Hugging Face73

    Hugging Face 发布开源大模型 Constitutional AI 端到端对齐方案与 llm-swarm 工具

    Hugging Face 推出基于开源大模型的 Constitutional AI(CAI)端到端对齐方案,并开源了用于 Slurm 集群大规模合成数据生成的工具 llm-swarm。

    推荐理由:原文提供了基于开源模型实现宪法级 AI 对齐的完整技术方案与集群生成工具,便于开发者低成本构建自定义安全对齐流程。

1月14日周日
  1. Hugging Face67

    如何将 ComfyUI 工作流通过 Gradio 免费部署至 Hugging Face Spaces ZeroGPU

    Hugging Face 发布完整教程,介绍如何将复杂的 ComfyUI 工作流转换为 Gradio Web 应用并免费部署到 Hugging Face Spaces 的 ZeroGPU 无服务器架构上。

    推荐理由:教程给出了将节点图转为脚本并适配无服务器 GPU 的完整改造细节,便于开发者将本地工作流封装为低成本在线服务。