跳到正文

Hugging Face

Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表。

最新精选

第 341–348 条 · 共 348 条
9月14日周二
  1. Hugging Face64

    Hugging Face 推出开源优化工具库 Optimum

    Hugging Face 宣布推出开源工具库 Optimum,旨在为 Transformer 模型在大规模生产部署中提供针对特定硬件的性能优化工具。该库联合硬件厂商封装了底层算子兼容、量化与稀疏化等复杂流程,首期结合 Intel Neural Compressor 简化了针对 Intel Xeon CPU 的模型量化操作。

    推荐理由:Hugging Face 联合硬件厂商推出模型性能优化工具包,旨在降低 Transformer 架构在特定硬件上的量化与部署门槛。

7月15日周四
  1. Hugging Face64

    基于互联网的深度学习:通过 DeDLOC 协作训练语言模型

    Hugging Face 联合多所机构提出跨互联网协作分布式训练方法 DeDLOC,并联合 40 名志愿者成功预训练出孟加拉语模型 sahajBERT。该方法通过在各节点累加大批次梯度并根据网络条件自适应分配聚合负载,解决了家用宽带带宽受限和节点易掉线的问题。

    推荐理由:原文展示了如何通过去中心化自适应聚合让普通设备协作预训练,为缺乏大算力集群的研究团队提供了低成本替代方案。

7月8日周四
  1. Hugging Face61

    Hugging Face 推出 Amazon SageMaker 推理方案,支持快速部署 Transformer 模型

    Hugging Face 联合亚马逊推出基于 Amazon SageMaker 的全新推理解决方案,上线了专用的 Hugging Face 推理深度学习容器(DLC)与推理工具套件。

    推荐理由:原文给出了基于 DLC 容器在 SageMaker 部署 Transformer 模型的完整代码与参数范式,适合工程团队评估模型云端托管流程。

6月28日周一
  1. Hugging Face69

    Hugging Face Hub 正式集成 Sentence Transformers 框架

    Hugging Face Hub 宣布正式集成句子与段落嵌入框架 Sentence Transformers,上线超过 90 个覆盖 100 多种语言的预训练模型。平台同步推出了特征提取和句子相似度计算的交互式微件,并提供托管 Inference API 供开发者进行程序化调用。用户还可通过简单的代码直接将模型上传至 Hub,自动生成模型卡片以便在开源社区中分享。

    推荐理由:该文梳理了嵌入模型在 Hub 上的托管、在线体验与 API 调用方式,为开发者分享和验证语义检索模型提供了清晰流程。

5月25日周二
  1. Hugging Face71

    Gradio 2.0 支持单行代码调用与混用 Hugging Face 模型

    Gradio 2.0 正式支持仅用一行代码为 Hugging Face Model Hub 上的模型构建 Web GUI 交互界面。该功能默认调用 Hugging Face 托管的 Inference API,也支持本地安装 transformers 运行。此外,新版本支持将多个模型并行对比或串联构建工作流,便于快速搭建多模型复合应用。

    推荐理由:读者可以通过该方案掌握仅用单行代码为开源模型构建交互界面,并将多个模型进行串联或并联组合的轻量演示方法。

4月16日周五
  1. Hugging Face74

    Hugging Face 推出 PyTorch 分布式训练库 Accelerate

    Hugging Face 正式推出开源训练库 Accelerate,让开发者仅需在原生 PyTorch 训练脚本中增加数行代码,即可在 CPU、多 GPU、TPU 以及混合精度等不同硬件配置下无缝运行。该库通过统一的 API 自动接管设备放置、模型包装与 DataLoader 分发,同时提供简化的 CLI 工具以统一各环境的启动流程。

    推荐理由:原文展示了仅需改动数行代码即可适配多卡与混合精度的方案,读者可参考其封装方式降低原生训练循环的跨硬件维护成本。

3月12日周五
  1. Hugging Face62

    在 Hugging Face Transformers 中微调 Wav2Vec2 英文语音识别模型教程

    Hugging Face 发布了在 Transformers 中微调 Wav2Vec2 预训练模型用于英文语音识别的完整教程。指南以 5 小时训练数据的 Timit 数据集为例,在不接入外部语言模型的情况下结合 CTC 算法训练端到端声学模型,实现了 22.1% 的词错误率。文章涵盖了词表构建、音频特征提取、动态批填充以及将检查点推送到 Hub 的完整代码实现。

    推荐理由:教程展示了无需外接语言模型、仅靠CTC微调端到端声学模型的完整流程,提供了可直接复用的数据处理与动态批填充实现方案。

2月14日周五