跳到正文

#Hugging Face

今日 0 条
4月16日周三
4月14日周一
  1. Hugging Face80

    Hugging Face 收购 Pollen Robotics,进军开源人形机器人硬件销售

    Hugging Face 宣布收购拥有 9 年开源硬件经验的机器人团队 Pollen Robotics,开始销售开源机器人硬件。首款在售硬件为面向研究与具身智能实验的开源人形机器人 Reachy 2,售价 70,000 美元,具备 7 自由度双臂、全向移动底盘与 VR 遥操作功能。

    推荐理由:这是 Hugging Face 首次通过收购直接销售开源硬件机器人,标志着其开源生态从软件平台延伸至具身实体。

4月9日周三
4月5日周六
4月4日周五
  1. Hugging Face64

    Gradio 月活开发者突破 100 万:开源库成长的五条经验复盘

    Gradio 宣布月活跃开发者突破 100 万,并复盘了其从斯坦福演示工具成长为机器学习 Web 框架的五条核心经验。团队重点总结了优先构建底层原语而非高层抽象(gr.Blocks 占 80% 用量)、将临时分享链接与 Hugging Face Spaces 结合内置传播属性、放弃固定路线图实行快速迭代,以及自动生成 API 端点以适配应用集成与后续 MCP 调用。

    推荐理由:原文总结了底层原语设计和垂直场景聚焦等具体实践,读者可据此参考开源 AI 库的产品架构取舍与增长路径。

4月3日周四
  1. Hugging Face63

    Hugging Face 经典 NLP 课程升级更名为大语言模型课程

    Hugging Face 宣布将运行三年的 NLP 课程升级并更名为 The LLM Course,全面转向大语言模型前沿内容。新课程在保留实体识别与分类等经典 NLP 任务的基础上,增加了大模型微调和构建 DeepSeek R1 风格推理模型的章节。后续内容还将联合 LlamaIndex、LangChain 及 Unsloth 等社区开源工具,系统覆盖微调、推理与检索等实践模块。

    推荐理由:官方课程从传统 NLP 转向覆盖推理模型与主流微调工具,为开发者提供了贴合当前开源大模型生态的系统学习路径。

4月2日周三
  1. Hugging Face51

    高效请求排队:大语言模型推理性能优化实践

    TNG 在 Hugging Face 博客分享了大语言模型自托管推理中的请求排队与调度优化方案,解决多用户并发时高频请求阻塞推理后端的问题。文章提出在 vLLM 等引擎前引入 API 网关层,采用轮询与多优先级队列实现公平调度,并通过拉取 Prometheus 队列长度和生成耗时指标建立动态背压机制,控制向后端的发送速率。

3月31日周一
3月28日周五
3月27日周四
  1. Hugging Face84

    Hugging Face 发布 Open R1 第 4 期更新:详解 DeepSeek-V3 0324 表现与部署

    Hugging Face 梳理了新上架的 DeepSeek-V3 0324 模型,该版本改用 MIT 协议并在数学、代码与指令遵循能力上获得显著提升。基准测试中 AIME 提高至 59.4,LiveCodeBench 提高至 49.2,同时显著改善了前端开发与中文检索表现。

    推荐理由:原文汇总了新版模型在数学与代码上的评测表现,同时梳理了主流推理框架部署方案与开源运行安全规范。

3月26日周三
  1. Hugging Face62

    使用 Sentence Transformers 训练与微调重排模型指南

    Hugging Face 发布使用 Sentence Transformers 训练和微调交叉编码器重排(Reranker)模型的实践指南,系统拆解了数据集准备、难负样本挖掘、损失函数选择与评估流程。

    推荐理由:文章系统拆解了重排模型微调中的难负样本挖掘与损失函数配置,展示了特定领域微调超越大尺寸通用模型的路径。

3月24日周一
  1. Hugging Face61

    Gradio 推出全新 Dataframe 数据表格组件

    Gradio 宣布对核心组件 gr.Dataframe 进行全面升级,在过去 6 周内修复并增强了 70 余项功能与缺陷。新版本支持多单元格选择、行号显示、列固定、全屏交互以及数据搜索和过滤,并新增静态列设置与专属样式定制功能。用户可通过 pip install --upgrade gradio 更新库并直接体验上述改进。

    推荐理由:Gradio 对核心表格组件完成了多项交互升级,开发者更新版本后即可为排行榜与看板应用直接接入列固定和搜索过滤等功能。

3月19日周三
  1. Hugging Face37

    Hugging Face 就白宫 AI 行动计划信息征求提交回应

    Hugging Face 针对白宫 AI 行动计划信息征求提交回应,呼吁将开源 AI 与开放科学确立为国家战略的核心。回应列举 7B 参数的 OlympicCoder 在复杂编码上超越 Claude 3.7、OLMo 2 媲美 o1-mini,力证开源模型的竞争力。团队提出三大建议:保障公共算力与开源数据支持、优先推进小模型与推理降本、以透明系统保障 AI 安全。

3月12日周三
  1. Hugging Face83

    Google 发布新一代多模态开权重模型 Gemma 3

    Google 正式发布新一代开权重模型 Gemma 3,提供 1B、4B、12B 和 27B 四种尺寸的基础与指令微调版本。除 1B 纯文本模型具备 32k 上下文外,其余尺寸均原生支持图像与文本多模态理解、140 多种语言以及最高 128k token 上下文窗口。

    推荐理由:模型将多模态能力与长上下文下放到较小参数规模,为端侧设备和轻量化本地部署提供了高性价比选择。

3月11日周二
3月4日周二
2月24日周一
  1. Hugging Face55

    Hugging Face Diffusers 推出基于推理端点的远程 VAE 解码实验性功能

    Hugging Face Diffusers 团队推出基于推理端点进行远程 VAE 解码的实验性方案,以缓解本地显卡运行扩散模型时的显存压力。该方案在 diffusers 中引入 `remote_decode` 工具方法,支持将 SD v1.5、SDXL、Flux 及 HunyuanVideo 的潜空间解码交由云端端点处理,避免本地分块解码带来的画质损失与内存卸载延迟。

2月20日周四
2月12日周三
  1. Hugging Face67

    Hugging Face 推出视频生成数据集构建工具与处理流程

    Hugging Face 推出了一套用于视频生成模型微调的数据集构建工具与开源脚本,包含获取、过滤与打标的三阶段流水线。该流程通过 yt-dlp 和场景切分脚本提取片段,结合专用模型进行水印检测、美学评分、NSFW 过滤与运动评估,并支持使用 Florence-2 或 Qwen2VL 生成多粒度描述。

    推荐理由:给出了视频数据清洗的三阶段流水线与具体过滤阈值,读者可直接参考该方案构建视频生成模型的微调数据集。

2月4日周二
1月31日周五
  1. Hugging Face79

    Mini-R1:基于 GRPO 和数字倒计时游戏复现 DeepSeek-R1 顿悟时刻的强化学习教程

    作者通过 TRL、DeepSpeed 和 vLLM 在 4 张 NVIDIA H100 GPU 上运用 GRPO 算法微调 Qwen2.5-3B-Instruct,复现了类似 DeepSeek-R1 的纯强化学习自我验证顿悟现象。

    推荐理由:教程展示了用轻量开源方案跑通纯强化学习自我验证的可迁移流水线,有助于开发者评估小模型复现长链思考的算力与策略门槛。

1月28日周二
  1. Hugging Face67

    Hugging Face 启动 Open-R1 项目:全面开源复现 DeepSeek-R1

    Hugging Face 宣布启动 Open-R1 项目,旨在全面复现并开源 DeepSeek-R1 未公开的训练代码、数据集及完整管线。项目分为三步推进:首先通过 DeepSeek-R1 蒸馏高质量推理数据以复现轻量模型,随后构建大规模数学、代码与推理数据以复现类似 R1-Zero 的纯强化学习管线,最后打通从基座模型到 SFT 再到强化学习的多阶段训练。

    推荐理由:Hugging Face 启动开源复现项目,旨在补齐 DeepSeek-R1 未公开的训练代码与数据集构建细节。

1月27日周一
  1. Hugging Face77

    Diffusers 开源视频生成模型现状与显存优化指南

    Hugging Face 发布 Diffusers 开源视频生成模型现状综述与技术指南,系统梳理了 CogVideoX、HunyuanVideo 和 LTX-Video 等开源模型的架构设计与资源瓶颈。

    推荐理由:原文对比了主流开源视频模型的显存开销并给出优化方案,开发者可直接参考量化与分组卸载组合将大模型推断压至消费级显卡。

1月24日周五
  1. Hugging Face67

    Hugging Face 为 smolagents 引入视觉语言模型原生支持

    Hugging Face 宣布开源智能体框架 smolagents 正式支持视觉语言模型(VLM),使智能体能够在任务流程中原生处理图像。框架不仅支持在任务启动时批量传入图像,还允许通过步骤回调函数动态捕获浏览器截图并写入观测记忆。官方结合 helium 自动化工具与 Qwen2-VL 等模型,演示了让视觉智能体自主浏览网页并提取信息的实现流程。

    推荐理由:原文展示了如何通过回调函数动态传入截图让智能体观察网页,为构建基于视觉的浏览器工作流提供了直接参考。

1月16日周四
1月13日周一
  1. Hugging Face50

    Hugging Face:AI 智能体已来,接下来何去何从?

    Hugging Face 针对基于大语言模型(LLM)的 AI 智能体展开分析,呼吁不要开发完全自主的 AI 智能体。研究指出系统的安全与隐私风险会随系统自主权提升而显著增加,能够自主编写并执行代码的完全自主系统可能彻底脱离人类控制。相比之下,在明确人类控制权与任务范围的前提下,半自主智能体更能实现利大于弊。

1月10日周五
12月5日周四
  1. Hugging Face49

    大语言模型自我纠错能力如何?基于 Keras 与 TPU 的 Chatbot Arena 实验

    该实验基于 Keras、JAX 与 TPU v5e 构建了 Chatbot Arena 对比环境,测试 10B 参数量以下大语言模型在自然语言提示下修正代码错误的能力。系统利用拥有 8 个核心、共 128GB 内存的 TPU v5e 进行模型分片,以 bfloat16 格式在显存中同时加载多个约 8B 与 2B 参数模型进行即时对话评测。

12月2日周一
  1. Hugging Face68

    面向开源开发者的欧盟人工智能法案合规指南

    Hugging Face 发布面向开源开发者的欧盟人工智能法案合规指南,梳理了有限风险系统与通用大模型的合规界限与义务要求。指南指出,非系统性风险开源通用模型需提供训练数据摘要并遵守版权退出机制,交互式或生成式系统则须标注 AI 生成内容。相关通用模型规定将于 2025 年 8 月起执行,开发者可借助模型卡片、Gradio 水印和 Spawning 退出工具提前适配。

    推荐理由:文章系统梳理了开源模型与系统在欧盟法规下的分级边界,并指明了训练数据披露与版权退出的具体落地路径。

11月20日周三
  1. Hugging Face41

    从文件到数据块:提升 Hugging Face 存储效率

    Hugging Face 的 Xet 团队采用内容定义分块(CDC)技术,将文件切分为数据块进行增量传输与去重,以优化超 30 PB 资产的存储效率。该方案相比传统 Git LFS 可提升约 50% 的存储与传输性能,在微调模型与检查点上的去重率达 30% 至 85%。团队计划于 2025 年初在 Hub 正式推出首批基于 Xet 的存储库。

11月4日周一
  1. Hugging Face57

    Argilla 2.4 发布:支持在 UI 中无代码构建 Hub 微调与评测数据集

    开源数据标注工具 Argilla 发布 2.4 版本,新增无需编写代码即可在 UI 中直接从 Hugging Face Hub 导入公开数据集的功能。该功能支持用户自定义标注问题与字段,便于构建模型微调与评测数据集并收集人类反馈。工具推荐部署在 Hugging Face Spaces 并默认启用 HF OAuth 进行协作标注,同时保留了 Python SDK 导入方式。

10月29日周二
10月23日周三
10月22日周二