跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

171条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 81–100 条 · 共 171 条
6月12日周四
  1. Hugging Face62

    5 分钟上手 Hugging Face Kernel Hub

    Hugging Face 推出 Kernel Hub 及配套 kernels 库,支持开发者通过单行代码直接拉取并加载预编译的硬件优化计算算子。该工具能自动匹配 Python、PyTorch 和 CUDA 版本并下载二进制文件,避免了 FlashAttention 或 Triton 算子本地编译与环境依赖的繁琐流程。

    推荐理由:提供了免去本地复杂编译而直接按需加载预编译算子的完整流程,读者可借此评估如何快速降低大模型底层的部署加速门槛。

6月3日周二
  1. Hugging Face72

    Hugging Face 发布开源轻量机器人模型 SmolVLA

    Hugging Face 推出 450M 参数的开源机器人视觉-语言-动作模型 SmolVLA,可直接在消费级硬件及 CPU 上运行。该模型完全基于 LeRobot 社区开源数据集预训练,结合 SmolVLM2 与流匹配动作专家架构,并通过视觉 token 压缩和层跳过优化推理延迟。

    推荐理由:该模型展示了基于轻量架构与低成本社区数据训练机器人策略的路径,显著降低了具身智能的硬件门槛。

5月21日周三
  1. Hugging Face62

    Diffusers 多种量化后端实践与性能对比

    Hugging Face 详细介绍了在 Diffusers 中使用 bitsandbytes、torchao、Quanto、GGUF 以及 FP8 分层类型转换等多种量化后端的方法,并以 FLUX.1-dev 模型实测了显存与速度表现。

    推荐理由:原文横向对比了五种量化后端在 Flux-dev 上的显存占用与推理耗时,读者可以据此为扩散模型选择适合的部署优化方案。

5月15日周四
  1. Hugging Face72

    Transformers 推进模型定义标准化:打造跨框架核心枢纽并打通多引擎生态

    Hugging Face 宣布将 Transformers 库定位为跨框架的核心枢纽,推进模型定义的标准化,使新增架构直接被下游生态通用支持。Transformers 目前已支持 300 多个模型架构,正与 vLLM、SGLang、TGI 等主流推理引擎合作作为后端运行,并深化与 llama.cpp 的 GGUF 格式互通及 MLX 的兼容。

    推荐理由:文章明确了统一模型规范在主流训练与推理引擎中的打通方式,有助于开发者评估跨框架迁移成本并规范新架构的接入路径。

5月14日周三
4月30日周三
4月29日周二
4月14日周一
  1. Hugging Face80

    Hugging Face 收购 Pollen Robotics,进军开源人形机器人硬件销售

    Hugging Face 宣布收购拥有 9 年开源硬件经验的机器人团队 Pollen Robotics,开始销售开源机器人硬件。首款在售硬件为面向研究与具身智能实验的开源人形机器人 Reachy 2,售价 70,000 美元,具备 7 自由度双臂、全向移动底盘与 VR 遥操作功能。

    推荐理由:这是 Hugging Face 首次通过收购直接销售开源硬件机器人,标志着其开源生态从软件平台延伸至具身实体。

4月5日周六
4月4日周五
  1. Hugging Face64

    Gradio 月活开发者突破 100 万:开源库成长的五条经验复盘

    Gradio 宣布月活跃开发者突破 100 万,并复盘了其从斯坦福演示工具成长为机器学习 Web 框架的五条核心经验。团队重点总结了优先构建底层原语而非高层抽象(gr.Blocks 占 80% 用量)、将临时分享链接与 Hugging Face Spaces 结合内置传播属性、放弃固定路线图实行快速迭代,以及自动生成 API 端点以适配应用集成与后续 MCP 调用。

    推荐理由:原文总结了底层原语设计和垂直场景聚焦等具体实践,读者可据此参考开源 AI 库的产品架构取舍与增长路径。

4月3日周四
  1. Hugging Face63

    Hugging Face 经典 NLP 课程升级更名为大语言模型课程

    Hugging Face 宣布将运行三年的 NLP 课程升级并更名为 The LLM Course,全面转向大语言模型前沿内容。新课程在保留实体识别与分类等经典 NLP 任务的基础上,增加了大模型微调和构建 DeepSeek R1 风格推理模型的章节。后续内容还将联合 LlamaIndex、LangChain 及 Unsloth 等社区开源工具,系统覆盖微调、推理与检索等实践模块。

    推荐理由:官方课程从传统 NLP 转向覆盖推理模型与主流微调工具,为开发者提供了贴合当前开源大模型生态的系统学习路径。

3月27日周四
  1. Hugging Face84

    Hugging Face 发布 Open R1 第 4 期更新:详解 DeepSeek-V3 0324 表现与部署

    Hugging Face 梳理了新上架的 DeepSeek-V3 0324 模型,该版本改用 MIT 协议并在数学、代码与指令遵循能力上获得显著提升。基准测试中 AIME 提高至 59.4,LiveCodeBench 提高至 49.2,同时显著改善了前端开发与中文检索表现。

    推荐理由:原文汇总了新版模型在数学与代码上的评测表现,同时梳理了主流推理框架部署方案与开源运行安全规范。

3月24日周一
  1. Hugging Face61

    Gradio 推出全新 Dataframe 数据表格组件

    Gradio 宣布对核心组件 gr.Dataframe 进行全面升级,在过去 6 周内修复并增强了 70 余项功能与缺陷。新版本支持多单元格选择、行号显示、列固定、全屏交互以及数据搜索和过滤,并新增静态列设置与专属样式定制功能。用户可通过 pip install --upgrade gradio 更新库并直接体验上述改进。

    推荐理由:Gradio 对核心表格组件完成了多项交互升级,开发者更新版本后即可为排行榜与看板应用直接接入列固定和搜索过滤等功能。

3月12日周三
  1. Hugging Face83

    Google 发布新一代多模态开权重模型 Gemma 3

    Google 正式发布新一代开权重模型 Gemma 3,提供 1B、4B、12B 和 27B 四种尺寸的基础与指令微调版本。除 1B 纯文本模型具备 32k 上下文外,其余尺寸均原生支持图像与文本多模态理解、140 多种语言以及最高 128k token 上下文窗口。

    推荐理由:模型将多模态能力与长上下文下放到较小参数规模,为端侧设备和轻量化本地部署提供了高性价比选择。

3月11日周二
2月20日周四
2月12日周三
  1. Hugging Face67

    Hugging Face 推出视频生成数据集构建工具与处理流程

    Hugging Face 推出了一套用于视频生成模型微调的数据集构建工具与开源脚本,包含获取、过滤与打标的三阶段流水线。该流程通过 yt-dlp 和场景切分脚本提取片段,结合专用模型进行水印检测、美学评分、NSFW 过滤与运动评估,并支持使用 Florence-2 或 Qwen2VL 生成多粒度描述。

    推荐理由:给出了视频数据清洗的三阶段流水线与具体过滤阈值,读者可直接参考该方案构建视频生成模型的微调数据集。

2月4日周二
1月31日周五
  1. Hugging Face79

    Mini-R1:基于 GRPO 和数字倒计时游戏复现 DeepSeek-R1 顿悟时刻的强化学习教程

    作者通过 TRL、DeepSpeed 和 vLLM 在 4 张 NVIDIA H100 GPU 上运用 GRPO 算法微调 Qwen2.5-3B-Instruct,复现了类似 DeepSeek-R1 的纯强化学习自我验证顿悟现象。

    推荐理由:教程展示了用轻量开源方案跑通纯强化学习自我验证的可迁移流水线,有助于开发者评估小模型复现长链思考的算力与策略门槛。