跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

171条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 21–40 条 · 共 171 条
6月22日周一
6月18日周四
  1. Hugging Face68

    Hugging Face 评测超越 LoRA 的微调方法

    Hugging Face 在统一基准下对比了 PEFT 库中的多种参数高效微调方法,结果显示 LoRA 并非所有场景下的最优选择。在 Llama-3.2-3B 数学推理任务中,带稳定秩初始化的 LoRA 准确率达到 53.2%,而 Lily 达到 54.9%,LoRA-FA 则更加节省显存;在图像生成测试中,OFT 在相似度得分与显存占用上均优于 LoRA。

    推荐理由:实测在统一硬件和基准下对比了多种高效微调技术,揭示了 LoRA 之外的帕累托最优解,为微调权衡提供了可迁移参考。

6月17日周三
  1. Hugging Face63

    Strands Robots 结合 LeRobot:从 Hugging Face Hub 到实体硬件的智能体实践教程

    AWS 工程师在 Hugging Face 博客介绍了开源 SDK Strands Robots 与 LeRobot 的集成方案,实现了从仿真演示记录、策略推理到物理硬件部署的单一智能体工作流。

    推荐理由:原文展示了统一数据集格式和智能体接口下的端到端流程,开发者只需切换一行配置即可将仿真策略无缝部署到实体机器人。

  2. Hugging Face84

    智谱开源 GLM-5.2 旗舰模型:支持 1M 上下文与长流程编码任务

    智谱推出新一代旗舰开源模型 GLM-5.2,采用 MIT 协议完全开源,原生支持 1M token 上下文,主打面向长流程(long-horizon)的软件工程与智能体任务。

    推荐理由:GLM-5.2 将实用工程评测与 1M 上下文推理架构结合,为需要长时间自主运行的编码智能体提供了兼顾开源与高吞吐的落地参考。

  3. Hugging Face72

    Hugging Face 联合发起智能体资源发现规范 ARD 并推出 Discover 工具

    Hugging Face 与 Microsoft、Google 等合作推出开放草案规范 Agentic Resource Discovery(ARD),并上线参考实现 Discover Tool,让 AI 智能体能在运行时动态搜索并调用外部工具与技能。

    推荐理由:针对现有智能体依赖手动预装工具的痛点,该规范给出了运行时的统一发现层,便于在联邦注册表中动态检索扩展能力。

6月8日周一
  1. Hugging Face66

    开源社区联合推进 OpenEnv:打造智能体强化学习交互协议层

    Hugging Face 宣布 OpenEnv 成立多方联合治理委员会,并将其明确为智能体强化学习环境的标准化互操作协议层。OpenEnv 基于客户端与服务端架构提供类 Gymnasium API,通过 HTTP、WebSocket 和 Docker 部署并原生兼容 MCP,不绑定具体的奖励计算逻辑。

    推荐理由:原文阐述了 OpenEnv 作为环境互操作协议层的设计与多机构治理路线,为开源智能体训练提供了标准化的环境交互与部署方案。

6月5日周五
6月1日周一
  1. Hugging Face67

    JetBrains 发布 12B 开源混合专家模型 Mellum2

    JetBrains 正式发布开源混合专家模型 Mellum2,总参数量为 12B 且每个 token 仅激活 2.5B 参数,专注于文本与代码任务。该模型基于 Apache 2.0 许可证开源,官方测试称其比同尺寸模型推理速度提升 2 倍以上,适用于路由编排、RAG 流水线、子智能体及私有化部署等高吞吐工作负载。

    推荐理由:该模型通过低激活参数量和高推理速度降低部署成本,为复杂系统中高频调用的路由与子智能体任务提供了轻量解法。

5月27日周三
  1. Hugging Face70

    开源机器人 Reachy Mini 实现全本地语音对话运行

    Hugging Face 推出完全本地化运行的 Reachy Mini 机器人语音交互方案,音频无需上传云端服务器即可完成实时对话。该方案依托 speech-to-speech 级联流水线,默认组合 Silero VAD、Parakeet-TDT 0.6B v3 语音识别、Qwen3-TTS 语音合成,并支持通过 llama.cpp、vLLM 或 MLX 本地驱动 LLM。

    推荐理由:提供了基于开源级联流水线搭建低延迟端到端语音交互的完整方案,读者可以据此将本地语音闭环迁移至各类机器人与端侧设备。

5月19日周二
5月15日周五
4月29日周三
  1. Hugging Face65

    IBM 开源 Granite 4.1 系列大模型

    IBM 宣布以 Apache 2.0 协议开源 Granite 4.1 系列稠密大语言模型,包含 3B、8B 和 30B 三种尺寸,支持最高 512K 上下文。

    推荐理由:技术报告详述了五阶段退火预训练与四阶段强化学习流程,为端侧与企业级小参数稠密模型的构建提供了完整工程参考。

4月28日周二
  1. Hugging Face77

    NVIDIA 发布 Nemotron 3 Nano Omni:支持文档、音视频与智能体的长上下文多模态全能模型

    NVIDIA 正式推出全模态理解模型 Nemotron 3 Nano Omni,原生支持文本、图像、长音视频理解、复杂文档分析以及 GUI 智能体计算机操作。

    推荐理由:该模型结合 Mamba-Transformer-MoE 混合架构与原生音视频编码,为长上下文多模态处理与 GUI 智能体提供了高吞吐量的开源实现方案。

4月24日周五
4月22日周三
4月16日周四
  1. Hugging Face72

    Hugging Face 推出 transformers-to-mlx Skill 与测试套件,加速模型移植到 Apple MLX

    Hugging Face 推出基于 Claude Code 的 transformers-to-mlx 技能与独立测试套件,辅助开发者将 transformers 架构模型规范地移植到 Apple MLX 框架的 mlx-lm 库。

    推荐理由:它展示了如何将项目规范与独立验证流程封装为技能,在保证提交质量的同时降低开源模型跨框架迁移门槛。

4月9日周四
  1. Hugging Face74

    Sentence Transformers v5.4 发布:支持多模态嵌入与重排序模型

    Sentence Transformers 发布 v5.4 版本,正式支持通过统一 API 编码与比对文本、图像、音频和视频等多模态数据。新版本同时涵盖多模态嵌入(SentenceTransformer)与重排序(CrossEncoder)能力,原生适配 Qwen3-VL、Nemotron 等开源模型并支持混合输入。

    推荐理由:该更新统一了文本、图像与音视频的检索与重排序接口,便于开发者直接构建跨模态 RAG 管线。

  2. Hugging Face74

    Overworld 发布 Waypoint-1.5 实时交互世界模型,支持消费级 GPU 本地运行

    Overworld 正式发布实时视频世界模型 Waypoint-1.5,模型权重已在 Hugging Face 开源上线,主打消费级硬件本地实时交互。在 RTX 3090 至 5090 显卡上可实时生成最高 720p 60 FPS 环境,并提供适配游戏本及 Apple Silicon 的 360p 规格。

    推荐理由:原文给出了消费级硬件本地运行世界模型的具体分级与训练细节,读者可以了解端侧实时交互环境生成的落地可能。