跳到正文

#Meta

今日 0 条
8月10日周一
  1. Hugging Face83

    Meta 开源端侧多模态模型 Muse Glimmer-30B,主打本地智能体场景

    Meta 推出专为本地智能体设计的开源多模态模型 Muse Glimmer-30B,采用 Apache 2.0 协议开源并已上线 Hugging Face。该模型由 2B 视觉编码器和 28B 文本解码器构成,支持视频理解、多模态工具调用与 DFlash 投机解码加速。

    推荐理由:该模型展示了 30B 级别端侧多模态模型通过智能体指令实现自我量化、云端部署与推理自优化的工程实践。

6月8日周一
  1. Hugging Face66

    开源社区联合推进 OpenEnv:打造智能体强化学习交互协议层

    Hugging Face 宣布 OpenEnv 成立多方联合治理委员会,并将其明确为智能体强化学习环境的标准化互操作协议层。OpenEnv 基于客户端与服务端架构提供类 Gymnasium API,通过 HTTP、WebSocket 和 Docker 部署并原生兼容 MCP,不绑定具体的奖励计算逻辑。

    推荐理由:原文阐述了 OpenEnv 作为环境互操作协议层的设计与多机构治理路线,为开源智能体训练提供了标准化的环境交互与部署方案。

10月23日周四
8月5日周二
  1. Hugging Face64

    在 DeepResearch Bench 上评测开源 Llama Nemotron 模型

    NVIDIA 的 AI-Q 深度研究智能体在 DeepResearch Bench 的搜索增强大语言模型榜单中取得 40.52 的总分,位列完全开源架构榜首。

    推荐理由:文章呈现了开源大模型结合检索架构在深度研究基准上的实测表现,为构建本地可部署的智能体工作流提供了参数选型与评测参考。

4月29日周二
4月5日周六
11月20日周三
10月21日周一
  1. Hugging Face51

    Keras 支持运行与微调 Llama 3.2

    Keras 与 keras_hub 已支持直接加载 Hugging Face 上的 Llama 3.2 检查点进行推理与训练,遇到格式差异时会自动完成实时转换。框架支持 JAX、PyTorch 与 TensorFlow 多后端运行,并提供内置的分词器与预处理器接口。结合 JAX 与 XLA 编译机制,用户还能在 TPU 或 GPU 上配置模型并行以运行及微调更大参数量的模型。

8月19日周一
7月23日周二
5月24日周五
  1. Hugging Face62

    CyberSecEval 2 发布:大语言模型网络安全风险与能力评估框架上线

    Meta 与 Hugging Face 推出开源基准 CyberSecEval 2 及排行榜,用于系统评估大语言模型在网络安全领域的风险与能力。评测覆盖不安全代码生成、提示词注入抵御、协助网络攻击合规率、代码解释器滥用以及自动化攻防渗透等维度。最新评测显示模型协助网络攻击的合规率从 52% 降至 28%,但提示词注入和解释器滥用在面对对抗性输入时仍缺乏可靠防护。

    推荐理由:该框架从不安全代码生成与提示词注入等维度评估模型风险,帮助开发者在接入代码助手时量化评估潜在安全隐患。

4月18日周四
  1. Hugging Face96

    Meta 正式发布开源大语言模型 Llama 3,Hugging Face 全面集成上线

    Meta 正式发布开源大语言模型 Llama 3,提供 8B 和 70B 两个尺寸的基础版与指令微调版,并同步推出安全模型 Llama Guard 2。模型在超过 15 万亿模型 token 上训练,词表扩展至 128,256,上下文窗口为 8k context,8B 版本增加了分组查询注意力(GQA)。

    推荐理由:原文梳理了模型架构参数与词表变化,并给出了在开源框架下进行推理部署和单卡微调的完整代码。

3月21日周四
1月19日周五
11月7日周二
9月28日周四
9月26日周二
8月8日周二
7月18日周二
  1. Hugging Face96

    Meta 开源大语言模型 Llama 2,Hugging Face 提供全面集成支持

    Meta 发布开源大语言模型家族 Llama 2,涵盖 7B、13B 和 70B 参数版本并开放商用许可,Hugging Face 同步提供全生态集成支持。该系列在初代基础上增加了 40% 预训练 token 并将上下文拓展至 4k tokens,经 RLHF 优化的 Llama 2-Chat 在多项基准上接近 ChatGPT 表现。

    推荐理由:材料梳理了新模型相比初代的上下文与训练量升级,并提供了基于开源生态的推理部署与微调路径。

6月19日周一
6月6日周二
  1. Hugging Face41

    fastText 正式入驻 Hugging Face Hub

    Hugging Face 正式上线 Meta AI 旗下 fastText 模型的官方镜像,涵盖全部 157 种语言的词向量以及最新的语种识别模型。开发者可通过 huggingface_hub 便捷下载并调用模型,执行词向量特征提取、近邻词查询和文本语种检测等任务。该集成同时在 Hugging Face 模型页面支持文本分类与特征提取的交互式 widget 体验。

4月5日周三
  1. Hugging Face81

    StackLLaMA:使用 RLHF 训练 LLaMA 的实操指南

    Hugging Face 发布 StackLLaMA 实操教程与模型权重,演示如何结合 TRL 库与 8-bit LoRA 技术对 LLaMA-7B 完成完整的 RLHF 对齐。流程涵盖基于 StackExchange 数据的监督微调、奖励模型训练及 PPO 强化学习全周期,并深入分析了奖励作弊与负 KL 惩罚等训练不稳定性问题及工程应对方案。

    推荐理由:原文完整梳理了借助参数高效微调在有限算力下落地人类反馈对齐的工程链路,为开源模型复现相关算法提供了可操作方案。