跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

234条精选相关主题模型发布行业动态AI 编码

最新精选

第 161–180 条 · 共 234 条
9月17日周二
  1. Hugging Face71

    Hugging Face 为数据集推出 SQL 控制台

    Hugging Face 在 Hub 数据集页面推出 SQL 控制台(SQL Console),支持用户直接在浏览器中对数据集执行 SQL 查询。该功能基于 DuckDB WASM 构建,无需后端服务器即可在浏览器本地运行,支持完整的 DuckDB 语法、结果导出为 Parquet 文件及链接分享。

    推荐理由:原文给出了在浏览器内使用 DuckDB WASM 交互式查询 Hugging Face 数据集的完整机制与内存限制,读者可以借此简化微调前的数据筛选流程。

9月16日周一
8月20日周二
8月6日周二
  1. OpenAI83

    OpenAI API 推出结构化输出功能

    OpenAI 宣布在 API 中引入结构化输出(Structured Outputs)功能。该功能可确保模型输出能够可靠遵循开发者提供的 JSON Schema。

    推荐理由:该功能让模型输出严格匹配开发者定义的架构,方便下游系统稳定解析与工程集成。

7月18日周四
  1. Hugging Face67

    Hugging Face TGI 推出 Multi-LoRA 服务功能:单次部署支持同时运行 30 个模型

    Hugging Face 的 Text Generation Inference(TGI)正式支持 Multi-LoRA serving,允许用户在单次部署基础模型的前提下动态路由并调用多个任务专用 LoRA 适配器。

    推荐理由:文章展示了通过单个基础模型动态挂载多个 LoRA 适配器的方法,帮助团队在多任务场景下显著降低硬件与显存开销。

7月9日周二
  1. Hugging Face67

    Google Cloud TPU 正式面向 Hugging Face 用户开放

    Hugging Face 宣布在其 Inference Endpoints 和 Spaces 中正式上线 Google Cloud TPU v5e 算力支持。服务提供 1 核 16 GB(每小时 $1.375)、4 核 64 GB(每小时 $5.50)以及 8 核 128 GB(每小时 $11.00)三种配置。

    推荐理由:该支持降低了在托管环境调用 TPU 的操作门槛,为需要平衡延迟与成本的开源模型部署提供了具体的硬件配置参考。

7月8日周一
  1. Hugging Face62

    Hugging Face 推出四项全新数据集搜索与过滤功能

    Hugging Face 宣布为其 Dataset Hub 推出四项全新搜索过滤功能,以提升平台上超过 18 万个公开数据集的检索效率。新功能支持按数据模态(文本、图像、音频、3D、视频等)、数据规模(指定行数区间)、文件格式(如 Parquet、WebDataset)以及兼容代码库(如 Pandas、Dask、🤗 Datasets 并提供加载代码片段)进行筛选。

    推荐理由:原文详细介绍了按模态、数据规模、存储格式和兼容库四类新增过滤维度,方便开发者精准检索和筛选训练数据。

6月12日周三
5月16日周四
5月13日周一
5月3日周五
4月24日周三
4月2日周二
  1. Hugging Face67

    Hugging Face 联合 Cloudflare 推出 Workers AI 无服务器 GPU 推理部署

    Hugging Face 宣布在 Hub 上推出 Deploy on Cloudflare Workers AI 集成,让开发者能以无服务器 API 形式调用部署在 Cloudflare 边缘数据中心 GPU 上的开源模型。

    推荐理由:该功能将边缘无服务器 GPU 与开源模型库结合并按调用量计费,为开发者降低了运行开源大模型的运维门槛与闲置成本。

2月27日周二
  1. Hugging Face69

    Hugging Face 推出语音模型盲测平台 TTS Arena

    Hugging Face 宣布推出 TTS Arena,通过社区盲测与类 Elo 评分机制对文本转语音模型进行对比排行。用户输入文本后盲测试听两款模型的生成效果并投票,系统在提交后揭示模型名称并更新榜单。首批入选模型包括商业模型 ElevenLabs 以及 MetaVoice、OpenVoice、Pheme、WhisperSpeech 和 XTTS 等开源方案。

    推荐理由:平台借鉴盲测竞技场机制解决语音合成主观评估难的问题,为开发者比较开源与闭源语音模型提供了统一参考。

2月19日周一
  1. Hugging Face71

    Hugging Face PEFT 支持多种 LoRA 适配器融合新方法

    Hugging Face 宣布在 PEFT 库中支持多种针对 LoRA 适配器的融合新方法,允许开发者在运行时动态合并来自同一基模的多个微调权重。新方法涵盖矩阵拼接(cat)、线性加权(linear)、SVD 分解、TIES、DARE 以及幅度剪枝等机制,可通过 add_weighted_adapter() 直接调用。

    推荐理由:文章梳理了六种 LoRA 适配器融合机制与参数调优实践,为多任务微调权重的低成本组合提供了标准参考。

2月13日周二
2月8日周四
1月10日周三
  1. Hugging Face80

    Hugging Face 介绍 Unsloth 与 TRL 集成:大语言模型微调提速可达 2 倍且节省显存

    Hugging Face 介绍了轻量级微调库 Unsloth 及其与 TRL 工具集的无缝集成,在保证精度零损失的前提下可将大语言模型微调提速最高 2.7 倍并减少最多 74% 显存占用。

    推荐理由:文中展示了通过重写反向传播与 Triton 内核加速微调的具体实现,为在有限显存下微调开源模型提供了现成的集成方案。