跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

101条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 61–80 条 · 共 101 条
9月23日周二
  1. Qwen Blog66

    Qwen 发布 Qwen3Guard 安全护栏模型系列

    Qwen 发布 Qwen 系列首个安全护栏模型 Qwen3Guard,基于 Qwen3 基础模型微调,可对提示词和回复做安全检测并给出风险等级与分类。它提供 Qwen3Guard-Gen 和 Qwen3Guard-Stream 两个变体,后者通过 Transformer 末层两个轻量分类头实现逐 token 的实时流式检测,两者均有 0.6B、4B、8B 三种规模。

    推荐理由:原文给出两种安全护栏变体的能力差异与开源入口,读者可据此判断流式审核在部署中的取舍。

8月19日周二
  1. Qwen Blog76

    Qwen 发布图像编辑模型 Qwen-Image-Edit

    Qwen 发布 Qwen-Image-Edit,这是基于 20B Qwen-Image 的图像编辑版本,将文本渲染能力扩展到图像编辑任务。该模型同时把输入图像送入 Qwen2.5-VL 做视觉语义控制、送入 VAE Encoder 做视觉外观控制,支持语义编辑与外观编辑,并支持中英双语文字的直接增删改且保留原字体、大小和风格。

    推荐理由:原文给出语义与外观两类编辑能力及中英文字编辑细节,读者可据此判断图像编辑模型的能力边界。

8月4日周一
  1. Qwen Blog78

    Qwen 发布 20B 图像基础模型 Qwen-Image

    Qwen 发布 Qwen-Image,一个 20B MMDiT 图像基础模型,主打复杂文字渲染与精准图像编辑,可在 Qwen Chat 的 Image Generation 入口试用。

    推荐理由:原文给出 20B MMDiT 图像基础模型在文字渲染与图像编辑上的能力展示和多个基准结果,读者可据此判断中文文字生成的实际水平。

7月27日周日
7月22日周二
7月15日周二
  1. Mistral AI78

    Mistral 发布 Voxtral 语音理解模型,24B 与 3B 双版本开源

    Mistral AI 发布 Voxtral 语音理解模型,提供 24B 和 3B 两个版本,均以 Apache 2.0 许可开源并上线 API。模型支持 32k token 上下文,可处理最长 30 分钟音频转写或 40 分钟音频理解,具备内置问答与摘要、多语言自动检测以及从语音直接触发函数调用等能力。

    推荐理由:Mistral 开源两款语音理解模型,给出与 Whisper、GPT-4o mini、Gemini 2.5 Flash 的基准对比和 API 定价,便于评估替代方案。

7月11日周五
6月26日周四
  1. Qwen Blog71

    Qwen 发布统一多模态理解与生成模型 Qwen VLo

    Qwen 发布统一多模态理解与生成模型 Qwen VLo,预览版可通过 Qwen Chat 访问,支持直接文生图和上传图片后按指令修改。该模型采用从左到右、从上到下的渐进式生成方式,支持中英文等多语言指令,可完成风格迁移、背景替换、文字编辑以及检测、分割、边缘提取等任务。官方表示多图输入和极端宽高比生成尚未正式上线,模型仍处预览阶段,存在生成不准确、不遵循指令等不足。

    推荐理由:原文给出统一理解与生成模型的预览入口和能力边界,读者可据此判断多模态生成的实际可用程度。

6月11日周三
6月10日周二
6月5日周四
  1. Qwen Blog62

    Qwen3 Embedding 系列发布:文本嵌入与重排模型开源

    Qwen3 Embedding 系列发布,包含 0.6B、4B、8B 三种尺寸的文本嵌入与重排模型,基于 Qwen3 基础模型构建,以 Apache 2.0 协议在 Hugging Face 和 ModelScope 开源,技术报告与代码已发布在 GitHub。

    推荐理由:原文给出 Qwen3 Embedding 系列的尺寸、评测分数与开源入口,读者可据此判断它在检索与重排任务上的选型空间。

5月21日周三
  1. Mistral AI76

    Mistral AI 与 All Hands AI 发布 Devstral 智能体编码模型

    Mistral AI 与 All Hands AI 合作发布面向软件工程任务的智能体模型 Devstral,以 Apache 2.0 许可开源,在 SWE-Bench Verified 上得分 46.8%,超过此前开源 SOTA 逾 6 个百分点,并在同一 OpenHands 测试框架下超过 Deepseek-V3-0324(671B)和 Qwen3 232B-A22B。

    推荐理由:Devstral 在 SWE-Bench Verified 上以 46.8% 超过此前开源 SOTA 逾 6 个百分点,并给出单卡 4090 可跑的本地部署路径。

4月29日周二
3月27日周四
  1. Qwen Blog75

    Qwen 发布端到端全模态模型 Qwen2.5-Omni

    Qwen 团队发布端到端全模态模型 Qwen2.5-Omni,可处理文本、图像、音频和视频输入,并以流式方式同时输出文本与自然语音。该模型采用 Thinker-Talker 架构,并提出 TMRoPE 位置嵌入来同步视频与音频时间戳,支持分块输入和即时输出的实时交互。

    推荐理由:原文给出 Thinker-Talker 架构与实时语音视频交互能力,读者可据此判断端到端全模态模型的落地方式。

3月24日周一
3月17日周一
3月6日周四
  1. Qwen Blog80

    Qwen 发布 QwQ-32B 推理模型,320 亿参数对标 DeepSeek-R1

    Qwen 发布 QwQ-32B,一个 320 亿参数的推理模型,官方称其性能可与 6710 亿参数(激活 370 亿)的 DeepSeek-R1 相比。该模型以 Apache 2.0 协议在 Hugging Face 和 ModelScope 开源权重,并可通过 Qwen Chat 使用。

    推荐理由:原文给出 32B 模型对标 671B 的评测结果与两阶段 RL 训练方法,可据此判断小模型推理路线的可行性。

2月25日周二
  1. Qwen Blog62

    Qwen 发布 QwQ-Max-Preview 推理模型预览版

    Qwen 团队发布 QwQ-Max-Preview,这是基于 Qwen2.5-Max 构建的推理模型预览版,在数学、编码和通用领域任务上表现突出,并擅长 Agent 相关工作流。官方表示 QwQ-Max 与 Qwen2.5-Max 将以 Apache 2.0 协议开源,后续还会推出 Qwen Chat App,并开源 QwQ-32B 等更小的推理模型供本地部署。

    推荐理由:原文给出 QwQ-Max-Preview 的能力定位与后续开源、App 和小模型计划,读者可据此判断 Qwen 推理模型的路线。

1月28日周二
1月27日周一