全部AI动态

浏览AI动态,在一处查找来源与时间。

1287 条动态最近更新 2026-10-05 10:15 UTC+8
清除筛选

最新动态

1287 条动态 · UTC+8

2026-09-21

10 条动态

2026-09-20

1 条动态
千问 Qwen模型

Qwen-Image-2.1:小模强效,创改一体

我们很高兴地开源 Qwen-Image-2.1,千问图像系列当前兼顾生成效果、推理效率与使用成本的开源图像模型。Qwen-Image-2.1 将文生图与图像编辑整合在同一模型中,视觉生成部分仅有 7B 参数,并原生支持透明图像的生成与编辑。 本次更新的主要特色包括四个方面: 小模强效,极致价比:轻量的模型结构与推理优化,在生成质量和计算成本之间取得平衡。

Qwen-Image-2.1 横幅
站内阅读 阅读原文

2026-09-19

6 条动态

2026-09-18

16 条动态
千问 Qwen模型

Qwen3.8-LiveTranslate:知其人,传其义

同传不只是翻译得快,更要听得清、译得准。Qwen3.8-LiveTranslate 以 Interleave 架构重构实时同传,忠实度、流畅度、简洁度全面提升,字均延迟(LAAL)从 2.8 秒降至 2.3 秒。我们希望同传不只传递语言、也能保留交流中人物与上下文信息,因此,在支持 60 种语言的基础上,Qwen3.8-LiveTranslate 新增三项能力让同传更广泛的应用于真实场景中:实时说话人分离,每句话归属清晰,音色复刻更稳定;原文译文同帧同出,双语同屏;长上下文消歧,联系前文读懂当下,人名术语翻译更精准。

Qwen3.8-LiveTranslate Features Overview
站内阅读 阅读原文
千问 Qwen模型

Qwen3.8-Omni-Flash:耳聪目明,办事得力

今天,新一代原生全模态模型 Qwen3.8-Omni-Flash 正式上线。该模型的核心目标是提升其在真实生产力场景中的 Agent 能力,推动全模态模型从“理解全模态内容”进一步走向“规划任务、调用工具并完成创作”。在具备编程、文本知识工作和 GUI 操作等通用 Agentic 能力的基础上,Qwen3.8-Omni-Flash 进一步拓展了以音视频为核心的 Agentic 应用,在视频剪辑、音乐视频创作、影视制作与解说、音视频转图文摘要和音视频对话等需要综合处理文本、图像、音频与视频的工作流中取得了显著效果。

站内阅读 阅读原文