来源丨魔搭社区 通义万相开源 Wan-Dancer,一款音乐驱动的人像舞蹈视频生成模型。输入一张人物照片和一段音乐,即可自动生成节奏精准、动作流畅、风格鲜明的高质量舞蹈视频。首次突破分钟级时序瓶颈,支持15秒到3分钟的超长连贯输出,覆盖中国…
声浪
以下文章来源于Xiaomi MiMo 今天凌晨,Xiaomi MiMo-V2.5 系列模型正式开启公测。 Xiaomi MiMo-V2.5 系列包含 MiMo-V2.5、V2.5-Pro 、V2.5-TTS Series 、V2.5-ASR…
昨晚,千问3.6系列最新模型Qwen3.6-27B正式开源! 该模型在核心编程能力评测中,以270亿的总参数量,性能媲美千亿参数级别模型。在SWE-bench、Terminal-Bench 2.0、SkillsBench、QwenWebBe…
论文标题: Qwen3.5-Omni Technical Report 论文链接: https://arxiv.org/abs/2604.15804v1 代码链接: https://modelscope.cn/studios/Qwen/Qw…
体量轻巧、推理高效,Qwen3.6-35B-A3B 开源! 这是一款采用稀疏混合专家(MoE)架构的高效模型:总参数350 亿,每次推理仅激活30 亿参数。 参数量虽小,性能依旧强劲。在智能体编程上,它大幅超越前代 Qwen3.5-35B-…
来源丨开源星探 做视频剪辑的人都懂,从几小时的素材里剪出一段踩点精准、叙事流畅的短视频有多折磨人。 特别是对于旅拍博主和Vlogger来说,拍了一天5-6小时的素材,回来还要花好几个小时慢慢剪,真正的创作热情都被这种机械劳动消磨掉了。 更别…
来源丨机器之心 1 月 26 日深夜,阿里千问旗舰推理模型 Qwen3-Max-Thinking 正式上线。 该模型在科学知识(GPQA Diamond)、数学推理(IMO-AnswerBench)、代码编程(LiveCodeBench)等…
几个小时前,阿里一次更新了3个大模型,分别是 开源的全模态大模型 Qwen3-Omni 开源的图像编辑大模型Qwen-Image-Edit-2509 不开源的语音合成大模型 Qwen3-TTS 本次发布的3个模型均为多模态大模型,可以说阿里…
来源丨阿里云 近日,通义首个深度研究Agent模型DeepResearch正式开源。该模型参数仅30B(激活3B),在多个权威评测集上取得SOTA成绩,超越众多顶级Agent模型。 目前,通义DeepResearch的模型、框架和方案均已全…
阿里巴巴通义实验室推出了FunAudio-ASR端到端语音识别大模型。这款模型通过创新的Context模块,针对性优化了“幻觉”、“串语种”等关键问题,在高噪声的场景下,幻觉率从78.5%下降至10.7%,下降幅度接近70%。 FunAud…
