美团开源 LongCat-Next,仅3B参数实现文本到图像再到语音全模态统一处理
来源丨AIGC Studio 近日,美团开源了一款名为 LongCat-Next 的原生全模态模型,该模型能够接受文本、语音、图像的输入,并生成相应的文本、语音、图像输出。 LongCat-Next不仅简化了多模态建模的复杂性,还在图像理解…
39 0 0
来源丨AIGC Studio 近日,美团开源了一款名为 LongCat-Next 的原生全模态模型,该模型能够接受文本、语音、图像的输入,并生成相应的文本、语音、图像输出。 LongCat-Next不仅简化了多模态建模的复杂性,还在图像理解…