腾讯混元发布 52B 参数多模态理解模型 Large-Vision
腾讯混元团队近日发布了全新的多模态理解模型——混元Large-Vision,该模型采用腾讯混元擅长的MoE(专家混合)架构,激活参数达到52B规模,在性能与效率之间实现了良好平衡。
混元Large-Vision的核心亮点在于其强大的多模态输入支持能力。该模型不仅支持任意分辨率的图像处理,还能处理视频和3D空间输入,为用户提供了全方位的视觉理解体验。这一技术突破意味着用户可以直接输入各种格式和尺寸的视觉内容,无需进行复杂的预处理操作。
MoE架构通过动态激活部分专家网络来处理不同类型的输入,既保证了模型的强大性能,又避免了全参数激活带来的计算资源浪费。52B的激活参数规模在当前多模态模型中处于先进水平,能够处理复杂的视觉理解任务。
该模型还重点提升了多语言场景理解能力,这对于全球化应用具有重要意义。在处理包含多种语言文字的图像或视频时,混元Large-Vision能够准确识别和理解不同语言环境下的视觉内容,为跨语言的多模态应用提供了技术基础。
混元Large-Vision支持任意分辨率图像输入的特性尤其值得关注。传统的视觉模型往往需要将输入图像调整到固定尺寸,这可能导致信息丢失或画质下降。而混元Large-Vision能够直接处理原始分辨率的图像,保持了视觉信息的完整性,这对于需要精细视觉分析的应用场景具有重要价值。
3D空间输入支持则进一步扩展了模型的应用范围,为虚拟现实、增强现实、3D建模等领域的AI应用提供了强有力的技术支撑。结合视频处理能力,该模型有望在智能监控、视频分析、内容创作等多个行业发挥重要作用。

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。
持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。
转载内容版权归作者及来源网站所有,本站原创内容转载请注明来源。
- 上一篇
昆仑万维开源 Skywork UniPic 2.0
昆仑万维宣布正式开源 Skywork UniPic 2.0 模型——面向统一多模态建模的高效训练和推理框架,围绕生成和编辑模块轻量化、连接多模态理解模型进行联合训练,构建了理解、生图、编辑一体化的核心能力,旨在实现“高效、高质、统一”的多模态生成模型。 目前,Skywork UniPic 2.0 及其系列模型已全面开源,涵盖模型权重、推理代码、强化策略等。 Skywork UniPic 2.0 由三个核心模块组成: 生图编辑(下图中):基于 SD3.5-Medium 架构将原本只支持文本输入的模型改进成也接受文本图像同时输入,然后通过高质量图像生成和编辑数据的训练将原本生图能力扩展成生图、编辑双能力。 统一模型能力(下图左侧与中间):通过冻结生图编辑模块,多模态模型(Qwen2.5-VL-7B),Pre-Train连接器来构建出理解生成编辑一体化能力,再通过连接器和生图编辑模块一起联合微调,实现最终的一体化理解、生图、编辑模型。 生图编辑后训练(下图右):为提升生图编辑整体性能,设计了基于Flow-GRPO的渐进式双任务强化策略,实现了生成与编辑任务在不互相干扰下的协同优化,在预训练的...
- 下一篇
阿里通义升级 Qwen Chat 的 Deep Research (深入研究)功能
阿里通义Qwen团队宣布对Qwen Chat的Deep Research能力进行了升级。此次升级旨在提供更智能、更具洞察力的研究报告。 新版本通过更深入的搜索来获取更丰富的研究发现,并提高了信息准确性以减少幻觉现象。技术上,新版本支持模块化工具和并行执行。 此外,一个重要的新增功能是多模态输入支持,允许用户上传文件和图像进行研究。用户可通过官方链接体验此项新功能。 https://chat.qwen.ai/?inputFeature=deep_research
相关文章
文章评论
共有0条评论来说两句吧...
文章二维码
点击排行
推荐阅读
最新文章
- SpringBoot2编写第一个Controller,响应你的http请求并返回结果
- SpringBoot2整合Redis,开启缓存,提高访问速度
- SpringBoot2整合MyBatis,连接MySql数据库做增删改查操作
- CentOS关闭SELinux安全模块
- SpringBoot2全家桶,快速入门学习开发网站教程
- Docker快速安装Oracle11G,搭建oracle11g学习环境
- 设置Eclipse缩进为4个空格,增强代码规范
- Docker使用Oracle官方镜像安装(12C,18C,19C)
- Springboot2将连接池hikari替换为druid,体验最强大的数据库连接池
- CentOS7,8上快速安装Gitea,搭建Git服务器