球探足球比分

图片
您的位置: 首页 > 新闻 > 智能家居 > 新闻详情

英伟达推全新视觉AI语音模型 可以直接看图聊天

时间:2024-09-02 16:59:40
  • 来源:互联网
  • 作者:硅星人
  • 编辑:陶笛

如今AI大时代,世界各大巨头都有自己的特色AI产品计划,日前据英伟达官方消息,英伟达联合 Georgia Tech、UMD 和 HKPU 的研究团队推出了全新的视觉语言模型 ——NVEagle。

英伟达推全新视觉AI语音模型 可以直接看图聊天

据悉,NVEagle 能够理解复杂的现实场景,通过视觉输入进行更好的解读和回应。它的设计核心在于将图像转化为视觉标记,再与文本嵌入相结合,进而提升了对视觉信息的理解。

NVEagle包括了三个版本:Eagle-X5-7B、Eagle-X5-13B 以及 Eagle-X5-13B-Chat。其中,7B 和13B 版本主要用于一般的视觉语言任务,而13B-Chat 版本则专门针对对话式 AI 进行了微调,能够更好地进行基于视觉输入的互动。

NVEagle 的一个亮点在于采用了混合专家(MoE)机制,能够根据不同任务动态选择最合适的视觉编码器,这极大提升了对复杂视觉信息的处理能力。该模型已在 Hugging Face 上发布,方便研究人员和开发者使用。

英伟达推全新视觉AI语音模型 可以直接看图聊天

0

玩家点评 0人参与,0条评论)

收藏
违法和不良信息举报
分享:

热门评论

全部评论

他们都在说 再看看
3DM自运营游戏推荐 更多+