AI创业之家

首页

立即注册

免费试用

首页 > AI资讯 > AI头条

今日推荐

热门搜索

Chat gpt人工智能网页版国内使用入口昆仑万维实测“天工”大模型：以AI改写搜索边界抢抓大模型机遇助力AI产业高质量发展多模态大模型推动AI迈向“通感”时代巨人网络与阿里云达成“游戏+AI”全面合作 2023中国AI大语言模型前10名美团入股智谱AI 纷享销客战略融资 AI圈割韭菜乱象频出：卖199元AI课赚了上千万华为正式发布盘古大模型3.0 探索用AI赋能千行百业 AI 作图内卷加剧：AI作图领域内卷现象深度解析谷歌CEO万字访谈：搜索未来、AI变革、合并DeepMind幕后故事当AI绘画开始抢动漫人饭碗 AI大模型继续遍地开花华为发布大模型时代AI存储新品 5G+AI，点亮银龄潮生活

标准化CRM

AI原创论文写作

毕业论文、学术论文写作

大型CRM

AI长篇写作

写小说、写论文等

CRM定制开发

AI生成思维导图

一键快速生成思维导图

轻创AI用户注册

免费获取体验账号

通义千问开源视觉语言模型Qwen2-VL 2B、7B尺寸API可直接调用

来源：AIbase基地· 2024-09-02 14:55:33

9月2日，通义千问宣布开源其第二代视觉语言模型Qwen2-VL，并在阿里云百炼平台上推出2B、7B两个尺寸及其量化版本模型的API，供用户直接调用。

Qwen2-VL模型在多个方面实现了性能的全面提升。它能够理解不同分辨率和不同长宽比的图片，在DocVQA、RealWorldQA、MTVQA等基准测试中创下全球领先的表现。此外，该模型还能理解20分钟以上的长视频，支持基于视频的问答、对话和内容创作等应用。Qwen2-VL还具备强大的视觉智能体能力，能够自主操作手机和机器人，进行复杂推理和决策。

该模型能够理解图像视频中的多语言文本，包括中文、英文、大多数欧洲语言、日语、韩语、阿拉伯语、越南语等。通义千问团队从六个方面评估了模型的能力，包括综合的大学题目、数学能力、文档表格多语言文字图像的理解、通用场景问答、视频理解、Agent能力。

微信截图_20240902141930.png

Qwen2-VL-72B作为旗舰模型，在大部分指标上都达到了最优。Qwen2-VL-7B以其经济型参数规模实现了极具竞争力的性能表现，而Qwen2-VL-2B则支持移动端的丰富应用，具备完整的图像视频多语言理解能力。

在模型架构方面，Qwen2-VL延续了ViT加Qwen2的串联结构，三个尺寸的模型都采用了600M规模大小的ViT，支持图像和视频统一输入。为了提升模型对视觉信息的感知和视频理解能力，团队在架构上进行了升级，包括实现对原生动态分辨率的全面支持和使用多模态旋转位置嵌入（M-ROPE）方法。

阿里云百炼平台提供了Qwen2-VL-72B的API，用户可以直接调用。同时，Qwen2-VL-2B和Qwen2-VL-7B的开源代码已集成到Hugging Face Transformers、vLLM和其他第三方框架中，开发者可以通过这些平台下载和使用模型。

您可能关注: 语言模型 API

专业AI论文写作一键生成万字论文只需5分钟

文章来源: https://cy211.cn/aizixun/3783.html Chat AI人工智能机器人在线使用

[免责声明]如需转载请注明原创来源;本站部分文章和图片来源网络编辑，如存在版权问题请发送邮件至398879136@qq.com，我们会在3个工作日内处理。非原创标注的文章，观点仅代表作者本人，不代表本站立场。

上一篇 360AI 助手推出模型竞技场让用户比较多家大模型表现

下一篇百度交通大模型落地贵阳工作日车辆平均延误时长减少15%

相关推荐

仅需250份文件！AI模型也能被 “洗脑” 的惊人发现

仅需250份文件！AI模型也能被 “洗脑” 的惊人发现

　在近期的一项联合研究中，来自 Anthropic、英国 AI 安全研究所和艾伦・图灵研究所的科学家们揭示了一个惊人的事实:大语言模型（如 ChatGPT、Cla ...

AI摘要与社交媒体双重夹击:维基百科人工流量骤降8% 敲响警钟

AI摘要与社交媒体双重夹击:维基百科人工流量骤降8% 敲响警钟

　长期以来被誉为“互联网绿洲”的维基百科，正面临着来自生成式人工智能和社交媒体的严峻挑战。维基媒体基金会（Wikimedia Foundation）的马歇尔·米勒 ...

AI视频公司爱诗科技完成1亿元B+轮融资：ARR突破4000万美元，用户超1亿

AI视频公司爱诗科技完成1亿元B+轮融资：ARR突破4000万美元，用户超1亿

　国内AI视频生成公司爱诗科技（PixVerse）于10月17日宣布完成1亿元人民币B+轮融资，由复星锐正、同创伟业和顺禧基金等机构联合投资。公司披露的数据显示， ...

OpenAI Sora 2全新功能上线，Pro用户生成视频长达 25 秒

OpenAI Sora 2全新功能上线，Pro用户生成视频长达 25 秒

　在最近的一次更新中，OpenAI 宣布了其视频生成平台 Sora2的新功能，吸引了众多用户的关注。此次更新主要包括两个重要的变化:首先，故事板功能现已在网页版本 ...

抖音与LV-NUS联合推出SAIL-VL2模型：小巧身材也能大显神威！

抖音与LV-NUS联合推出SAIL-VL2模型：小巧身材也能大显神威！

　在科技的浪潮中，抖音 SAIL 团队与 LV-NUS Lab 强强联手，推出了一款名为 SAIL-VL2的多模态大模型。这个新模型在保持较小参数规模的同时，竟然 ...

ChatGPT新功能，抢占你早上第一个打开的App

ChatGPT新功能，抢占你早上第一个打开的App

　ChatGPT新功能闪亮登场！ChatGPT Pulse（随时随地脉动回来）。号称无需提问就可以在你睡觉时带来个性化更新，并在每天早上为你送上一份精心整理的卡片 ...

AI智能对话

智能聊天对话，AI秒回答
AI模型创作

它无所不知，无所不能
AI绘画

只需一句话，生成精美画作
轻创AI咨询热线

13826579603

行业解决方案 AI论文生成网站地图 AI创作网 AI资讯 AI智能对话系统 AI创业之家 AI论文写作 AI智能知识库

©2023专业AI智能生成工具支持私有化支持定制

地址：深圳市龙华区民治牛栏前大厦微信:398879136 网站备案号：粤ICP备08036815号-3Copyright © 2024 深圳市星远创业科技有限公司版权所有