CogVLM

CogVLM是一个强大的开源视觉语言模型。CogVLM-17B拥有100亿个视觉参数和70亿个语言参数。CogVLM-17B在10个经典的跨模态基准测试中取得了最先进的性能,包括NoCaps、Flicker30k字幕、RefCOCO、RefCOCO+、RefCOCOg、Visual7W、GQA、ScienceQA、VizWiz VQA和TDIUC,并在VQAv2、OKVQA、TextVQA、COCO字幕等方面排名第二,超过或与PaLI-X 55B相匹配。CogVLM还可以与您就图像进行对话。

需求人群:

"用于图像描述、问题回答和视觉定位"

使用场景示例:

使用CogVLM准确描述图像细节

使用CogVLM回答各种类型的问题

使用CogVLM进行视觉定位

产品特色:

准确描述图像细节

回答各种类型的问题

视觉定位

浏览量:142

s1785318098921236

打开站点

构建AI去赚钱
s1785341518918206
网站流量情况

最新流量情况

月访问量

4.58m

平均访问时长

00:07:29

每次访问页数

6.65

跳出率

37.90%

流量来源

直接访问

51.57%

自然搜索

29.65%

邮件

0.89%

外链引荐

11.44%

社交媒体

6.43%

展示广告

0

截止目前所有流量趋势图

地理流量分布情况

美国

16.83%

中国

14.47%

印度

9.23%

日本

3.69%

德国

3.38%

类似产品

© 2024     AIbase    备案号:闽ICP备2023012347号-1

隐私政策

用户协议

意见反馈 网站地图