SALMONN

SALMONN

SALMONN是由清华大学电子工程系和字节跳动开发的大型语言模型(LLM),支持语音、音频事件和音乐输入。与仅支持语音或音频事件输入的模型不同,SALMONN可以感知和理解各种音频输入,从而获得多语言语音识别和翻译以及音频-语音共推理等新兴能力。这可以被视为给予LLM“听觉”和认知听觉能力,使SALMONN成为通向具有听觉能力的人工通用智能的一步。

需求人群:

"SALMONN可以应用于语音识别、语音翻译、音频处理等领域。"

使用场景示例:

输入:gunshots.wav,输出:...

输入:duck.wav,输出:...

输入:music.wav,输出:...

产品特色:

多语言语音识别

多语言语音翻译

音频-语音共推理

浏览量:151

s1785318098921236

打开站点

构建AI去赚钱
s1785341518918206
网站流量情况

最新流量情况

月访问量

4.38m

平均访问时长

00:07:17

每次访问页数

6.50

跳出率

38.34%

流量来源

直接访问

51.33%

自然搜索

30.08%

邮件

0.86%

外链引荐

11.05%

社交媒体

6.66%

展示广告

0

截止目前所有流量趋势图

地理流量分布情况

美国

15.94%

中国

15.11%

印度

9.28%

日本

3.94%

德国

3.35%

类似产品

© 2024     AIbase    备案号:闽ICP备08105208号-14

隐私政策

用户协议

意见反馈 网站地图