浏览量:377
最新流量情况
月访问量
4.92m
平均访问时长
00:06:33
每次访问页数
6.11
跳出率
36.20%
流量来源
直接访问
51.61%
自然搜索
33.46%
邮件
0.04%
外链引荐
12.58%
社交媒体
2.19%
展示广告
0
截止目前所有流量趋势图
地理流量分布情况
中国
13.25%
德国
3.63%
印度
9.32%
俄罗斯
4.28%
美国
19.34%
MovieLLM是一个用于增强长视频理解的AI生成电影框架
MovieLLM由复旦大学和腾讯PCG提出,是一个创新框架,旨在为长视频创建合成的、高质量的数据。该框架利用GPT-4和文本到图像模型的力量,生成详细的脚本和相应的视觉内容。
强大的AI平台,提供AI图像生成器、文本生成器和视频生成器,无需注册即可在线使用。
Perchance AI是一个多功能的AI创作平台,专注于图像、文本和视频的生成。它支持多种艺术风格和生成模型,能够快速将用户的创意文本转化为高质量的视觉作品。该平台无需注册即可使用,适合艺术家、设计师、内容创作者和企业用户,帮助他们高效地实现创意和提升工作效率。平台提供免费版本,同时也有付费升级选项,满足不同用户的需求。
通过网络摄像头将VTuber虚拟形象变为现实,提升直播体验。
VTuber Maker是一款面向虚拟主播(VTuber)的桌面软件,能够通过摄像头捕捉用户表情和动作,实时驱动虚拟形象进行直播或视频创作。它利用先进的面部追踪和动作捕捉技术,为用户提供稳定、高精度的虚拟形象驱动体验。该产品支持多种虚拟形象格式,包括VRM模型,并提供丰富的背景和道具资源,帮助用户快速创建个性化内容。VTuber Maker不仅适合个人创作者,也适用于商业直播场景,其订阅模式提供了免费和付费版本,满足不同用户需求。
Genime AI 是一款专注于动画生成与编辑的工具,提供图像到 3D、补间动画等功能。
Genime AI 是一个面向动画创作者的工具平台,通过先进的 AI 技术,为用户提供图像到 3D 模型转换、补间动画生成等功能。其主要优点是能够帮助用户快速生成高质量的动画内容,降低动画制作门槛,提高创作效率。该产品适合动画设计师、视频创作者以及相关领域的专业人士,尤其适合那些希望借助 AI 技术提升创作能力的用户。目前产品处于发展阶段,具体价格和定位尚未明确。
8B参数变分自编码器模型,用于高效的文本到图像生成。
Flux.1 Lite是一个由Freepik发布的8B参数的文本到图像生成模型,它是从FLUX.1-dev模型中提取出来的。这个版本相较于原始模型减少了7GB的RAM使用,并提高了23%的运行速度,同时保持了与原始模型相同的精度(bfloat16)。该模型的发布旨在使高质量的AI模型更加易于获取,特别是对于消费级GPU用户。
高效的人像动画生成工具
LivePortrait是一个基于隐式关键点框架的人像动画生成模型,它通过使用单一源图像作为外观参考,并从驱动视频、音频、文本或生成中获取动作(如面部表情和头部姿势),来合成逼真的视频。该模型不仅在计算效率和可控性之间取得了有效平衡,而且通过扩展训练数据、采用混合图像-视频训练策略、升级网络架构以及设计更好的运动转换和优化目标,显著提高了生成质量和泛化能力。
一款专注于提升AI生成肖像照片真实感的模型。
AWPortrait是一款专注于AI生成肖像照片的模型,致力于通过技术提升照片的真实感。它通过不断优化训练,使得生成的人物肖像更加逼真,加入了东方元素,如旗袍和汉服,增强了室内外效果,优化了面部特写的变形问题,并允许调整人物年龄。AWPortrait适用于个人和商业用途,但需遵守相应的使用协议。
基于生成式头像的AI创作平台
DigenAI是一家应用型AI研究公司,致力于革新视频创作方式。它为全球用户提供将想象转化为现实的入口。DigenAI提供基于生成式头像的视频创作功能,简化创作流程并生成出色视频作品。目前正处于公测阶段,欢迎用户加入体验。
一款基于WebGL的设计工具,用于给图片或视频添加效果
Unicorn Studio是一款基于WebGL的设计工具,它允许用户为图片和视频添加各种炫酷效果,以提升网页体验和视觉资产。该工具提供33种强大的效果,支持自由组合和叠加,创造出独特的、可交互的效果,并可直接集成到网站中。
AI Studios是一个人工智能创作平台
AI Studios提供了一个用户友好的仪表板,让用户可以轻松创建和管理AI项目。该平台可能包含多种AI工具和功能,以支持用户在图像、视频、音频等领域的创作和编辑。
上传您的面部照片,通过电子邮件在5分钟内收到AI生成的维京人照片
VikingPic是一个在线服务,允许用户上传他们的面部照片,并通过AI生成成为维京人的照片。它提供8张在5分钟内生成并发送到您的电子邮件中的维京人照片,价格为$2.99。该服务保证上传的照片仅用于图像生成过程,并在此后删除。VikingPic适用于喜欢维京文化的个人、用于给朋友和家人送礼以及用于社交媒体内容创作。
Artisto提供多种艺术滤镜和视频特效
Artisto是一个免费的视频编辑应用,为用户提供丰富的艺术滤镜和特效,可以将普通视频转化为具有独特艺术风格的视频作品。该应用通过人工智能技术,可以检测视频人脸并识别场景,自动添加各类滤镜效果,无需用户手动操作。Artisto可用于处理自拍、图片、视频剪辑、动画等,功能强大而易于上手。
光学语言模型 - 重新构思、理解和生成多媒体的光学语言模型
Olm是一种基于光学语言模型的产品,可以帮助用户在几分钟内从头开始生成全新的视频。它能够创建、重新构思和理解多媒体,并生成与用户要求相符的内容。Olm具有以下主要功能:1. 生成全新的视频内容;2. 重新构思现有的视频内容;3. 理解和分析多媒体。Olm适用于各种场景,包括创作、教育、娱乐等领域。具体定价信息请访问官方网站。
AI Stash是一个汇集各类AI工具的综合目录网站
AI Stash是一个汇集各类AI工具的综合目录网站,用户可以在平台上发现最优秀的AI软件。网站分类清晰,包含35+类别,1000+工具,每周测试500+ AI软件,为用户省去验证工具质量的麻烦。用户可以按类别、功能、价格等筛选,快速找到适合自己的AI工具。
快速生成高质量的概念设计
Generative Fill是一款功能强大的图像处理软件,其中包括Generative Fill功能,可通过简单的文本提示快速创建、添加、删除或替换图像,由Adobe Firefly生成AI提供支持。
AI生成名人视频
SendFame是一款使用AI生成名人视频的平台。用户可以选择自己喜欢的名人,并描述想要传达的内容,AI将生成脚本、声音和视频。该平台适用于制作个人祝福或留言视频,不可用于商业用途,仅限进行戏仿使用。
Pixlr:免费在线照片编辑器、AI图像生成器和设计工具
Pixlr是一个免费的在线照片编辑器和设计工具,提供AI图像生成器、批量编辑、动画设计、增强等功能。它可以帮助用户进行照片编辑、设计创作,并支持多种图像处理操作。Pixlr提供免费和付费版本,付费版本还提供更多高级功能和资源。
使用 AI 技术无缝合并图像,轻松生成创意艺术。
AI 图像融合工具利用先进的 AI 技术,能够快速无缝地合并多张图片,生成高质量的视觉效果。该工具适合数字艺术家、营销人员和摄影师等专业人士使用。定价方面,提供多个套餐,包括免费和付费版本,以满足不同用户的需求。
高效的视觉编码技术,提升视觉语言模型性能。
FastVLM 是一种高效的视觉编码模型,专为视觉语言模型设计。它通过创新的 FastViTHD 混合视觉编码器,减少了高分辨率图像的编码时间和输出的 token 数量,使得模型在速度和精度上表现出色。FastVLM 的主要定位是为开发者提供强大的视觉语言处理能力,适用于各种应用场景,尤其在需要快速响应的移动设备上表现优异。
在Mac上两次点击,无需降低分辨率即可压缩图像大小。
Compress Image是一款用于Mac的桌面客户端,可以在不损失分辨率的情况下,通过两次点击轻松压缩任意数量的图像文件。该产品的主要优点是快速、简便、无需上传至服务器,可减小文件大小高达90%。价格为一次性支付3.99美元,定位于图像处理工具。
快速简便的图片格式转换工具。
imgKonvert是一个快速简便的图片格式转换工具,支持多种常见格式的转换,如PNG、JPG、WebP等。通过在浏览器中进行转换,保证数据安全性和隐私,无需注册即可使用。
使用文本描述您的想法,我们的高级AI将将您的文本提示转换为引人注目的图像。让文字变成图像,轻松实现!
ImagineArt AI工具是一款人工智能艺术生成工具,利用先进的AI技术,可以将文字描述转化为生动的图像作品。其主要优点包括快速生成图像、灵活性高、用户友好,定位于为用户提供创意灵感和图像生成解决方案。
AI图像处理技术,为您的图片增添纹理,实时创建惊艳的视觉变换。
RetextureAI利用AI技术实现图像处理,能够快速为图片增添纹理,实现视觉上的瞬间变换。其主要优点在于提供先进的纹理生成功能,让用户轻松实现图片的艺术化处理。
通过AI创建和共享图像的平台。
Photogen by AI是一个通过AI快速生成高质量照片的平台,用户可上传自拍照片并使用AI模型转化为专业级肖像。价格分为Hobby、Pro和Enterprise三个档次。
InstantCharacter 是一种基于扩散变换器的角色个性化框架。
InstantCharacter 是一个基于扩散变换器的角色个性化框架,旨在克服现有学习基础自定义方法的局限性。该框架的主要优点在于开放域个性化、高保真结果以及有效的角色特征处理能力,适合各种角色外观、姿势和风格的生成。该框架利用一个包含千万级样本的大规模数据集进行训练,以实现角色一致性和文本可编辑性的同时优化。该技术为角色驱动的图像生成设定了新的基准。
InternVL3开源:7种尺寸覆盖文、图、视频处理,多模态能力扩展至工业图像分析
InternVL3是由OpenGVLab开源发布的多模态大型语言模型(MLLM),具备卓越的多模态感知和推理能力。该模型系列包含从1B到78B共7个尺寸,能够同时处理文字、图片、视频等多种信息,展现出卓越的整体性能。InternVL3在工业图像分析、3D视觉感知等领域表现出色,其整体文本性能甚至优于Qwen2.5系列。该模型的开源为多模态应用开发提供了强大的支持,有助于推动多模态技术在更多领域的应用。
© 2025 AIbase 备案号:闽ICP备08105208号-14