AI音乐视频生成器,将歌曲与创意转化为可编辑分镜和电影感MV,或让照片歌唱。
MVFlow是一个AI驱动的音乐视频创作平台,专注于将音乐与视觉内容深度融合。它提供两种核心创作模式:一是“音乐视频”模式,用户上传音乐并描述视觉方向,AI会生成可编辑的故事板,然后逐镜头生成并组合成完整的MV;二是“AI演唱视频”模式,用户只需上传一张角色照片和一段人声音频,AI即可让照片中的角色开口唱歌。此外,平台还集成了AI音乐生成、图像生成与编辑、嘴型同步(Lip Sync)等功能,支持用户从零开始创作音乐和视觉素材。MVFlow采用积分制收费,注册后可免费试用,适合音乐人、内容创作者和广告从业者使用。其核心优势在于将复杂的视频制作流程简化为“音乐→故事板→成片”的高效工作流,降低了音乐视频制作的门槛。
上传两张照片,生成橙色展台双人说唱短视频。
Hotel Lobby AI 是一款在线人工智能视频生成工具,用于复刻 2022 年两位说唱歌手在色彩秀节目《酒店大堂》中的橙色演播室双人表演。用户只需上传两张独立照片,系统就会把人物、宠物或角色放入标志性的橙色展台、单吊麦克风和固定双人构图中,自动生成一人说唱、另一人反应并交换段落的垂直短视频。它无需提示词、无需剪辑时间线,适合快速跟进社交平台热点。该产品起源于 2026 年 9 月短视频平台上两只猫的人工智能改编视频,随后原表演者转发原版表演,使格式迅速爆红。产品定位为付费趋势模板工具,生成前显示价格,页面显示每视频 310 积分,并提供限时五折订阅。它是独立工具,不隶属于原艺术家或色彩秀节目。
用自然语言描述视频,Treza 自动组装 AI 模型管道,定时或通过 API 发布。
Treza 是 Treza Labs 推出的生成式媒体节点编辑器,将 AI 视频、图像、语言、语音与音频模型组合为可视化管道。用户可以用自然语言描述“发布什么、何时发布”,平台自动从 Veo 3.1、Seedance 2.5、Gemini Image 及任意开放模型中挑选并组装生成流程。产品内置时间线剪辑、AI 助理调整、自动字幕/配音/配乐、视觉质量检查、失败重试与模型回退,并可定时运行或通过统一 API 调用。Treza 采用预付费点数计费,无订阅绑定,典型单次 AI 视频生成成本约 1.06 美元,定位面向内容创作者、营销团队和开发者,强调可投入生产的自动化视频工作流。
一站式AI平台,提供共享上下文的专业AI产品,自动化工作流,实现业务成果。
Converge.AI 是一个面向整个企业的 AI 原生套件,将多种专用 AI 产品整合在同一平台中,并让这些产品跨团队共享上下文。它不仅生成文字、图片或视频等中间输出,而是通过自动化工作流将输出转化为真实业务结果:营销部门可获得完整可发布的视频和品牌素材,研发团队可从想法直接获得生产级应用。平台包含 Enter Pro(智能编码代理)和 Framia Pro(创意与营销工作室)等智能体,支持自然语言操作、可视化编辑、全栈部署和资产复用。其重要性在于帮助企业无需增加招聘即可放大团队执行力,并平滑迁移到 AI 原生工作方式。产品已覆盖全球 200K 创作者和 110 个国家/地区,提供免费试用,并持续推出新智能体。
通过一个API调用多种AI模型,享受最高90%折扣,自动路由和退款保障。
APIKO是一个统一的AI API聚合平台,旨在简化开发者对多种人工智能模型的访问。它提供文本、图像、视频和音频生成模型的一站式接口,通过OpenAI兼容的端点,开发者可以使用同一个API密钥调用来自OpenAI、Anthropic、Google、DeepSeek等主流提供商的模型。平台的核心优势在于实时价格对比和自动折扣,通常可节省高达90%的成本。APIKO采用自动路由和故障转移机制,确保高可用性,并且仅对成功的请求计费,失败请求自动退款。此外,它还提供详细的定价透明度,包括输入/输出每百万令牌的价格以及缓存价格,帮助用户精准控制成本。该平台特别适合需要多模型集成、成本敏感或追求高可靠性的开发团队。
AI视频聊天与角色扮演平台,可自选或创建AI角色,进行实时语音视频互动。
Prelulu是一款AI视频聊天与角色扮演平台,允许用户选择或创建AI角色,并通过实时视频进行面对面的互动。平台融合了AI对话、语音合成和虚拟形象技术,为用户提供沉浸式的角色扮演体验。其角色库丰富,涵盖黑帮、总裁、狼人、奇幻等多种类型,支持性别和风格筛选,并能根据用户偏好进行个性化回应。Prelulu不仅满足娱乐和情感陪伴需求,也为创作者提供了展示和分享虚拟角色的空间。产品以网站形式提供服务,用户无需下载客户端即可访问,目前采用付费套餐模式,具体价格需在平台内查看。
终极多模态AI视频生成与创意工作室,将文本和图片自然对话生成电影级视频。
Gemini Omni 是一个基于下一代多模态AI模型的在线视频生成与创意平台,定位为“AI视频生成器 + 创意工作室”。它以自然对话为核心交互,用户输入文字提示或上传参考图片,即可生成电影级质感、符合真实世界物理规律的视频。新一代Gemini Omni 1.1 Flash模型支持10秒深度上下文、40秒连续场景扩展、360p快速草图、起始/结束关键帧控制,并可融合多图/多模态参考。其重要性在于用对话式交互替代传统剪辑和动画制作流程,让不具备专业技能的用户也能快速完成分镜设计、视频生成和迭代修改;同时集成DeepMind Veo、VBench等前沿技术路线,保证了视频的物理真实感与镜头一致性。新用户注册即送30积分,无需信用卡即可体验;付费套餐提供高清无水印导出和完整商用授权,并内置不可见SynthID数字水印。产品面向创作者、品牌、影视与广告行业,是连接创意构思与成片的低成本高效率解决方案。
浏览器里的AI代理:用自然语言描述任务,自动在已登录网站上完成操作
Dassi 是由 Omnify Labs 开发的浏览器扩展型 AI 代理,运行在 Chrome、Edge 或 Brave 中。它允许用户用自然语言描述任务,在用户已登录的网站和账户中自动执行多步操作,无需复制上下文或搭建集成。用户可以先演示一次工作流程,Dassi 会学习并沉淀为可定时运行的自动化流程;它也支持在 Claude、GPT、Gemini 等模型间切换。Dassi 在单次运行内保持任务上下文缓存,可显著减少模型重复读取页面的开销,在 Claude 上最高可节省 90% 的输入 token 成本。产品定位是处理每周重复的核对、筛选、汇总类工作,让用户只处理异常。采用免费试用模式:注册即可获得 7 天免费额度,无需绑定信用卡。
外语视频听中文配音的Chrome扩展,一键翻译配音。
FeedDub 是一款专为外语视频观看者设计的 Chrome 扩展,支持在 YouTube、Netflix、哔哩哔哩、TED、Coursera 等主流视频平台上一键开启中文配音。它基于先进的语音识别和机器翻译技术,自动将视频原声压低,同时以逐句对齐的时间点将翻译后的中文配音播放出来,让用户无需紧盯字幕即可专注画面内容。该产品采用低延迟的预生成机制,提前准备后续句子的配音,减少等待时间;同时支持拖拽进度条后自动重新对齐配音,确保画面与声音高度同步。FeedDub 提供 20 种目标语言,每种语言包含男女两个音色,用户可随时切换。产品本身免费,但提供每日 2 条新视频的免费配额,登录后赠送三天不限量使用,之后可订阅 2 美元/月获得无限制服务。其定位是降低观看外语视频的语言门槛,提升沉浸式观看体验,尤其适合学习、娱乐和知识获取场景。
免费无注册的 MiniMax H3 视频生成代理,可用文字或首尾帧图片生成短片。
Free MiniMax H3 Video Generation Agent 是 VideoWeb AI 提供的免费在线人工智能视频生成代理,主要面向营销人员、创作者和短视频制作者。它基于 MiniMax H3 模型,让用户无需注册即可通过文本镜头简报或两张端点图片生成短片段,并可选择 16:9、9:16、1:1 画幅。当前免费表单输出为 480p、5 秒,页面宣称 100% 免费、无需注册、可无限生成,适合快速验证创意、制作社媒素材和前期分镜;更高分辨率、更长时长、多模型对比和应用程序接口集成则引导至高级工具和付费工作流。
Vibit 是 AI 广告生成器,几分钟把脚本变成高转化短视频广告。
Vibit 是一款面向营销人员、创始人和创作者的 AI 视频广告生成器。它将一句话需求或脚本转化为 30–60 秒高转化短视频广告:先由 AI 研究代理分析受众、购买时机、竞品和广告心理,再生成脚本、分镜与场景图像,最后用谷歌 Gemini 与 Veo 渲染电影级视频。核心优势是故事板驱动和参考图角色/产品一致性,能保持品牌视觉统一并适配 TikTok、Instagram Reels、YouTube Shorts、Meta 等渠道。定位为从脚本到成片的端到端广告制作工具,减少拍摄、剪辑和外包成本。价格提供免费计划(50 积分),付费计划从 7 美元/月起:入门版 150 积分,创作者版 500 积分并支持 4K,专业版 1500 积分并支持优先渲染;付费计划包含商业使用权。
AI 将直播流自动剪辑成高质量病毒短视频,并一键发布到各社交平台。
ClipMe 是一款面向直播创作者的 AI 视频剪辑与分发工具,主要支持将 Kick、Twitch 和 YouTube 的直播内容自动转化为高质量、适合病毒传播的短视频。它通过 AI 识别高光片段并生成 50–100 条切片,帮助主播减少手动剪辑时间,同时一键发布到 TikTok、Reels、Shorts 等社交平台,从而提升内容产出频率和账号增长。页面显示其可免费开始、无需信用卡,免费方案每月可处理 1 场直播,定位为帮助主播更快创作和增长的生产力工具。价格信息:提供免费使用入口。
AI驱动的PDF转换工具,可将文档一键转为视频、翻页书、演示文稿等多种格式。
Recastia是一个基于AI的在线内容转化平台,由创新团队开发,旨在解决静态文档难以传播和吸引观众的问题。它利用自然语言处理、语音合成、计算机视觉等技术,将PDF等文件自动转换为视频、交互式翻页书、演示文稿、响应式落地页、AI聊天机器人、3D虚拟展览、播客等多种格式,用户无需任何设计或编程技能。该产品的主要优点包括:节省时间(几秒生成初稿)、保持品牌一致性、支持多语言翻译、支持自定义域名和嵌入,适合营销、教育、出版等领域。定价方面,提供免费套餐(含基础功能和水印),付费版解锁高清导出、无限项目等高级功能,具体价格需参考官网Pricing页面。
从文本或照片快速生成3-30秒AI视频,多模型共用积分。
VidKiss 是一款在线 AI 视频制作工具,主打用一句话提示词或一张参考图生成 3 到 30 秒的视频。它整合多种视频模型,用户无需在多个平台间切换,用一个积分余额即可调用文本生视频、图生视频等能力,并支持 720p 与 1080p、多种画幅比例和时长设置。产品定位为轻量、快速、面向创作者的 AI 视频生成工作台,适合社交媒体、广告、故事分镜和电商展示等场景。价格采用积分包付费制,最低约 4.98 美元起,积分永不过期,降低一次性订阅压力。
使用领先AI视频模型,从文本或图像创建电影级视频,注册享3天100积分
AiVideoFlux是一个基于领先AI视频模型的在线平台,可将文本或图像转化为电影级视频。其重要性在于为用户提供了便捷、高效的视频创作方式,无需专业的视频制作技能。主要优点包括支持多种前沿模型、提供创作工作区、可对比不同模型效果等。产品背景是顺应AI技术在视频创作领域的发展趋势。新用户注册可获得100积分,有效期3天,无需信用卡,至于其他付费模式文中未详细提及。定位是为视频创作爱好者和专业人士提供服务的平台。
ZeroGPT免费AI检测器,可检测文本、图像和视频,有3次免费扫描。
ZeroGPT是一款用于文本、图像和视频的AI内容检测工具,主要功能是通过先进的AI技术区分真实和合成内容。其重要性在于帮助用户识别AI生成的信息,避免虚假内容的影响。主要优点包括针对英语的精确校准、采用概率性检测避免绝对论断、支持移动设备使用等。产品背景是为了应对AI内容大量出现所带来的真实性验证需求。用户可免费进行3次扫描,无需注册,如需更多扫描次数可查看定价。定位是为学生、教师等提供专业的AI内容检测服务。
科大讯飞新一代全场景AI生产力工作台,输入目标即可交付多类型成果
AStudio是科大讯飞推出的新一代全场景AI生产力工作台。其核心功能是用户只需输入目标,AI就能深度理解意图,自主拆解规划并调用工具执行任务,透明可控地交付高质量文档、表格、网页与代码等。重要性在于极大提升工作效率,减少人工操作的繁琐。主要优点包括支持实时预览与协同迭代,操作安全可靠,权限范围可控等。它定位为满足各类企业和个人在不同工作场景下的智能化办公需求,价格方面未提及,可能有多种收费模式,如企业服务收费、私有化企业采购等。
© 2026 AIbase 备案号:闽ICP备08105208号-14