AI音乐视频生成器,将歌曲与创意转化为可编辑分镜和电影感MV,或让照片歌唱。
MVFlow是一个AI驱动的音乐视频创作平台,专注于将音乐与视觉内容深度融合。它提供两种核心创作模式:一是“音乐视频”模式,用户上传音乐并描述视觉方向,AI会生成可编辑的故事板,然后逐镜头生成并组合成完整的MV;二是“AI演唱视频”模式,用户只需上传一张角色照片和一段人声音频,AI即可让照片中的角色开口唱歌。此外,平台还集成了AI音乐生成、图像生成与编辑、嘴型同步(Lip Sync)等功能,支持用户从零开始创作音乐和视觉素材。MVFlow采用积分制收费,注册后可免费试用,适合音乐人、内容创作者和广告从业者使用。其核心优势在于将复杂的视频制作流程简化为“音乐→故事板→成片”的高效工作流,降低了音乐视频制作的门槛。
免费AI图片编辑器,一键修改照片。AI修图工具支持换背景、去除物体、改变风格。
ImagesArt AI图片编辑器是一款基于先进机器学习模型的免费在线AI修图工具。它能够同时分析上传的照片和用户用自然语言描述的修改指令,自动判断需要调整的像素区域,从而完成换背景、替换物体、转换画风等复杂编辑操作。与传统Photoshop等软件相比,它无需任何技术基础,只需像向设计师描述需求一样写出想法即可生成专业级效果。该工具支持复合指令,能理解场景与物体,并自动处理光线和细节融合,让修改后的图片自然无痕。产品定位为大众化的AI创意工具,免费账号注册即送12个积分,可用于体验所有核心功能;付费计划则提供更多积分、高速处理和去水印等高级服务,适合从个人用户到商业团队的广泛需求。
免费在线音频工具,可编辑、转换、压缩、裁剪、合并、测试和分析声音。
MyAudioTools 是一个基于浏览器的免费在线音频工具箱,汇集 48 个面向日常任务的音频工具。它无需注册账号或安装桌面软件,所有处理尽量在浏览器中完成,降低使用门槛并提升工作流效率。平台覆盖音频编辑、格式转换、压缩、标准化、音量提升、母带处理、铃声制作、循环、元数据编辑、视频转音频、音频转 MIDI、均衡、混响、低音增强、夜核、变调、变速、倒放、8D/双耳/空间音频、语音合成与转换、文本转语音、音频转文本、音板、鼓机、节拍器、音调发生器、可视化、歌曲分析、BPM/调性/和弦/LUFS、乐器调音、设备测试等场景。其重要性在于把零散、昂贵的音频处理流程集中到轻量网页中,适合快速完成转换、剪辑、分析和导出,价格免费,定位为创作者、音乐人、播客、学生和普通用户的一站式在线音频工具集合。
上传两张照片,生成橙色展台双人说唱短视频。
Hotel Lobby AI 是一款在线人工智能视频生成工具,用于复刻 2022 年两位说唱歌手在色彩秀节目《酒店大堂》中的橙色演播室双人表演。用户只需上传两张独立照片,系统就会把人物、宠物或角色放入标志性的橙色展台、单吊麦克风和固定双人构图中,自动生成一人说唱、另一人反应并交换段落的垂直短视频。它无需提示词、无需剪辑时间线,适合快速跟进社交平台热点。该产品起源于 2026 年 9 月短视频平台上两只猫的人工智能改编视频,随后原表演者转发原版表演,使格式迅速爆红。产品定位为付费趋势模板工具,生成前显示价格,页面显示每视频 310 积分,并提供限时五折订阅。它是独立工具,不隶属于原艺术家或色彩秀节目。
用自然语言描述视频,Treza 自动组装 AI 模型管道,定时或通过 API 发布。
Treza 是 Treza Labs 推出的生成式媒体节点编辑器,将 AI 视频、图像、语言、语音与音频模型组合为可视化管道。用户可以用自然语言描述“发布什么、何时发布”,平台自动从 Veo 3.1、Seedance 2.5、Gemini Image 及任意开放模型中挑选并组装生成流程。产品内置时间线剪辑、AI 助理调整、自动字幕/配音/配乐、视觉质量检查、失败重试与模型回退,并可定时运行或通过统一 API 调用。Treza 采用预付费点数计费,无订阅绑定,典型单次 AI 视频生成成本约 1.06 美元,定位面向内容创作者、营销团队和开发者,强调可投入生产的自动化视频工作流。
一站式AI平台,提供共享上下文的专业AI产品,自动化工作流,实现业务成果。
Converge.AI 是一个面向整个企业的 AI 原生套件,将多种专用 AI 产品整合在同一平台中,并让这些产品跨团队共享上下文。它不仅生成文字、图片或视频等中间输出,而是通过自动化工作流将输出转化为真实业务结果:营销部门可获得完整可发布的视频和品牌素材,研发团队可从想法直接获得生产级应用。平台包含 Enter Pro(智能编码代理)和 Framia Pro(创意与营销工作室)等智能体,支持自然语言操作、可视化编辑、全栈部署和资产复用。其重要性在于帮助企业无需增加招聘即可放大团队执行力,并平滑迁移到 AI 原生工作方式。产品已覆盖全球 200K 创作者和 110 个国家/地区,提供免费试用,并持续推出新智能体。
在线生成与编辑图片,支持精准文字、多参考图、区域编辑和透明PNG。
Qwen Image 2.1 是一款在线 AI 图像生成与编辑工具,面向需要快速产出高质量图片并保持文字、人物或产品一致性的用户。它支持在图像中生成准确的中英文文字,适合海报、广告、封面和社交媒体图片;支持最多十张参考图片,用于人物、角色或产品的跨场景一致性;支持蒙版区域编辑,只重绘用户涂抹或圈选的局部,保留其余画面;还支持透明背景导出 PNG/WebP,便于产品抠图、贴纸和设计文件。页面提供生成器、示例、使用说明和定价入口,说明有付费计划,但当前抓取文本未披露具体价格与免费试用政策。
通过一个API调用多种AI模型,享受最高90%折扣,自动路由和退款保障。
APIKO是一个统一的AI API聚合平台,旨在简化开发者对多种人工智能模型的访问。它提供文本、图像、视频和音频生成模型的一站式接口,通过OpenAI兼容的端点,开发者可以使用同一个API密钥调用来自OpenAI、Anthropic、Google、DeepSeek等主流提供商的模型。平台的核心优势在于实时价格对比和自动折扣,通常可节省高达90%的成本。APIKO采用自动路由和故障转移机制,确保高可用性,并且仅对成功的请求计费,失败请求自动退款。此外,它还提供详细的定价透明度,包括输入/输出每百万令牌的价格以及缓存价格,帮助用户精准控制成本。该平台特别适合需要多模型集成、成本敏感或追求高可靠性的开发团队。
AI视频聊天与角色扮演平台,可自选或创建AI角色,进行实时语音视频互动。
Prelulu是一款AI视频聊天与角色扮演平台,允许用户选择或创建AI角色,并通过实时视频进行面对面的互动。平台融合了AI对话、语音合成和虚拟形象技术,为用户提供沉浸式的角色扮演体验。其角色库丰富,涵盖黑帮、总裁、狼人、奇幻等多种类型,支持性别和风格筛选,并能根据用户偏好进行个性化回应。Prelulu不仅满足娱乐和情感陪伴需求,也为创作者提供了展示和分享虚拟角色的空间。产品以网站形式提供服务,用户无需下载客户端即可访问,目前采用付费套餐模式,具体价格需在平台内查看。
终极多模态AI视频生成与创意工作室,将文本和图片自然对话生成电影级视频。
Gemini Omni 是一个基于下一代多模态AI模型的在线视频生成与创意平台,定位为“AI视频生成器 + 创意工作室”。它以自然对话为核心交互,用户输入文字提示或上传参考图片,即可生成电影级质感、符合真实世界物理规律的视频。新一代Gemini Omni 1.1 Flash模型支持10秒深度上下文、40秒连续场景扩展、360p快速草图、起始/结束关键帧控制,并可融合多图/多模态参考。其重要性在于用对话式交互替代传统剪辑和动画制作流程,让不具备专业技能的用户也能快速完成分镜设计、视频生成和迭代修改;同时集成DeepMind Veo、VBench等前沿技术路线,保证了视频的物理真实感与镜头一致性。新用户注册即送30积分,无需信用卡即可体验;付费套餐提供高清无水印导出和完整商用授权,并内置不可见SynthID数字水印。产品面向创作者、品牌、影视与广告行业,是连接创意构思与成片的低成本高效率解决方案。
在线复古美学照片编辑器,提供数码相机与胶片效果,可微调光影色彩。
OldRoll是一款免费的在线美学照片编辑器,专注于复古风格的摄影效果。它通过模拟CCD传感器、一次性相机、胶片颗粒、VHS纹理等特性,帮助用户快速获得带有年代感的照片。产品强调在浏览器中即可完成全部编辑,无需安装客户端,同时提供精细的调节工具,如曝光、对比度、饱和度、镜头模糊等。OldRoll拥有庞大的用户基础,全球下载量超过5000万,应用商店评分较高,其网页版延续了移动端的核心体验。基础功能免费,并提供可选的高级付费功能。定位为满足内容创作者、摄影爱好者及普通用户对复古美学编辑需求的一站式工具。
免费人工智能照片编辑器,无需注册,用文本提示轻松编辑背景、物体、服装和光线。
Photo Editor AI 是一款基于生成式人工智能的在线照片编辑工具,用户无需安装复杂软件,也无需注册即可通过自然语言提示完成图片到图片的智能编辑。它可处理背景替换、对象移除、服装替换、颜色与光线调整、材质优化,并支持上传参考图来融合色彩、材质、服装和视觉风格。其重要价值在于降低专业修图门槛,让电商、营销、社交媒体和个人创作者快速制作高质量、无水印、可下载的成片;同时强调隐私保护、保持人物面部与构图自然。产品定位为免费在线人工智能照片编辑器,提供免费额度试用,适合先体验再决定是否继续使用更多服务。
AI语音代理与声音克隆平台,可连接Slack、Zapier等工具自动化通话与跟进。
HeyRik 是一个面向企业与开发者的 AI 语音代理与声音克隆平台,将实时对话式 AI、文本转语音、语音克隆和电话系统集成到同一个工作流中。用户无需编写代码,即可通过可视化对话流构建器创建能接听、拨打、预约、提醒和客户服务的语音代理。平台内置 600 多种自然语音和 30 多种语言,特别支持印度多个地区语言,适合从本地商家到全国性企业的各种场景。产品定位为 ElevenLabs、Vapi、Retell AI 的替代方案,既提供接近真实的语音合成和克隆能力,也包含完整的 AI 呼叫中心、AI 前台、智能 IVR 和外呼功能。定价以订阅或按用量计费,官网提供免费试用入口,最终费用取决于所选套餐与用量。
外语视频听中文配音的Chrome扩展,一键翻译配音。
FeedDub 是一款专为外语视频观看者设计的 Chrome 扩展,支持在 YouTube、Netflix、哔哩哔哩、TED、Coursera 等主流视频平台上一键开启中文配音。它基于先进的语音识别和机器翻译技术,自动将视频原声压低,同时以逐句对齐的时间点将翻译后的中文配音播放出来,让用户无需紧盯字幕即可专注画面内容。该产品采用低延迟的预生成机制,提前准备后续句子的配音,减少等待时间;同时支持拖拽进度条后自动重新对齐配音,确保画面与声音高度同步。FeedDub 提供 20 种目标语言,每种语言包含男女两个音色,用户可随时切换。产品本身免费,但提供每日 2 条新视频的免费配额,登录后赠送三天不限量使用,之后可订阅 2 美元/月获得无限制服务。其定位是降低观看外语视频的语言门槛,提升沉浸式观看体验,尤其适合学习、娱乐和知识获取场景。
免费无注册的 MiniMax H3 视频生成代理,可用文字或首尾帧图片生成短片。
Free MiniMax H3 Video Generation Agent 是 VideoWeb AI 提供的免费在线人工智能视频生成代理,主要面向营销人员、创作者和短视频制作者。它基于 MiniMax H3 模型,让用户无需注册即可通过文本镜头简报或两张端点图片生成短片段,并可选择 16:9、9:16、1:1 画幅。当前免费表单输出为 480p、5 秒,页面宣称 100% 免费、无需注册、可无限生成,适合快速验证创意、制作社媒素材和前期分镜;更高分辨率、更长时长、多模型对比和应用程序接口集成则引导至高级工具和付费工作流。
Vibit 是 AI 广告生成器,几分钟把脚本变成高转化短视频广告。
Vibit 是一款面向营销人员、创始人和创作者的 AI 视频广告生成器。它将一句话需求或脚本转化为 30–60 秒高转化短视频广告:先由 AI 研究代理分析受众、购买时机、竞品和广告心理,再生成脚本、分镜与场景图像,最后用谷歌 Gemini 与 Veo 渲染电影级视频。核心优势是故事板驱动和参考图角色/产品一致性,能保持品牌视觉统一并适配 TikTok、Instagram Reels、YouTube Shorts、Meta 等渠道。定位为从脚本到成片的端到端广告制作工具,减少拍摄、剪辑和外包成本。价格提供免费计划(50 积分),付费计划从 7 美元/月起:入门版 150 积分,创作者版 500 积分并支持 4K,专业版 1500 积分并支持优先渲染;付费计划包含商业使用权。
AI 将直播流自动剪辑成高质量病毒短视频,并一键发布到各社交平台。
ClipMe 是一款面向直播创作者的 AI 视频剪辑与分发工具,主要支持将 Kick、Twitch 和 YouTube 的直播内容自动转化为高质量、适合病毒传播的短视频。它通过 AI 识别高光片段并生成 50–100 条切片,帮助主播减少手动剪辑时间,同时一键发布到 TikTok、Reels、Shorts 等社交平台,从而提升内容产出频率和账号增长。页面显示其可免费开始、无需信用卡,免费方案每月可处理 1 场直播,定位为帮助主播更快创作和增长的生产力工具。价格信息:提供免费使用入口。
AI驱动的PDF转换工具,可将文档一键转为视频、翻页书、演示文稿等多种格式。
Recastia是一个基于AI的在线内容转化平台,由创新团队开发,旨在解决静态文档难以传播和吸引观众的问题。它利用自然语言处理、语音合成、计算机视觉等技术,将PDF等文件自动转换为视频、交互式翻页书、演示文稿、响应式落地页、AI聊天机器人、3D虚拟展览、播客等多种格式,用户无需任何设计或编程技能。该产品的主要优点包括:节省时间(几秒生成初稿)、保持品牌一致性、支持多语言翻译、支持自定义域名和嵌入,适合营销、教育、出版等领域。定价方面,提供免费套餐(含基础功能和水印),付费版解锁高清导出、无限项目等高级功能,具体价格需参考官网Pricing页面。
© 2026 AIbase 备案号:闽ICP备08105208号-14