AI图像生成与编辑,支持真实感、主体一致、清晰文字与4K输出。
Nano Banana 2.1 是 Gemini 系列中的图像生成与对话式编辑模型,也是 Nano Banana 2 的升级版。它重点提升了视觉真实感、提示词遵循度、多轮主体一致性和文字渲染能力,可用于原创图片、照片编辑、产品概念、海报和信息图。模型支持多参考图融合、掩码引导编辑,以及 1K/2K/4K 和宽幅输出,同时延续 Flash 系列的快速迭代特性。其重要性在于让用户可以用自然语言完成高质量视觉产出,把创意简报快速转成可审核的素材,减少传统设计中反复沟通和手工修图的成本。网站采用免费积分加付费订阅的模式,新用户注册送 100 积分,每日可领免费积分,付费方案最高 50% 折扣。
一站式AI视频生成器,支持文本/图片转视频及热门病毒特效。
Flowlio AI 是一个集成了多种前沿 AI 模型的一体化在线视频生成平台。它允许用户通过文本描述、静态图片或参考视频素材,快速生成具有电影感的动态视频片段。平台整合了 Seedance、Wan、HappyHorse 等顶尖视频生成模型,以及 GPT Image、Midjourney、Flux 等图像生成模型,用户无需切换多个工具或管理复杂的 API 密钥,只需在一个界面内即可完成从创意到成片的完整流程。此外,Flowlio AI 还提供了一系列病毒式视频特效模板(如 Cheba Man、Ceiling Fan Transition、AI APT MV 等),用户上传一张照片或使用内置模板,即可自动生成分享级视频,极大降低了视频创作门槛。产品采用积分制计费,新用户注册时可免费领取约 80 积分,后续可选择按量付费或订阅年度计划(经常有折扣),生成的视频无任何水印,且存储于私密空间中,满足专业创作者和普通用户的需求。
免费AI图片编辑器,一键修改照片。AI修图工具支持换背景、去除物体、改变风格。
ImagesArt AI图片编辑器是一款基于先进机器学习模型的免费在线AI修图工具。它能够同时分析上传的照片和用户用自然语言描述的修改指令,自动判断需要调整的像素区域,从而完成换背景、替换物体、转换画风等复杂编辑操作。与传统Photoshop等软件相比,它无需任何技术基础,只需像向设计师描述需求一样写出想法即可生成专业级效果。该工具支持复合指令,能理解场景与物体,并自动处理光线和细节融合,让修改后的图片自然无痕。产品定位为大众化的AI创意工具,免费账号注册即送12个积分,可用于体验所有核心功能;付费计划则提供更多积分、高速处理和去水印等高级服务,适合从个人用户到商业团队的广泛需求。
在线生成与编辑图片,支持精准文字、多参考图、区域编辑和透明PNG。
Qwen Image 2.1 是一款在线 AI 图像生成与编辑工具,面向需要快速产出高质量图片并保持文字、人物或产品一致性的用户。它支持在图像中生成准确的中英文文字,适合海报、广告、封面和社交媒体图片;支持最多十张参考图片,用于人物、角色或产品的跨场景一致性;支持蒙版区域编辑,只重绘用户涂抹或圈选的局部,保留其余画面;还支持透明背景导出 PNG/WebP,便于产品抠图、贴纸和设计文件。页面提供生成器、示例、使用说明和定价入口,说明有付费计划,但当前抓取文本未披露具体价格与免费试用政策。
人工智能在线翻译漫画,支持50多种语言,保留原图排版与气泡。
该产品是一款面向漫画读者的在线人工智能翻译工具,专注于把单页或整章漫画从日语、韩语、中文等源语言翻译成目标语言。它结合漫画感知文字识别、上下文翻译与自然排版,将译文放回原气泡和文字区域,尽量保留人物、线稿、色彩、分镜与阅读顺序。产品支持50多种语言、章节压缩包上传、连续阅读、原文与译文对照、术语表与浏览器插件等能力,适合个人读者、汉化爱好者和本地化团队使用。产品可免费试用,并按积分或套餐付费。
网易叭哥说是桌面端AI语音输入工具,能语音转文字,比打字快5倍
网易叭哥说是一款桌面端AI语音输入工具。其重要性在于极大提升输入效率,为快节奏的创作者、开发者与职场精英等人群提供便利。产品主要优点众多,语音输入速度比打字快5倍,支持全局跨应用适配,可自动去除口头语、智能润色、分段排版,还具备语音翻译等功能。该产品背景是为满足人们在工作场景中更高效输入表达的需求。价格方面,完全免费下载使用。其定位精准,致力于成为用户在各类工作场景下的得力助手,解放双手,提升工作效率。
在线AI工具,几秒将PNG、JPG转成3D STL模型,无需设计经验和安装软件。
该产品是oakleaf3d推出的在线图片转STL工具,核心技术是利用AI算法分析PNG、JPG图片,重建出具有真实深度和细节的3D几何模型。其重要性在于降低了3D建模的门槛,让非专业人士也能轻松将图片转换为可3D打印的模型。主要优点包括无需设计经验、无需安装软件、转换速度快、支持多视角输入以提高精度,生成的模型干净、可直接用于3D打印。价格方面,提供免费试用,注册即送30积分,之后可按需购买积分包或订阅。定位是满足不同水平用户对图片转3D模型的需求,涵盖新手、创客、设计师等多种群体。
在线免费模糊图片,多种风格,无需上传和注册,本地处理
Blur Image Online是一款基于浏览器的免费图片模糊处理工具。其重要性在于为用户提供了便捷、高效且安全的图片模糊解决方案。主要优点包括无需下载安装、无需注册账号、支持多种模糊风格、可选择性涂抹、支持多种图片格式导出且图片全程不离开本地设备。该产品定位为满足用户快速、简单处理图片模糊需求的在线工具,适用于各类需要对图片进行模糊处理的场景,无论是个人用户在社交媒体分享图片,还是专业人士处理工作相关图片。价格方面,完全免费使用,无账号限制,无水印。
一站式AI创作平台,图像与视频模型统一接入,浏览器内全程创作
PikpikGo是一站式AI创作平台,聚合了主流图像与视频大模型,可按需切换且算力通用。无需安装软件,从一句话灵感开始,到出图、生视频、导出成品,全程在浏览器里完成。平台持续上新模型,支持多模态内容参考和编辑。其价格方案多样,有免费体验,也有年付、月付套餐,年付能享受一定优惠,如Pro套餐年付省17美元等。该平台定位为面向不同水平创作者,无论是新手还是有经验的专业人士,都能便捷地进行AI创作。
GPT Image 2.5是AI图像生成与照片编辑器,可依描述创作或编辑图片
GPT Image 2.5是一个独立的AI图像生成与照片编辑网站,并非官方OpenAI网站。它允许用户根据文字描述创建图像,也能对现有照片进行编辑,如更换背景、替换物体、调整光线或改变图像风格等。该产品提供免费试用,注册登录后可获得免费试用额度,付费计划则提供更多使用权限。其定位是为有图像创作和编辑需求的用户提供便捷、高效的工具。
免费在线工具,用AI为截图、笔记等图像中的模糊文字去模糊。
Text Deblur是一款免费的基于AI技术的在线文字去模糊工具。它的主要功能是针对截图、笔记、扫描件和照片中的模糊文字进行处理,通过优化图像的对比度和字母边缘,让模糊的文字变得更清晰易读。该工具的重要性在于为用户解决了因各种原因导致的文字模糊问题,如相机抖动、低分辨率扫描等。其主要优点包括无需注册、无水印、每天可免费处理20张图片,且处理结果以私密链接形式保存24小时。产品定位是为普通用户提供便捷的文字去模糊服务,但不用于恢复故意模糊或遮挡的文字信息。
超300条实测AI图片提示词,带效果图,覆盖多模型可免费复制
AI PhotoPrompt是一个提供AI图片提示词库的网站。它收集了300 +条经过实测的AI图片提示词,每条提示词都配有真实的效果图,覆盖了Gemini、GPT Image和Seedream等多个模型。该网站的重要性在于为用户提供了便捷的AI图片创作辅助,用户无需自己绞尽脑汁去想提示词,直接复制使用即可快速生成想要的图片。其主要优点包括提示词丰富、带真实效果图可参考、支持多模型、免费复制使用。产品背景是随着AI图像生成技术的发展,用户对于优质提示词的需求增加,该网站应运而生。价格方面,目前提示词可免费复制使用。其定位是为AI图片创作者提供一个高效、便捷的提示词获取平台。
在线免费使用AI提升图片质量,多工具处理,秒出结果无水印
该产品是一个在线使用AI提升图片质量的网站。其重要性在于为用户提供便捷、高效且免费试用的图片质量改善方案。主要优点包括无需安装、处理速度快、无水印、有多种针对性工具、能最大程度保留原图内容。产品背景是满足用户对提升图片质量的多样化需求。注册可获得免费信用额度用于试用,使用时会显示每次操作所需信用额度。产品定位是为普通用户和专业人士提供高质量图片处理服务。
Gradium为开发者提供超低延迟语音AI,涵盖TTS、STT及语音克隆。
Gradium是一款先进的语音AI模型,为开发者构建语音应用程序和语音代理提供支持。其核心技术包括文本转语音(TTS)、语音转文本(STT)、实时翻译和语音克隆等。产品的主要优点是超低延迟,能够在短时间内完成语音与文本的转换,保证实时交互的流畅性;具备高保真度,生成的语音自然、准确,语音克隆相似度高;且具有多语言支持能力,可满足全球用户的需求。该产品获得了1亿美元种子资金扩展,吸引了NVIDIA等新投资者,还在旧金山湾区开设了办事处来扩大其实时语音AI业务。价格方面文档未明确提及,定位是面向开发者和语音代理领域,助力开发者打造高效、自然的语音交互应用。
使用AI去除产品图像背景,支持单图、批量处理和API调用
RemoveZero是一款专注于产品图像背景去除的AI工具,其重要性在于为电商、广告等行业提供高效、精准的图像背景处理解决方案。主要优点包括:能够清晰分离产品与背景,保留产品细节;提供单图免费处理、批量处理和API集成等多种工作流;定价简单,购买的积分永不过期,较大充值还包含额外奖励积分,相比传统方式可降低约50%的背景去除成本。产品定位为满足不同规模用户对产品图像背景处理的需求,无论是个人用户还是企业用户都能找到适合自己的工作流。
Alibaba ATH的AI音乐模型,一行文字生成含歌词、演唱和编曲的完整歌曲
Happy Shrimp是阿里巴巴ATH于2026年8月17日推出的AI音乐模型。该模型将音乐视为具有自身语法、语义和上下文的语言,能够将歌词、旋律、编曲和演唱统筹规划,实现端到端的完整曲目生成,无需分别拼凑各个部分。它理解专业音乐术语和日常语言,支持强大的提示控制。产品处于公开测试阶段,与太合音乐集团建立战略合作伙伴关系,并在2026阿那亚虾米音乐节上亮相。价格方面,提供免费层级,也有不同功能和时长的付费套餐可供选择,定位为满足用户轻松创作完整音乐的需求。
快速、准确、私密的语音转文字工具,支持多平台及AI工作流
Aqua Voice是一款语音转文字工具,支持Mac、Windows、iPhone等多平台及AI工作流。其主要优点是快速、准确、私密,能将语音实时转化为清晰文本。产品背景在于满足人们摆脱传统键盘输入,提高输入效率的需求。页面未提及价格信息。该产品定位为提高用户生产力,让用户告别打字,通过语音完成各种文本输入工作。
全球最快语音转文字API,低延迟,跨语言方言,速度与精准度兼备。
Pulse是Smallest.ai推出的一款语音转文字API,其核心技术在于能够以低于70毫秒的超低延迟对全球各种口音、语言和方言进行实时转录,且不损失准确性。该产品定位为满足不同行业对语音转录的高效、精准需求,适用于医疗、法律、金融、媒体、客户支持和企业等多个领域。价格方面,提供按需付费的模式,无月承诺,可随使用量扩展。其主要优点包括行业领先的准确率和速度,在30种语言中实现最低的单词错误率,还具备自动说话人标签、实时情感分析和语言识别等附加功能。
免费图像和文字转3D模型生成器,无需注册,一分钟出结果。
Meshy AI是一款免费的在线工具,可将图像或文字提示转化为带纹理的3D模型。它的重要性在于为3D模型制作提供了便捷、高效的解决方案,降低了制作门槛。主要优点包括完全免费、无需注册、生成速度快,支持多种格式导出。背景是基于多个开源AI模型开发,有Microsoft TRELLIS 2、Tencent Hunyuan3D 2.1等。产品定位是面向广大3D创作者,提供一个快速、易用的3D模型生成平台。
AI驱动,秒速将音视频转为精准文本,支持多格式与多语言。
SpeechTurbo是一款基于先进AI语音识别技术的在线转录工具。其核心优势在于能够快速、准确地将音频和视频内容转换为文本。该工具支持多种常见的音视频格式,可直接上传文件或从云存储导入。它采用GPU加速转录,能实现50倍实时转录速度,准确率高达99.8%,支持98种语言,VIP用户还可将转录文本AI翻译为70种目标语言。在数据安全方面,上传文件通过HTTPS加密传输,转录完成后24小时内自动删除原始文件,核心语音转文本在自有GPU服务器运行,不使用第三方转录API,且不会使用用户数据训练模型。价格方面,提供不同的信用包套餐,如9.99美元可购买60,000个信用点,信用点有效期为365天,按分钟计费,Flash模式每分钟10个信用点,Premium模式每分钟20个信用点。该产品定位为满足专业转录需求,为创作者、商务人士、教育工作者等提供高效、准确、安全的转录服务。
© 2026 AIbase 备案号:闽ICP备08105208号-14