塑造具面部、语音且响应超200ms的类人AI智能体,助力自然交互
Ojin是一家专注于打造类人AI智能体的公司。其核心技术基于多年世界级云流技术经验,利用全球分布式推理云,实现低延迟的实时推理,可让AI在有人类面部、语音的情况下以低于200ms的时间响应。该产品面向个人开发者、企业团队,适用于多种场景,无论是小型企业还是大型跨国公司都能借助其构建智能交互服务。产品价格方面,提供10美元免费试用信用额度,之后根据用户需求及使用规模进行收费,具有成本效益,运行实时推理时会自动寻找成本最低且速度最快的方式,把节省的成本让利给用户。产品注重安全性和数据隐私,符合如SOC 2 Type II、欧盟AI法规、GDPR等多种合规标准。
全球最快语音转文字API,低延迟,跨语言方言,速度与精准度兼备。
Pulse是Smallest.ai推出的一款语音转文字API,其核心技术在于能够以低于70毫秒的超低延迟对全球各种口音、语言和方言进行实时转录,且不损失准确性。该产品定位为满足不同行业对语音转录的高效、精准需求,适用于医疗、法律、金融、媒体、客户支持和企业等多个领域。价格方面,提供按需付费的模式,无月承诺,可随使用量扩展。其主要优点包括行业领先的准确率和速度,在30种语言中实现最低的单词错误率,还具备自动说话人标签、实时情感分析和语言识别等附加功能。
jcode是用Rust编写的开源终端编码代理,启动快、持久记忆、支持多任务
jcode是一个用Rust编写的开源终端编码代理。它建立在三个核心理念之上:一是强调并行性对编码生产力的提升,能同时运行多个代理,大大提高任务处理量;二是认为工具的配套环境对模型的输出结果影响巨大,且不断改进配套环境可随模型迭代而积累优势;三是坚持开发工具必须开源,用户可检查和修改工具代码。其优势在于资源高效利用,降低了多代理运行时的内存消耗,提升了启动速度。同时,它设计了新的基准测试方法,更准确地评估代理能力。价格方面文档未明确提及,推测定位为面向开发者及编程人员,帮助他们提高编码效率。
实时AI语音翻译与实时字幕,适用于直播、游戏和会议,即插即用。
HaloVoice是一款专注于实时语音翻译和实时字幕的桌面客户端软件。其背景是为了解决全球用户在直播、游戏和会议等场景中的语言沟通障碍问题。它的主要优点在于低延迟的实时翻译,能确保流畅沟通;支持多平台集成,方便用户在常用软件中使用;具备先进的噪音消除和音频处理技术,提供清晰音质。价格方面,有免费版可一分钟内开始使用实时字幕和翻译,专业版每月9.9美元,企业版支持定制。整体定位是为全球用户提供高效、便捷的语音翻译解决方案。
APIArc为开发者提供统一API密钥和端点,访问多厂商AI模型。
APIArc是一个统一的AI模型网关,其重要性在于简化了开发者对多种AI模型的访问流程。主要优点包括:通过官方渠道发送请求,确保数据安全和合规;采用低延迟路由,将请求发送到最快的健康上游,提高响应速度;具备健康检查和自动故障转移功能,保障服务的稳定性。产品背景方面,随着AI模型的增多,开发者需要一个统一的平台来管理和使用不同厂商的模型,APIArc应运而生。价格方面,文档中未明确提及,但有试用活动,如Kimi K3限免。产品定位是为开发者提供便捷、高效、稳定的多模型访问服务。
Spatius提供下一代AI头像基础设施,支持设备端渲染和低带宽实时交互。
Spatius是一个提供下一代AI头像基础设施的平台。其核心技术包括设备端渲染、轻量级音频特征提取、原生高斯模糊渲染等,适用于边缘计算和云端混合架构。该平台的重要性在于,它通过将繁重的云渲染替换为轻量级的100kbps流,并直接在边缘进行渲染,大幅降低了基础设施开销。其主要优势包括:具备在弱网络下保持稳定的性能,支持多种操作系统(Web、iOS和Android),可以快速部署,并且能够在入门级芯片组上运行1080p 25fps的视频。价格方面,每小时收费在0.00美元至0.42美元之间。平台定位为为各行业提供高效、经济的AI头像解决方案。
AI自动化平台,免代码构建智能体、自动化流程并发布交互式应用。
LiveContext是一个AI自动化平台,它允许用户通过聊天描述工作,平台自动构建工作流,利用有访问权限和预算的智能体运行流程,并将其作为应用提供给团队。其重要性在于提供了无代码的自动化解决方案,降低了自动化流程构建的门槛。主要优点包括拥有600多个集成、支持自定义API、数据表格、市场和AI聊天等功能。产品背景未提及,价格信息未给出,定位是为企业和团队提供高效的自动化工作解决方案。
OpenVibe为英国企业提供快速AI解决方案与原型开发,数周交付软件。
OpenVibe专注于快速AI原型开发、低代码/无代码开发以及企业级AI集成。其重要性在于能够帮助企业快速将商业想法转化为功能完善的AI软件。主要优点包括开发速度快,能在数周内交付成果;采用低代码/无代码开发,降低开发门槛;拥有专业的AI技术和云数据背景,确保系统稳定可靠。该公司总部位于英国,服务全球客户,为初创公司创始人、CTO、数字机构、运营团队等提供服务。文档中未提及价格相关信息。
Miso One是Miso Labs推出的英语TTS模型,支持情感语音生成。
Miso One是Miso Labs发布的一款具有8B开放权重的英文文本转语音模型。其重要性在于为语音研究和应用提供了新的选择,特别是在低延迟语音代理和富有表现力的对话式语音领域。主要优点包括支持富有表现力的英语对话语音、低延迟生成、支持语音克隆和基于提示的语音设计。产品背景是为了满足语音研究和创作者工作流程的需求。价格方面,有免费计划,每次可使用120个字符,升级后可解锁1000字符。定位是为语音代理研究和创作者提供高质量的语音生成解决方案。
AI驱动,数分钟内构建网站、应用和在线商店,无需编码
Youmake是一款基于AI技术的网站和应用构建平台,其重要性在于极大地降低了开发门槛,让非技术人员也能轻松创建应用。主要优点包括无需编码知识,开发速度快,能在短时间内将想法转化为实际应用;提供生产就绪的模板,支持各种行业;集成了常用工具,减少开发的复杂性;还能部署AI代理自动处理日常任务。产品背景是为了满足非技术创业者和开发者快速开发产品的需求。价格方面,平台免费使用,无需信用卡。产品定位是面向非技术人员和创业者的低代码开发平台。
提供高质量AI接口服务,适配多业务,支持多模型,价格优惠。
范尼API是一个提供AI接口服务的平台,为开发者打造稳定易用的API接口平台。其优势在于安全稳定、低延迟、高并发,可一站式集成几乎所有AI大模型。平台适配多种业务场景,驱动业务增长,并且完全兼容OpenAI接口协议,确保集成无缝。价格方面,采用按量付费的方式,透明计费与官方计费倍率同步,性价比高。定位是为开发者提供快速、便捷的Web API接口调用方案,助力企业级应用的开发。
OfoxAI统一大模型API网关,一个API接入100+模型,低延迟易集成。
OfoxAI是一个统一的大模型API网关,它为开发者和企业提供了便捷的AI服务接入方式。其重要性在于可以通过一个API接入GPT - 5.4、Claude Opus 4.6、Gemini 3.1、DeepSeek V3.2等100+模型,解决了多模型接入的繁琐问题。主要优点包括全球加速低延迟,能让开发者在全球范围内获得可靠的API访问;兼容OpenAI接口,只需简单替换URL,现有代码就能继续使用,3分钟即可完成集成;提供99.9%的SLA,保证服务的高可用性。产品背景是为了满足开发者快速部署AI应用的需求。价格方面,有免费层可使用10个免费模型,具体使用根据用量付费。定位是面向开发者和企业,帮助他们快速、高效地接入多种大模型。
LPM 1.0是17B参数模型,实时生成全双工AI视频,低延迟身份一致。
LPM 1.0是一个拥有17B参数的扩散变压器(Diffusion Transformer),专为实时全双工对话式AI视频生成而设计。其主要优点包括低至0.35秒的延迟、身份一致的无限长度视频输出、跨任何角色风格的零样本泛化能力以及多模态条件控制等。背景方面,它是一个学术研究项目,目前没有开源或商业化产品计划。价格上,在发布周年度计划可享4折优惠,购买年度计划可以解锁优先队列并生成更多AI视频。该产品定位为先进的AI视频生成解决方案,为用户提供高效、高质量的视频生成体验。
零代码AI应用开发平台,通过AI团队协作将创意快速转化为可盈利的Full-stack产品。
Atoms 是一款革命性的 AI 驱动型全栈开发平台,旨在消除编程门槛。它不仅仅是一个代码生成器,而是一个由多个 AI 角色(如架构师、产品经理、工程师等)组成的虚拟团队。该产品定位于帮助创业者和企业快速验证想法并将其转化为实际营收。其核心价值在于将传统需要数百小时和多种工具协作的流程,压缩至几小时内的单一工作流。Atoms 提供了包含前端、后端、数据库及 Stripe 支付集成在内的完整生产环境,支持导出代码至 GitHub,确保了用户对项目的完全掌控。目前提供免费试用额度,付费订阅起售价约为每月 15.8 美元(年付折扣价)。
由AI驱动、通过对话定制的本地桌面应用,可按需创建个人软件。
Moldable是一款桌面应用程序,允许用户通过对话构建个人软件。其核心技术是由AI驱动,通过与用户的对话来生成应用程序。这款产品的主要优点在于它的本地优先架构,确保用户数据的所有权和安全性,同时支持用户根据自己的想法快速创建和迭代应用。它的定位是为个人和团队提供一个无需编码或低代码的平台,以满足他们个性化的软件需求。产品背景是为了改变传统软件的构建和使用方式,让用户能够更加自主地定制他们所需的工具。价格方面,该产品免费下载和使用。
与LLaMA-Factory官方合作,一站式低代码大模型微调平台,支持超百种模型。
LLaMA-Factory Online是与明星开源项目LLaMA Factory官方合作打造的在线大模型训练与微调服务平台。其底层提供高性能、高弹性GPU算力资源,定位为具有微调需求、编码与工程能力较为基础的用户群体,提供开箱即用、低代码、全链路功能覆盖的大模型训练与微调服务。该平台具有权威、系统的使用指南和精选的真实场景案例。价格方面,采用秒级计费,任务仅在运行态计费,不用不扣费,还设有高性能GPU限时超低价等优惠活动。其重要性在于降低了大模型微调的技术门槛和经济门槛,让更多用户能够参与到大模型的训练与微调中。
Proxy Lite 是一款开源的 3B 参数视觉语言模型(VLM),专注于网页自动化任务。
Proxy Lite 是 Convergence AI 推出的一款开源模型,具有强大的网页自动化能力。它通过独特的三步响应机制(观察、思考、工具调用)实现高效的网页交互,显著提升了任务的成功率和效率。该模型在 WebVoyager 任务中表现出色,仅使用少量计算资源就能达到顶尖水平。其开源特性使得开发者和研究人员可以自由使用、改进和扩展,推动了开源社区在自动化领域的进步。
低占用、快速且可私有部署的免费版离线翻译服务器。
MTranServer 是一个专注于低资源消耗和快速响应的离线翻译服务器。它基于高效的翻译模型和优化的后端架构,能够在普通硬件上实现快速的翻译服务。该产品的主要优点是资源占用低(仅需1G内存即可运行),无需显卡支持,同时翻译速度极快,单个请求平均响应时间仅50ms。它适用于需要在本地环境中进行快速翻译的用户和企业,尤其适合对隐私和数据安全有较高要求的场景。产品完全免费,支持多种语言的翻译,是 Google Translate 的一个优秀的私有化替代方案。
Pig 是一款通过 AI 技术实现 Windows 应用程序自动化的生产力工具。
Pig 是一款专注于通过 AI 技术实现 Windows 应用程序自动化的工具。它通过自然语言交互界面,让用户无需编写代码即可快速构建复杂的工作流程。Pig 的核心优势在于其强大的 AI 能力,能够模拟人类操作行为,如点击、输入和截图等,从而实现对 Windows 应用的精准控制。此外,Pig 提供了低代码的 SDK,支持开发者构建更高级的自动化解决方案。该产品主要面向需要提高工作效率的企业和个人用户,尤其是那些希望减少重复性任务的用户。Pig 的价格和具体定位尚未明确,但从其功能来看,它可能更适合企业级用户,用于实现业务流程的自动化。
© 2026 AIbase 备案号:闽ICP备08105208号-14