快速精确测量卡片居中情况,提供四大评级机构的等级预估
Midpoint Card Centering Tool 是一款独立的卡片居中测量工具,与各大评级机构和卡片发行商无关联。它通过机器学习模型快速精准地测量卡片的居中程度,并提供 PSA、BGS、CGC 和 TAG 等评级机构的等级预估。该工具可节省收藏者的时间和金钱,避免因卡片未居中而导致的重新评级费用。产品提供 2 次免费分析,之后可选择每周或半年订阅以获取无限次使用服务。它定位为卡片收藏者的预评级工具,帮助他们在提交卡片进行专业评级前了解卡片的质量。
自动化的生成式AI评估平台
AutoArena是一个自动化的生成式AI评估平台,专注于评估大型语言模型(LLMs)、检索增强生成(RAG)系统和生成式AI应用。它通过自动化的头对头判断来提供可信的评估,帮助用户快速、准确、经济地找到系统的最佳版本。该平台支持使用来自不同供应商的判断模型,如OpenAI、Anthropic等,也可以使用本地运行的开源权重判断模型。AutoArena还提供了Elo评分和置信区间计算,帮助用户将多次头对头投票转化为排行榜排名。此外,AutoArena支持自定义判断模型的微调,以实现更准确、特定领域的评估,并可以集成到持续集成(CI)流程中,以自动化评估生成式AI系统。
RAG-based LLM agents的Elo排名工具
RAGElo是一个工具集,使用Elo评分系统帮助选择最佳的基于检索增强生成(RAG)的大型语言模型(LLM)代理。随着生成性LLM在生产中的原型设计和整合变得更加容易,评估仍然是解决方案中最具有挑战性的部分。RAGElo通过比较不同RAG管道和提示对多个问题的答案,计算不同设置的排名,提供了一个良好的概览,了解哪些设置有效,哪些无效。
开源的3D生成模型评价工具
GPTEval3D是一个开源的3D生成模型评价工具,基于GPT-4V实现了对文本到3D生成模型的自动评测。它可以计算生成模型的ELO分数,并与现有模型进行对比排名。该工具简单易用,支持用户自定义评测数据集,可以充分发挥GPT-4V的评测效果,是研究3D生成任务的有力工具。
找到所有ChatGPT的自定义GPT的最佳市场
GPT App Store是一个在线的自定义GPT目录,提供按类别、受欢迎程度和用户评级来发现OpenAI GPT。用户可以轻松搜索、评论、收藏和评价GPT。
© 2026 AIbase 备案号:闽ICP备08105208号-14