AI评测平台DesignArena获790万美元融资

摘要
AI 评测平台 DesignArena 完成 790 万美元种子轮融资,主打面向模型公司的大规模人类反馈数据服务 。
一家主打 AI 模型“人类反馈”数据的平台拿到新一轮融资。DesignArena 背后公司 Intelligence 宣布完成 790 万美元种子轮融资,领投方为 Index Ventures,参投方包括 Conviction、A*、Valkyrie 等。公司称,平台目前已覆盖全球 530 万用户,年化经常性收入达到 6000 万美元。
从游戏生成转向模型评测
这家公司由 Grace Li 与朋友在 2025 年毕业前后创立。团队起初想做 AI 游戏引擎,但很快发现,模型虽然能生成“可用”的游戏,却很难判断作品是否真正好玩。
团队随后把重点转向收集大规模真实用户反馈。他们认为,在设计与审美相关任务上,自动化指标很难完全替代人的判断,这也让产品逐步演变成一个面向模型输出的比较与排序平台。
用户投票形成训练信号
对普通用户来说,DesignArena 的使用方式接近一个多模型生成工具。用户输入提示词后,可以在网页、图片等不同视觉格式中选择输出,再通过“A 对 B”的方式比较多个结果,最终把候选内容从优到劣排出顺序。
这套流程的商业价值主要体现在企业端。参与平台的模型公司可以把这些排序结果当作持续更新的反馈来源,用来优化各自的媒体生成模型。由于多数用户更关注结果本身,而不是背后具体调用了哪一个模型,这类投票数据更接近真实偏好。
- 全球用户规模约 530 万
- 公司称年化经常性收入为 6000 万美元
- 本轮融资金额为 790 万美元
AI公司为偏好数据付费
Grace Li 表示,公司在产品早期就与一家前沿实验室达成了首笔重要合作。她认为,很多模型在设计类任务上的提升,瓶颈并不只是算力或基准测试,而是缺少可持续的人类评价数据。
公司还提到,由于用户需要登录后才能获取结果,平台可以进一步追踪不同地区、不同时间段的审美变化。这类数据被视为自动化基准测试的补充。文章提到,自动化评测虽然规模更大,但也更容易受到操纵,近期 Hugging Face 遭遇的安全事件就再次放大了这一问题。
同类赛道已有分化
不过,人类众包评测并不意味着一定能形成稳定商业模式。报道提到,另一家同类公司 Yupp 在拿到 3300 万美元融资后,已于今年早些时候停止运营。该公司曾表示拥有超过 130 万用户,也吸引过前沿模型客户,但最终未能建立可持续业务。
与此同时,文本评测平台 LM Arena 的进展则更快。该公司在今年 1 月完成 1.5 亿美元 A 轮融资,距离其正式推出付费产品仅过去 4 个月。由此可见,围绕 AI 模型评估与偏好数据的创业方向,仍在快速分化之中。