Design Arena获790万美元种子轮融资,加速AI模型人类评估平台商业化

背景与市场需求
随着生成式AI模型在文本、图像乃至游戏等多模态领域的快速迭代,单纯依赖自动化基准已难以捕捉真实用户的审美与可玩性。Design Arena的创始人Grace Li在2025年毕业前夕意识到,模型能够生成功能完整的游戏,却往往缺乏“好玩”这一核心属性。为此,她联合几位同学打造了一个以 A/B 对比 为核心的人类反馈平台,让真实玩家在短时间内对多版本输出进行排序,从而为模型提供可量化的“味觉”。
融资概览
2026年8月3日,公司母体Intelligence宣布完成 790万美元 种子轮融资,领投方为 Index Ventures,随后还有 Conviction(Sarah Guo、Mike Vernal)、A*、Valkyrie 等机构跟投。融资后,公司计划:
- 扩大亚洲与欧洲的运营团队;
- 深化与前沿实验室的长期合作协议;
- 推出企业级 API,提升数据安全与合规能力。
产品核心功能
- 多模态输入:支持网页、图片、音频等十余种格式的提示词。
- 即时对比:用户在 ChatGPT 风格的对话框中提交请求后,系统自动生成多组候选输出,呈现为 “A vs. B” 的选择卡片。
- 排名反馈:用户将最满意的结果拖至顶部,系统记录排名顺序并实时回传给接入模型。
- 企业仪表盘:后台提供跨地域、时间维度的口味趋势图,帮助实验室监测不同文化下的偏好变化。
“用户不在乎他们在评估的是哪个模型,只在乎得到的内容是否最佳,”Li 在接受采访时如是说。
商业表现与竞争格局
截至目前,Design Arena 已拥有 5300万 注册用户,年化经常性收入(ARR)突破 6000万美元,成为 AI 产业中重要的人类评估数据提供商。相比之下,去年倒闭的 Yupp 虽然也拥有约 130万 用户,却因商业模式单一、难以实现可持续盈利而被迫关闭。另一家同类公司 LM Arena 在今年1月完成 1.5亿美元 的 Series A 融资,专注于文本响应的对比评测,两者在目标用户和付费模式上呈现互补。
行业意义
Design Arena 的数据流不仅为模型的微调提供了高质量的监督信号,也为自动化基准的 防作弊 提供了有力补充。正如文章所提及的 Hugging Face 安全漏洞,纯算法评测易被对手“游戏化”。通过大规模、持续的人类反馈,前沿实验室能够更快捕捉到用户真实需求的细微变化,加速生成式AI 向可商用化迈进的步伐。
前景展望
随着大模型规模继续扩大、生成内容的商业化场景增多,对高质量人类评估的需求将呈指数级增长。Design Arena 已在技术、数据与商业三方面奠定了先发优势,后续若能进一步深化与云服务提供商的集成,或将成为生成式AI 生态链中不可或缺的“味觉中枢”。