首页 游戏 软件 资讯 排行榜 专题
首页
科技数码
40万数字人替代真人调研,预测准确率高达95%

40万数字人替代真人调研,预测准确率高达95%

热心网友
11
转载
2026-03-08

三年前,斯坦福大学与谷歌的研究团队联合发布了一篇论文,让整个 AI 圈集体亢奋。

免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈

他们用 ChatGPT 驱动了 25 个各有姓名、职业与性格设定的虚拟角色,让这些角色在一个名为 Smallville 的像素风沙盒世界里自主生活:起床、做早饭、上班、在公园散步、与邻居聊天,关系网络随着交互自然生长,甚至有人自发竞选市长、还有人撺掇着策划了一场情人节派对……


(来源:斯坦福小镇)

这些行为没有预置脚本,完全由语言模型在每个时间步骤中实时生成。这项后来被称为"斯坦福小镇"的实验揭示了一种可能:大语言模型在被赋予记忆、反思与规划机制之后,能够涌现出相当程度上近似真实人类的社会行为。而这带来的影响将远超模拟游戏本身。

近日,这支团队的多位核心成员走出校园,把这个思路带进了商业世界。他们创立了一家名为 Simile 的公司,目标不是继续在虚拟小镇里做实验,而是直接替换掉传统市场调研行业的核心工作流。

Simile 的创始团队学术背景极其强大。联合创始人兼首席执行官 Joon Sung Park 是斯坦福大学博士,“斯坦福小镇”论文《生成式智能体:人类行为的交互模拟》(Generative Agents: Interactive Simulacra of Human Behavior,2024)的共同作者之一;另外两位核心创始人 Michael Bernstein 和 Percy Liang 均为斯坦福教授,各自在斯坦福执教已逾 12 年。

Percy Liang 还是“基础模型”(Foundation Model)这一概念的提出者之一,该术语如今已成为整个 AI 行业的通用语。此外,公司联合创始人还包括 Lainie Yallen,同样具有斯坦福学术背景。目前团队规模依然精干,据公开资料显示在 50 人以内,更接近一支学术实验室的体量,而非成熟的科技公司。

上个月,Simile 正式宣布完成 1 亿美元的 A 轮融资,领投方为知名风险投资机构 Index Ventures,参与方包括 Bain Capital Ventures、A* 和 Hanabi Capital,以及 AI 学界两位极具影响力的人物:斯坦福大学教授、“AI 教母”李飞飞,以及特斯拉前 AI 总监、OpenAI 联合创始人 Andrej Karpathy。


图 | 创始人Joon Sung Park 宣布创立Simile(来源:X)

与此同时,CVS Health(美国最大药房连锁集团之一)的风险投资部门 CVS Health Ventures 也赫然在列, CVS 同时也是 Simile 迄今最重要的商业客户之一。目前,公司估值未予披露。

Simile 的核心产品,是他们所称的“智能体孪生”(Agentic Twin)。简单说,就是基于真实人类的访谈数据、行为记录、消费数据等多维度信息,训练出一个能够模拟该人做决策、表达偏好的 AI 智能体。

这个智能体不是一个静态的用户画像,而是可以被反复"提问"的虚拟个体。你可以向它询问对某个产品设计的看法,测试某条广告语的反应,或者模拟它在某种政策条件下的行为选择。

这套逻辑的商业价值非常清晰:传统市场调研行业的规模约达 1,500 亿美元,依赖大量人工访谈、焦点小组和问卷调查,一个项目走下来往往耗时数月、成本不菲。而 Simile 提供的,是一个"永远在线"的数字人群库。企业可以随时向这个数据库发起查询,问题数量不设上限,不必担心受访者疲劳,也不用等待问卷回收周期。

CVS 的实践,目前是 Simile 最具说服力的案例。据 CVS 企业客户体验与洞察副总裁 Sri Narasimhan 介绍,CVS 的数字孪生智能体系统基于超过 40 万真实用户、合计 290 万条问卷回答构建,这些数据均经过用户知情同意,并叠加了 CVS 自有的第一方数据,包括历史问卷记录和客户服务互动信息。经过校准测试,CVS 发现这套孪生系统在复现已知调研结论方面,准确率高达 95%。


(来源:CVS)

所谓“复现已知结论”,指的是用 AI 孪生体回答过去真实人类已经回答过的问题,再比对结果的吻合程度。这是一种回溯验证方式,衡量的是孪生体的拟真度,而非其预测未来行为的能力,后者要复杂得多,目前也没有公开披露相关数据。CVS 的研究人员也承认,这套系统仍需人工持续介入,用真实用户的回答不断进行回测,并由专业人员负责识别潜在偏差。

Narasimhan 在接受采访时描述了一些具体应用场景:CVS 用数字孪生智能体评估客户对用药指南的依从性,发现人们最普遍的担忧集中在如何联系到药剂师、以及如何管理药品续期这两件事上;他们还用孪生体测试宠物药品的营销话术,发现用户普遍不认为给宠物用药是件麻烦事,反而更在乎能否协调兽医的服务流程。

这类洞察在过去依赖人工访谈,对于难以触达的群体,比如有慢性病的患者、基层医疗提供者等,更是成本极高。

CVS 还透露了下一步计划:将现有的孪生体规模扩展至超过十万个,并在店面布局设计、新品开发等更多决策场景中引入这套工具。Narasimhan 用了一句意味深长的话概括方向:"如果我们要持续投入数字孪生智能体,我们对传统市场调研小组的需求就不会像以前那么大了。"

除了 CVS,Simile 还宣布与民调机构 Gallup 达成合作。根据 Gallup 全球执行合伙人 Joe Daly 的说法,双方将向共同客户提供超过 1,000 个 AI 生成的数字孪生体,重点覆盖政策研究、趋势分析、企业调研以及健康、职业满意度等议题。

在定价层面,Simile 向企业客户收取的年费区间为 15 万至数百万美元不等(数据来源:《华尔街日报》),具体金额取决于访问规模与功能深度,细节未作公开披露。这个价格带意味着其当前目标客户仍主要是大型企业,中小型机构是否能够负担,目前尚不明朗。

当然,这些顺畅的商业叙事背后,也存在着值得审视的挑战。市场调研咨询机构 Gartner 的新兴技术分析师 Evan Brown 给出了相对保守的判断:用 AI 孪生体测试营销话术,是这项技术目前最合适的落地场景之一,因为风险相对可控,即便 AI 判断出现偏差,代价也比医疗等高敏感领域小得多。

但他同样明确表示,现阶段 AI 孪生体尚不具备全面取代传统数据采集流程的能力,企业仍然需要持续采集真实人类的第一手数据,而不是完全依赖模拟。

这一点,CVS 本身也是认同的。Narasimhan 强调,公司的研究团队会持续将孪生体的输出与真实用户回应进行比对,任何可能的偏差都需要人工识别和修正。“我们永远不会停止与真实客户的沟通,”他说。这句话,既是对外部质疑的回应,也在一定程度上厘清了孪生体在整个调研体系中的定位——它是一个加速工具和规模化工具,而不是终点。

Simile 并非孤身入场。就在其融资宣布前数周,同赛道的竞争对手 Listen Labs 于 2026 年 1 月完成 6900 万美元的 B 轮融资,估值达 5 亿美元,采取的是另一种路径:用 AI 对真实人类进行大规模访谈,而非构建合成替代品,客户已涵盖微软、Perplexity 等头部企业。


(来源:Listen Labs)

两种方法论的分歧,折射出这个新兴市场目前尚未形成共识的底层争论:模拟人类行为,究竟需要一个多深的真实数据锚点?

Joon Park 在公开场合表达的愿景是:未来 Simile 的客户将需要“多智能体仿真”,即让大量孪生体相互交互,在接近真实世界的环境中模拟更复杂的社会场景。这一愿景与两年前 Smallville 的实验一脉相承,但商业落地的逻辑要务实得多。先从市场调研这个痛点最直接、采购决策最成熟的行业切入,积累数据、打磨准确率、建立信任,再徐图扩展。

从斯坦福实验室里 25 个虚拟小镇居民,到 CVS 正在构建的数十万人规模数字人群库,数量级的跃迁只用了不到两年。第一枪,已经打响了。

1.https://www.wsj.com/cio-journal/can-ai-replace-humans-for-market-research-4f818890?st=ttdgNe&reflink=desktopwebshare_permalink

来源:https://www.163.com/dy/article/KNH59ID905119734.html
免责声明: 游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。

相关攻略

腾讯发布出行智能体开放平台,音乐、导航外再做加法
科技数码
腾讯发布出行智能体开放平台,音乐、导航外再做加法

汽车智能化竞争进入下半场,腾讯加速入局 汽车智能化赛道的竞争正进入一个全新阶段,互联网巨头腾讯的布局步伐也在明显加快。就在刚刚落幕的北京车展上,腾讯面向整个汽车行业,正式发布了“出行全场景智能体开放平台”。这个平台并非空壳,而是直接带来了随行点单、随行向导、随行逛逛、随行互连等七大核心场景的智能体应

热心网友
04.27
万联易达推出产业智能体协同应用平台
科技数码
万联易达推出产业智能体协同应用平台

AI智能体:从“工具”到“协作者”,产业变革正当时 AI智能体正在加速渗透各行各业。面对充满不确定性的商业环境和产业场景,一个可管可控、可信可协作的“智能体互联网”,正逐渐成为关键的“数字新基建”。 就在近日,一场由工业和信息化部信息通信管理局指导,中国互联网络信息中心、中国电信、万联易达集团联合举

热心网友
04.27
智能体落地遇到数据难题,看实在Agent怎么做
业界动态
智能体落地遇到数据难题,看实在Agent怎么做

生成式AI:从技术热潮到企业落地,关键跨越何在? 眼下,生成式AI(GenAI)无疑是商界最炙手可热的话题,一跃成为众多企业数字化转型的首选AI方案。大语言模型的突飞猛进,为这波普及浪潮提供了底层支撑,而其中最具想象空间的AI Agent,更是被推至聚光灯下——2024年,甚至被许多人定义为“AI

热心网友
04.27
智能体和智能体平台分别是什么?两者有什么关系?
业界动态
智能体和智能体平台分别是什么?两者有什么关系?

智能体与智能体平台:智能化浪潮的双翼 当下的科技领域,智能体和智能体平台堪称一对耀眼的主角。如果说智能体像经验老到的“特工”,能够独立研判、精准执行,那么智能体平台就是培养这位特工的“训练营”和施展才华的“大舞台”。它们一个负责在前线冲锋陷阵,另一个则在后方提供源源不断的弹药与战术地图。两者相互成就

热心网友
04.27
大型智能体模型
业界动态
大型智能体模型

大型智能体模型:从核心原理到广阔前景 说起“大型智能体模型”,可能听起来技术味儿十足,但它的核心思路其实挺直观的:就是以我们熟知的大型语言模型(LLM)作为“大脑中枢”,赋予它规划任务、做出决策并执行一系列复杂操作的能力。这类模型的特点非常鲜明——参数规模庞大、训练数据海量、内部结构复杂,通常需要经

热心网友
04.27

最新APP

宝宝过生日
宝宝过生日
应用辅助 04-07
台球世界
台球世界
体育竞技 04-07
解绳子
解绳子
休闲益智 04-07
骑兵冲突
骑兵冲突
棋牌策略 04-07
三国真龙传
三国真龙传
角色扮演 04-07

热门推荐

我国刀具市场发展调研报告
办公文书
我国刀具市场发展调研报告

我国刀具市场发展调研报告 在当今制造业持续升级的背景下,市场调研报告的重要性日益凸显。一份结构清晰、数据翔实的报告,能为决策提供关键参考。以下这份关于我国刀具市场的调研报告,旨在梳理现状、剖析问题,并为未来发展提供借鉴。 当前,国内刀具年销售额约为145亿元,其中硬质合金刀具占比不足25%。这一比例

热心网友
04.27
国内首份空净市场调研报告
办公文书
国内首份空净市场调研报告

国内首份空净市场调研报告 在公众健康意识日益增强的今天,市场报告的重要性不言而喻。一份结构清晰、数据翔实的报告,能为行业描绘出精准的航图。那么,一份优秀的市场调研报告究竟该如何呈现?近期发布的这份国内空气净化器行业蓝皮书,或许能提供一个范本。 市场增长的势头有多强劲?数据显示,国内空气净化器市场正驶

热心网友
04.27
水利工程供水管理调研报告
办公文书
水利工程供水管理调研报告

水利工程供水管理调研报告 在各类报告日益成为工作常态的今天,撰写一份扎实的调研报告,关键在于厘清现状、找准问题、提出思路。这份关于水利工程供水管理的报告,旨在系统梳理情况,为后续决策提供参考。 一、基本情况 横跨区域的**水库及八座枢纽拦河闸,构成了**运河流域防洪与兴利供水的骨干工程体系。自投入运

热心网友
04.27
财产保全申请书范本
办公文书
财产保全申请书范本

财产保全申请书范本 一份规范的财产保全申请书,是启动财产保全程序的关键文书。其核心在于清晰、准确地列明各方信息、诉求与依据。通常,申请书的结构是固定的,但具体内容需要根据案件事实来填充。下面,我们通过几个典型的范本来拆解其中的要点。 篇一:通用格式范本 首先来看一个通用模板。这个模板清晰地勾勒出了申

热心网友
04.27
暑假大学生防台风社会实践调研报告范文
办公文书
暑假大学生防台风社会实践调研报告范文

“防台抗台”活动由学院的积极分子组成,他们踊跃报名,利用暑期时间奉献自己的青春,为社会尽一份力量。 带队的学院分团委书记吕老师点出了活动的深层价值:这不仅是一次能力锻炼,更是学生认识社会、融入社会并最终回馈社会的关键一步。经过这番历练,团队友谊愈发坚固,协作精神显著增强,感恩之心也油然而生。 青春洋

热心网友
04.27