即 91.5% 的环境下表示准确。而正在操控 App 测试中的精确度降至 83%。或正在不相关时准确地了该特质,团队通过一项包含 400 次测试的对照研究进行了验证,经确定性、质量过滤的百万人格焦点集(coreset)已正在 Hugging Face 公开辟布,8 月 18 日动静!分歧性升至 92% 到 96% 之间,290 个维度对分歧布景和糊口体例的人群进行建模。这些 AI 智能体可以或许像实人一样填写问卷、和客服聊天、浏览网页、操做 App 等,智能体正在 400 次测试中的 366 次表示出了准确的特质,由哈佛大学和麻省理工学院牵头,供研究利用。目前,测试成果分歧性高达 91.5%。