2026年6月,多维表格 Analysis Agent 在 FDABench、SpreadsheetBench 、TableBench三大真实业务数据分析评测榜单均位列第一。
6月,飞书多维表格 AI 先后斩获三项全球权威真实业务数据分析 Data Agent 评测榜单冠军:在 FDABench 榜单的总三项任务中均名列第一,在 SpreadsheetBench (V1 Verified 榜单)中以 96.50% 的准确率排名第一,并在面向真实业务场景的国际表格数据问答评测 TableBench 中位列第一。
三项评测对应不同的真实业务数据处理任务:TableBench 主要验证 AI 对复杂表格的数据检索、统计计算、数据分析和可视化能力;FDABench 进一步验证 AI 能否整合多源信息完成业务分析;SpreadsheetBench 则验证 AI 能否稳定完成真实电子表格操作。
TableBench:面向真实业务场景的复杂表格数据问答
TableBench 是面向真实业务场景的国际表格数据问答评测,评测指标包括数据检索、统计计算、数据分析和可视化四项能力,覆盖 18 个专业测试任务和 886 个真实业务案例。这些任务并非抽象的技术指标,而是企业日常经营中的真实难题:销售数据波动如何快速定位原因,项目进度滞后如何一眼看清瓶颈,库存周转异常如何及时预警并给出判断依据?它考察的不是 AI 会不会 "读表格",而是 AI 能否在复杂表格中把业务问题分析清楚。
飞书多维表格 AI 登顶 TableBench 榜单,意味着它在处理真实业务数据时已能更准确地完成检索、计算、分析与可视化,帮助用户获得更可用的业务判断。
250px|700px|reset
FDABench:验证多元数据分析能力
FDABench 考察的是 AI 能不能像业务分析师一样,理解和分析清楚真实工作中更复杂、多元的数据问题。测评内容包含 2,007 个任务,包覆盖金融、医疗、零售等50多个领域。其评测数据集不只是一张表格,还包括数据库、文档、网页、图片、视频、音频等多种类型的业务资料,通过单选、多选和分析报告生成三项核心任务,考察 AI 是否能在复杂业务数据中完成数据检索、逻辑推理和结论输出。
飞书多维表格 AI 在 FDABench 中取得领先表现,在报告生成、单选、多选等三项任务上均位列第一。这意味着,它不只是能“查表”,还能面对多来源、多形态的数据,把“数据在哪里”“该怎么算”“原因是什么”这些步骤连起来,帮助团队更快看清业务问题。帮助用户更快看清销售波动、项目延期、库存异常等业务问题背后的原因。
250px|700px|reset
SpreadsheetBench:在真实电子表格中稳定完成操作
SpreadsheetBench 更聚焦真实电子表格里的具体操作。它不是让 AI 简单回答表格里的某个问题,而是给 AI 一份真实 Excel 和一个用户需求,让 AI 完成实际操作。任务包括查找、提取、求和、计数、计算、修改、删除、高亮、整理和展示结果等,都是用户日常处理表格时会遇到的工作。它的题目来自真实 Excel 论坛,共包含 912 个真实问题和 2,729 个测试用例
6月期间,飞书多维表格 Data Analysis Agent 在 SpreadsheetBench V1 Verified 子榜中以 96.50% 准确率排名第一,该榜单为经过人工校验后、更清晰、可自动评分的评测子集,可以更可靠地评测 Agent 效果。这意味着,面对真实工作里的复杂表格,飞书多维表格 AI 不只是能“看懂”,还更能稳定地完成操作:比如定位数据、处理格式、完成计算、整理结果,并且在数据变化后依然保持可靠。对用户来说,它能减少手动写公式、反复筛选和核对的成本,让 AI 更像一个真正能上手处理表格任务的数据分析助手。
250px|700px|reset
飞书多维表格,为团队配备专业的 AI 数据分析师
目前,飞书多维表格已成为许多团队的业务底座,沉淀着线索、订单、项目、库存、回款、目标等关键数据。过去,这些数据需要专人筛选、计算和分析,才能转化为业务判断。
如今,飞书多维表格已经推出智能体,用户可以基于正在使用的多维表格创建团队共用的 AI 智能体。同一个智能体可以与多名团队成员协作,团队成员可以直接用自然语言与智能体协作,由飞书多维表格智能体完成数据检索、指标计算、表格操作和深度分析,并形成分析报告与业务建议。
从复杂表格数据问答,到多源业务信息分析,再到真实电子表格操作,三项评测从不同维度验证了飞书多维表格 AI 处理真实业务数据的能力。未来,飞书多维表格将持续提升 AI 底层能力,使其更准确地理解业务数据结构、处理真实数据并完成专业分析,让沉淀在表格中的业务数据释放更大价值。
















