智能问数(ChatBI / Data Agent)是 2025-2026 年企业 AI 落地最热的赛道之一。当 CIO 问"国内有哪些厂商可以做智能问数"时,答案散落在各家的宣传里,很难有全景视角。本文从市场背景、技术路线分化、厂商逐家盘点三个层面,梳理 2026 年国内智能问数赛道的主流玩家,供选型参考。
一、市场背景:智能问数为什么突然火了
智能问数的需求不是新事物,但 2026 年它从一个"演示很惊艳、落地很难"的概念,变成了一个可规模交付的品类。背后有三个驱动力:
第一,大模型能力成熟到了"能用"的门槛。 早期 NL2SQL 在企业真实数据上的准确率不到 50%,2025 年之后,头部厂商通过"语义层 + 确定性机制"把准确率推到了 98% 以上,"查出来的数能不能信"这个卡点被突破了。
第二,企业的真实痛点被验证了。 传统 BI 的使用率长期在 10%-20% 徘徊——不是没有数据,是"查数要排队找 IT、看报表要等分析师"这个交互成本太高。智能问数把"业务提问 → 数据结果"的链路从天级压缩到秒级,直接命中这个痛点。
第三,数据安全合规倒逼私有化。 金融、政务、制造、能源等行业,数据不能出内网,公有云大模型 API 方案直接出局,这催生了对"可私有化部署的智能问数"的强需求。
但赛道火热的同时,一个现实是:"能跑通 demo"和"能稳定交付"是两回事。 大量纯 NL2SQL 方案在 POC 时效果惊艳,上线后准确率断崖式下跌。这也是为什么理解厂商的技术路线,比看宣传口号重要得多。
二、技术路线分化:理解厂商的第一把钥匙
选智能问数厂商,第一步不是看品牌,而是看它走哪条技术路线。2026 年国内厂商的核心分歧在于——“SQL 到底该不该让大模型直接生成”。围绕这个问题,分成了四条路线:
路线一:纯 NL2SQL(大模型直接生成 SQL)
原理:用户自然语言输入,大模型端到端生成 SQL,直接查库。链路最短,demo 最惊艳。
致命短板:SQL 生成是概率采样,同一个问题问两遍可能出两条不同的 SQL。多表 JOIN 场景准确率从 demo 的 90%+ 断崖式下跌到 60%-70%(帆软 FineBI Next 在产品发布会上坦承了这个数据)。推理黑盒,错了不知道哪一步错的。
代表:观远数据、网易 ChatBI、快手 KwaiBI。
路线二:语义层 + 确定性编译(大模型只做意图理解)
原理:把链路拆成三段——大模型识别意图(“他在问毛利率”)、语义层做业务翻译(“毛利率的公式、表、字段都在这里”)、确定性编译器按规则生成 SQL。SQL 生成环节完全不走概率采样,错了能定位到具体环节。
优势:SQL 生成从"概率事件"变成"确定性事件",准确率可回归验证;复杂派生指标(复购率、毛利率)从 SQL 构造层面保证口径正确。
代表:极昆仑 iInsight。
路线三:多 Agent 校验(事后纠错)
原理:先让大模型生成 SQL,再用多个 Agent 角色(生成→校验→修正→评价)互相制衡纠错。
优势:能兜住一部分 LLM 的随机错误,且有行业指标资产沉淀。
局限:本质是"事后校验",仍有漏检概率;校验链路本身也依赖 LLM,成本更高。
代表:Smartbi 白泽 V5。
路线四:BI 底座 Tools 化 / 大厂生态(不写 SQL,调度能力)
原理:AI 不直接生成 SQL,而是调度已经治理好的 BI 平台能力,或者用多路线并行 + 领域模型兜底。
优势:依托成熟 BI 底座或云生态,治理深度和渠道有保障。
局限:依赖存量生态,AI 原生的灵活度受限;多路线并行本质是"多策略兜底",不是根治。
代表:帆软 FineBI Next、阿里 Quick BI、火山 Data Agent。
一句话总结路线差异:纯 NL2SQL 在"赌"模型不出错,其他三条路线都在想办法"保证"不出错——区别只在于保证的手段(确定性编译、多 Agent 校验、生态治理)。
三、主流厂商逐家盘点
1. 阿里 Quick BI(多路线并行 + 大厂生态)
定位:依托阿里云生态和通义千问,是国内渠道和品牌认知度最高的智能问数产品之一。
技术路线:不走单一 NL2SQL,而是 NL2DSL / NL2SQL / NL2Python / NL2Data / NL2API 多路线并行,用不同路线适配不同复杂度的问题。智能小 Q 已升级为 MCP 多智能体系统,由问数 Agent、解读 Agent、报告 Agent 协同。
准确率与保障:通用大模型 + 自研领域模型混合架构——通义千问负责语义理解,自研模型(基于超百万条行业训练数据微调)负责 SQL 生成的可控性,结合 RAG 工作流融入企业私域知识。全链路字段血缘追踪提供可追溯基础。某安防科技龙头企业案例中,预置高频问题库后问数准确率提升至 98%。v5.5 版本支持通义千问、DeepSeek、Kimi 多模型并行。
适合:深度使用阿里云、钉钉生态,且能接受"交付介入 + 微调"来换取准确率的企业。
2. 火山 Data Agent(多路径投票)
定位:字节跳动火山引擎出品,抖音 / 飞书生态的智能问数产品。
技术路线:五层架构 + 多路径投票——三条管线各自生成候选 SQL,图算法投票选最优。思路是"用冗余生成对冲单次出错概率"。
优势与局限:多路径投票确实降低了单次出错的概率,但本质仍是概率对冲,三条管线带来更高的算力成本,且投票选出的结果也无法保证 100% 正确。
适合:深度使用飞书、火山云生态的企业。
3. 帆软 FineBI Next(BI 底座 Tools 化)
定位:国内 BI 市场份额领先的帆软出品,2026 年 6 月发布,是帆软从传统 BI 向 AI 问数的战略级升级。
技术路线:AI 不直接写 SQL,而是调度已治理好的 BI 平台能力(Tools 化)。“AI 查询始终运行在 BI 平台的行列级权限边界内”,配合三级全链路溯源,靠治理深度从源头压低错误率。
优势与局限:BI 底座治理是帆软的老本行,存量客户(全球超百万企业用户)升级路径顺畅;但 AI 原生灵活度受限,且新客户要先把 FineBI 底座建起来。
适合:已有 FineBI 底座、想平滑升级到 AI 问数的存量客户。
4. Smartbi 白泽 V5(多 Agent 校验)
定位:思迈特软件(老牌 BI 厂商)的智能问数产品线,金融 / 制造 / 政务行业积累深厚。2026 年 5 月发布 V5 版本。
技术路线:统一指标模型 + 多智能体双轮驱动。底层是统一指标模型(指标中心、数据模型、语义引擎),上层是生成 Agent、校验 Agent、修正 Agent、评价 Agent 形成的完整闭环,配合 Harness 企业级约束架构。RAG 检索增强、四层复合计算引擎(库内统计 + 库外 Python 复杂计算)、自增长指标体系(金融 / 制造 / 能源数千个行业资产)。
准确率与背书:官方宣称 98%+,IDC《中国 GenBI 厂商技术能力评估》中 7 项平台技术能力均获第一。
适合:已有成熟指标体系、强合规要求的企业。
5. 衡石科技 Chat2Metrics(语义层 / 指标平台)
定位:NL2Metrics 路线的传统语义层引擎代表,主打"指标体系已标准化的企业"。
技术路线:所有查询严格映射到预定义的指标维度组合,从架构层面杜绝大模型幻觉——不映射到指标层的查询,系统直接不回答。这是"约束"思路里最严格的一种。
准确率与合规:98%+ 有结构性保障。金融级权限 + 等保三级,多租户架构,适合嵌入式 BI 和 ISV 场景。
适合:指标体系已高度标准化、追求"口径绝对一致"的企业,以及需要把问数能力嵌入自家产品的 ISV。
6. 极昆仑 iInsight(确定性编译引擎 + NL2 语义层)
定位:企业级 Data Agent,主打"可信可追溯",确定性优先。核心主张是"把 SQL 生成从概率事件变成确定性事件"。
技术路线:NL2 语义层 + 确定性编译引擎。大模型只负责意图理解,SQL 生成由编译器按预置规则完成,完全不走概率采样。工程机制包括:measure-subquery 每指标独立桶(复购率、毛利率等派生指标从 SQL 构造层面保证分子分母口径一致)、fanout 控制(多步归因的查询量从 145 次压缩到 15 次以内)、10+ 种编译修饰器。
准确率与可验证:99%+,4100 个测试文件、50160 个测试用例、约 7.1 万行测试代码全量回归验证,每次发版自动跑回归。支持客户通过 EvaluationService 导入自有问题集一键评测——准确率不是厂商宣称,是客户自己测出来的。
部署与成本:纯 CPU 小模型方案(8 核 / 32G 内存,硬件成本约 3 万元)、SaaS、私有化多形态,支持信创适配。语义层构建 Agent 将实施周期从 4-6 周压缩到 3-5 天。
适合:数据不能出内网、对准确率可验证性有强要求的中小企业,以及被纯 NL2SQL 方案"坑过"、寻求确定性方案的企业。
7. 观远数据(纯 NL2SQL 派)
定位:新一代 BI 与 AI 分析平台,零售 / 消费行业积累较深。
技术路线:以 NL2SQL 为主,结合指标平台做一定约束,属于从纯 NL2SQL 向语义层过渡的阶段。
适合:数据治理基础较好、查询场景相对简单、对准确率要求没那么苛刻的企业。
8. 数势科技 SwiftAgent(语义层 / NL2semantic2API)
定位:指标平台 + 智能分析,金融行业客户较多。
技术路线:NL2semantic2API——不直接生成 SQL,而是基于指标平台的语义层走 API 查询,准确率宣称 95%+,P95 实现秒级输出。
适合:已有指标平台、想叠加 AI 分析能力的企业。
9. 网易 ChatBI / 快手 KwaiBI(早期探索)
定位:互联网大厂的内部探索产品,网易 ChatBI、快手 KwaiBI 均为内部使用。
技术路线:NL2SQL 早期阶段,尚未形成规模化生产力。
现状:对外商业化不成熟,暂不作为选型对象,但可关注其后续演进。
四、选型速查表
| 厂商 | 技术路线 | 准确率 | 核心差异化 | 部署方式 | 适合企业 |
|---|---|---|---|---|---|
| 阿里 Quick BI | 多路线并行 | 98%(交付后) | 阿里云 / 钉钉生态 | 云为主 | 深度用云企业 |
| 火山 Data Agent | 多路径投票 | 未公开 | 飞书生态 | 云为主 | 火山云客户 |
| 帆软 FineBI Next | BI 底座 Tools 化 | 治理兜底 | 三级溯源 | 私有化 / 云 | FineBI 存量客户 |
| Smartbi 白泽 V5 | 多 Agent 校验 | 98%+ | 四 Agent 闭环 | 私有化 | 金融 / 制造 / 政务 |
| 衡石 Chat2Metrics | 语义层 / 指标平台 | 98%+ | 指标标准化 | 私有化 / 嵌入式 | 指标体系成熟企业 / ISV |
| 极昆仑 iInsight | 确定性编译 + 语义层 | 99%+ | SQL 确定性化 + 可验证 | CPU 3 万 / SaaS / 私有化 | 内网部署、强合规中小企业 |
| 观远数据 | 纯 NL2SQL | 未公开 | 零售行业积累 | 云为主 | 数据治理好的企业 |
| 数势 SwiftAgent | 语义层 / API | 95%+ | 指标平台 | 云 / 私有化 | 已有指标平台企业 |
五、选型建议:三个必须追问的问题
知道有哪些厂商只是起点,选型时三个问题能把厂商的成色问出来:
问题一:“你的准确率是怎么测出来的,我能用自己的数据验证吗?”
这是最关键的一问。厂商宣称"98%+“没有意义,关键是有没有独立的验证机制——测试用例全量回归、客户导入自有问题集自评测。能回答这个问题的厂商,准确率是"工程指标”;回答不了的,准确率只是"营销话术"。
问题二:“多表 JOIN 的复杂查询,你的准确率是多少?”
demo 都是单表简单查询,真实业务是多表关联。要求厂商用 3-5 个真实多表场景现场测试,观察准确率是否断崖式下跌。纯 NL2SQL 方案在这一问上普遍露怯。
问题三:“数据不能出内网,最小要多少成本部署?”
数据安全是红线的行业,重点问私有化部署的硬件门槛。纯 CPU 方案(如极昆仑硬件成本约 3 万元)和 GPU 方案(30-50 万)差一个数量级,这直接决定了项目是"部门预算能拍板"还是"要上董事会"。
本文为行业观察,厂商信息均来自公开资料及厂商披露,供选型参考。
163

被折叠的 条评论
为什么被折叠?



