8月28日,本原智数首届生态发布会在贵阳举行。本原智数创始人李逆勇与来自政产学研各界的嘉宾代表共同出席。作为港股上市公司千百度(01028.HK)旗下全赛道专业数据服务商,本原智数现场发布了面向未来五年的“双十亿计划”,并首次集中亮相原测OriginBench、原识OriginWise、原智OriginFlow、原物OriginPhysis四大自研平台。

在人工智能产业从“数据规模”竞争转向“数据质量”竞争的关键节点,这场发布会不仅是一次企业战略升级,也被业界视为中国AI数据服务向高价值环节跃迁的标志性事件。
AI产业进入“数据质量”决胜阶段
“模型进化真正的瓶颈,正在从‘有没有数据’,转向‘有没有足够好的数据’。”李逆勇在演讲开篇即抛出这一判断。据相关研究,截至2025年,互联网公开高质量文本数据已消耗超过70%,传统数据红利逐渐见顶。当大模型、智能体、世界模型和具身智能持续演进,AI对数据的需求已发生根本性变化——通识数据决定模型的下限,专家数据才真正触碰智能的上限。

公开资料显示,本原智数是一家以高质量AI数据为核心的数据服务企业,业务覆盖大模型、智能体、具身智能等领域。李逆勇将公司过去十年的发展概括为三次进化:第一次是从“按图施工的施工队”走向数据标准共建者,与客户共同定义评测体系和交付流程;第二次是从通识数据建设者走向专家数据引领者,将医疗、金融、法律、代码等领域的专家隐性知识沉淀为AI可学习的数据资产;第三次则是从小样本尝试走向规模化供给,通过“三梯队交付体系”让高质量数据具备产业化供给能力。
据报道,本原智数年均标注量已达数亿级,核心项目交付及时率100%,质量达标率98%以上,并蝉联2024、2025语料风云榜十佳企业。依托港股数据标注第一股千百度的上市平台与稳健现金流,本原智数得以在技术与产能上坚持长期主义投入,同时保持战略中立——不做模型,只做客户的数据伙伴。
“双十亿计划”重构高质量数据供给
面对AI从“理解信息”走向“理解世界”、从数字交互走向物理交互的趋势,本原智数在发布会上正式推出“双十亿计划”。其中,“双十亿计划1.0——高质量数据集计划”提出,未来五年重点建设两类核心数据资产:一是十亿条专家轨迹数据,面向金融、医疗、法律、代码等数字信息交互任务,将人类专家的决策过程转化为可量化、可复用的数据资产;二是十亿小时具身操作数据,面向居家、办公、物流等物理场景交互任务,通过多本体遥操采集与仿真校准技术,为具身智能提供大规模、高保真的闭环交互数据。

“这不仅仅是数据数量上的‘十亿’,更重要的是沉淀为真正具有训练价值、评测价值和产业价值的高质量数据资产。”李逆勇强调。为支撑这一目标,“双十亿计划2.0——生态计划”同步启动:本原智数将以贵阳为核心,面向全球招募100个千人级核心数据生态伙伴,推动生态伙伴年总产值达到100亿元。贵阳作为国家大数据综合试验区核心区,兼具数据要素市场化配置改革试点、绿色数据中心集群及综合成本优势,正加速形成从数据标注、AI训练到智能终端的完整产业链条。本原智数希望以此为枢纽,让数据从分散的项目变成持续生长的产业生态。
“四大平台”打通数据服务全链路
据了解,与“双十亿计划”同台亮相的四大平台,构成了本原智数“评测—生产—落地”的数据服务闭环。原测OriginBench作为AI全生命周期测评平台,覆盖模型、智能体、AI应用的全链路多维评测,能精准界定能力边界、识别数据短板,将“AI能力提升”反向转化为“高质量数据集建设”需求。原识OriginWise是面向专家的Harness平台,汇聚10万+行业专家,通过众包触达、标准化工序拆解与AI工具提效,实现专家数据的高效规模化生产。
在应用落地端,原智OriginFlow聚焦智能体全栈运营,支持从0到1构建与模块化组装,打通业务数据向能力燃料转化的闭环;原物OriginPhysis则是一站式具身智能平台,覆盖多本体采集、全流程闭环加工到规模化落地,实现从实验室到真实场景的无缝衔接。
四者协同,意味着本原智数不再只是数据的“加工方”,而是能为客户提供“测评定义需求、专家生产数据、智能体落地应用、具身智能验证”的端到端基础设施。
“模型会迭代,架构会演进,算力会不断提升,但所有智能的成长,都离不开对世界经验的学习。”李逆勇在发布会尾声表示,“我们希望通过‘双十亿计划’和四大平台,与更多伙伴一起,把人类知识、经验和智慧转化为AI能够学习的高质量数据,以人类之智识,探索通用人工智能之边界。”
这场贵阳发布会,既是一次战略宣言,也是一份面向未来的行动地图。当数据从“原料”升维为“资产”,本原智数正试图为中国AI产业写下新注脚——而这条路,已启程。












