2026年,在华为Inspire盛会上,北京百行数智科技有限公司受邀参会并展示高质量数据集解决方案,面向大模型、具身智能、制造与能源等场景,帮助客户完成数据采集、标注、模型训练与落地应用闭环。
当前,人工智能应用正从通用模型能力竞争,进入行业场景落地阶段。企业普遍面临数据来源分散、标注质量不稳定、行业知识密度不足、数据无法出域、模型训练成本高等问题。高质量数据集已成为大模型效果提升、具身智能泛化能力增强和工业AI落地的关键基础设施。
百行数智数据解决方案围绕“高质量数据集”建设,形成了覆盖文本、图片、音频、视频等多模态的数据生产能力。公司累计沉淀上千个成品高质量数据集,并可在1-2个月内完成从数据采集到数据标注的定制化交付。其数据采集与标注平台支持私有化部署,能够满足客户数据不出域、合规标注和域内质检需求。
在大模型场景中,百行数智已服务字节、智谱、商汤、Minimax、面壁智能、阶跃星辰、上海人工智能实验室等国内头部模型企业。在具身智能方向,公司提出从产线数据采集、工具链建设、域内数据标注到VLA模型训练的全链路方案,覆盖居家、商超、酒店、工厂、物流等多类真实场景,并服务苏州汇川、海尔、越疆、国家电网、中国石油等客户。
从已落地案例看,百行数智为Minimax构建题库、法律垂类等高质量数据集,助力模型效果提升27%、成本下降16%;为商汤科技提供多模态数据集,助力多模态能力提升35%;为国家电网构建通用数据集与电力专用数据集的数据配方,支持电力垂直大模型定制,模型效果提升19%。
在工业与能源场景中,百行数智还为中国石油昆仑大模型构建高分子橡胶配方数据集,提升AI4S垂类能力;为苏州汇川构建PLC领域高知识密度知识库,并提供具身数据采集、标注及工具链平台建设服务,支持工业控制与具身智能场景的数据闭环。
作为全国数据标准化技术委员会成员单位、信通院人工智能标准化技术委员会成员单位,百行数智参与数据行业及人工智能相关标准制定。此次受邀参加华为Inspire盛会,进一步体现了其在高质量数据集、人工智能数据工程和具身智能数据管线方向的行业参与度。
**企业简介:**北京百行数智科技有限公司总部位于北京,并在上海、深圳设有分公司,团队规模200人以上,注册资本1000万元,服务客户超过500家。公司专注于人工智能数据解决方案,面向大模型公司、制造业、具身智能企业和能源企业,提供高质量数据集建设、数据采集与标注、模型训练、具身智能数据管线及私有化部署服务,助力客户提升模型效果、降低训练成本并加速AI场景落地。