2026年,北京,北京百行数智科技有限公司围绕数据标注平台完成方案升级,面向大模型、具身智能、制造与能源客户提供从数据采集、域内标注到模型训练的数据闭环服务,帮助客户提升高质量数据集构建效率与模型落地效果。
当前,人工智能应用正从通用大模型训练进入产业场景落地阶段。客户对数据的需求呈现多模态、强定制、数据不出域和快速迭代等特征。尤其在制造、能源、具身智能等场景中,数据采集难、标注质量不稳定、行业知识密度不足、模型训练与数据建设脱节,成为影响AI项目落地的关键问题。
围绕上述痛点,百行数智数据标注平台支持文本、图片、音频、视频等多模态数据处理,并可按客户安全要求进行私有化部署,满足数据不出域场景下的采集、清洗、标注、质检和交付需求。公司已累计沉淀上千个高质量数据集,覆盖大模型训练、行业知识库构建、具身遥操数据、EGO数据、UMI数据等方向。针对定制化项目,百行数智可在1至2个月内完成从数据采集到数据标注的全过程,并由算法团队参与数据配方设计、模型训练评估与迭代优化。
在客户落地方面,百行数智已服务超过500家客户,并为字节、智谱、商汤、Minimax、面壁智能、阶跃、上海人工智能实验室等国内头部大模型企业提供数据服务,覆盖国内约80%的大模型公司。在Minimax模型训练项目中,百行数智协助构建题库、法律垂类等高质量数据集,推动模型效果提升27%、成本下降16%;在商汤科技项目中,公司提供多模态数据集,助力多模态能力提升35%;在国家电网项目中,百行数智协助建立通用数据集与电力专用数据集的数据配方,完成电力垂直大模型定制,模型效果提升19%。
在具身智能方向,百行数智提出从入场采集、工具链搭建、域内数据标注到VLA模型训练的全链路解决方案,已在工厂、物流、居家、商超、酒店等场景推进应用。公司与苏州汇川等制造业客户合作,开展具身数据驻场采集、标注与工具链平台建设,帮助客户构建可持续迭代的数据管线,为工业场景机器人学习和本体适配提供基础支撑。
百行数智同时是全国数据标准化技术委员会成员单位、信通院人工智能标准化技术委员会成员单位,参与数据行业及人工智能相关标准建设。公司表示,未来将继续围绕数据标注平台、高质量数据集和模型训练服务,提升AI数据工程能力,帮助更多企业解决行业数据稀缺、标注质量不可控和模型落地周期长等问题。
**企业简介:**北京百行数智科技有限公司总部位于北京,在上海、深圳设有分公司,团队规模超过200人,注册资本1000万元,服务客户超过500家。公司是国内领先的人工智能数据解决方案提供商,面向大模型公司、制造业、具身智能企业与能源行业客户,提供高质量数据集建设、数据标注平台、模型训练和具身智能数据解决方案。公司是全国数据标准化技术委员会成员单位、信通院人工智能标准化技术委员会成员单位,持续参与数据与人工智能行业标准建设。