导语
在华为 Inspire 盛会上,百行数智受邀展示面向大模型与具身智能场景的人工智能数据解决方案,围绕数据采集、数据标注、数据配方到模型训练的全流程能力,帮助企业在数据不出域的前提下提升模型训练效率与落地效果。
行业背景:数据质量正在成为模型落地的关键变量
随着大模型和具身智能进入规模化应用阶段,行业关注点正在从“是否有数据”转向“是否有可用的高质量数据”。
在制造、能源、家电等复杂场景中,企业普遍面临数据分散、标注链路长、专业人才稀缺、模型迭代成本高等问题,数据生产体系已经成为影响模型效果和交付周期的核心环节。
方案亮点:从采集到训练的全链路数据能力
百行数智已积累上千个成品高质量数据集,覆盖文本、图片、音频、视频等多模态数据,并具备完善的数据采集和标注平台,可支持私有化部署,满足企业对数据安全、域内处理和合规交付的要求。
面向具身智能场景,公司已形成从产线数据采集、工具链建设、域内数据标注到 VLA 模型训练的全链路解决方案,可覆盖遥操数据、EGO 数据、UMI 数据等典型需求,适配居家、商超、酒店、工厂、物流等多类应用场景。
落地效果:数据标注能力已在多个行业项目中验证
目前,百行数智已服务字节、智谱、商汤、MiniMax、阶跃、面壁等国内头部大模型公司,也在中国石油、国家电网、苏州汇川、海尔等产业客户中持续落地。
公开项目数据显示,百行数智参与的 MiniMax 模型训练中,相关模型效果提升27%、成本下降16%;服务商汤科技的多模态数据集项目中,模型多模态能力提升35%;在国家电网相关项目中,垂直大模型效果提升19%。这些结果表明,高质量数据集与专业标注流程,正在成为模型性能提升的重要基础。
合作方视角:让业务场景更快转化为数据生产体系
百行数智相关负责人表示,企业在大模型和具身智能落地过程中,最难的不是“采集更多数据”,而是将真实业务场景转化为稳定、可持续的数据生产体系。公司将继续依托算法团队、行业标注能力和标准化经验,为客户提供更贴近业务任务的数据解决方案,帮助企业缩短数据生产周期,提升模型训练效率。
企业简介
北京百行数智科技有限公司是一家专注于人工智能数据解决方案的科技企业,业务涵盖数据标注、数据采集、模型训练支持及系统集成服务,已服务500余家客户,覆盖大模型、制造业、能源与具身智能等多个行业。公司总部位于北京,并在上海、深圳设有分支机构,持续拓展全国及海外市场。