在华为Inspire盛会上,百行数智展示了面向大模型、制造业与具身智能场景的高质量数据解决方案。公司围绕数据采集、工具链建设、域内标注到VLA模型训练,打通从数据到模型的全链路,帮助客户缩短数据构建周期、提升模型效果,并支持私有化部署,满足数据不出域要求。
当前,具身智能和大模型正在从“模型竞争”转向“数据竞争”。对制造、能源和机器人企业而言,真实场景数据稀缺、专业标注人才不足、跨场景数据标准不统一,已成为模型落地的主要瓶颈。围绕这一行业痛点,百行数智持续完善高质量数据集生产能力,并将能力延伸至工业、能源与机器人场景。
据了解,百行数智已积累上千个成品高质量数据集,覆盖文本、图片、音频、视频等多模态数据;在大模型领域,已服务字节、智谱、商汤、MiniMax、阶跃、面壁等国内80%的大模型公司;在具身智能方向,已覆盖国内50%以上的具身智能公司。公司可在1—2个月内完成从数据采集到标注的全过程,帮助客户更快完成定制化数据构建。
在落地实践中,百行数智的数据方案已进入多个产业场景。以苏州汇川为例,公司为其PLC大模型训练构建了高知识密度知识库,并同步推进具身数据采集与标注;在国家电网项目中,百行数智帮助建立通用数据集和电力专用数据集的数据配方,完成电力垂直大模型定制,模型效果提升19%。此外,服务MiniMax期间,相关模型效果提升27%,成本下降16%;服务商汤科技时,多模态能力提升35%。
作为全国数标委成员单位、信通院人工智能标准化技术委员会成员单位,百行数智持续参与数据行业与人工智能标准制定。公司表示,未来将继续面向大模型、制造业和具身智能企业,提供更高质量、更高效率的数据解决方案,推动AI在工业场景加快落地。
关于百行数智
北京百行数智科技有限公司成立于2024年,总部位于北京,在上海、深圳设有分公司,面向大模型、制造业、能源和具身智能企业提供数据标注、高质量数据集构建、模型训练等解决方案,服务客户超过500家。