在华为 Inspire 盛会上,北京百行数智科技有限公司受邀展示面向大模型与具身智能的数据解决方案。围绕数据采集、数据标注平台、私有化部署、域内数据标注和 VLA 模型训练,百行数智希望帮助企业缩短数据构建周期,提升模型训练效率,加快工业场景落地。
当前,大模型和具身智能正在从通用能力竞争,转向行业落地竞争。对制造业、能源和机器人企业而言,真正的难点已不再是“有没有模型”,而是“有没有高质量、可持续、可复用的数据”。数据分散、标注周期长、敏感数据不出域、行业知识密度高,成为制约模型效果和规模化应用的核心问题。
围绕这些痛点,百行数智形成了覆盖“数据采集—工具链建设—域内标注—模型训练”的全链路能力。公司已积累上千个成品高质量数据集,覆盖文本、图片、音频、视频等多模态数据;同时支持私有化部署,满足企业数据不出域的合规要求。依托专业算法团队与跨学科标注人才,百行数智能够针对客户需求,在 1—2 个月内完成从数据采集到标注的全流程交付。
在落地效果上,百行数智的数据解决方案已在多个行业项目中验证价值。服务 MiniMax 时,帮助其构建题库与法律垂类高质量数据集,模型效果提升 27%,成本下降 16%;服务商汤科技时,助力多模态能力提升 35%;服务国家电网时,完成电力垂直大模型定制,模型效果提升 19%。在制造业领域,公司还为苏州汇川等客户提供 PLC 大模型、具身数据采集和工具链平台支持,进一步推进工业智能化。
截至目前,百行数智已服务字节、智谱、商汤、MiniMax、面壁、阶跃、中国石油、国家电网、苏州汇川等众多客户,并覆盖国内 50% 以上的具身智能公司。随着工业智能化、机器人智能化需求持续上升,百行数智正围绕高质量数据集建设与模型定制训练,持续夯实面向产业落地的数据底座。
关于北京百行数智科技有限公司 北京百行数智科技有限公司成立于 2024 年,总部位于北京,在上海、深圳设有分公司,业务覆盖全国。公司聚焦人工智能数据解决方案,围绕数据采集、数据标注平台、私有化部署、领域数据集构建和模型训练,为大模型、制造业、能源及具身智能企业提供高质量数据服务。