锐意创新 · 敏锐洞察 · 锐不可当

觅蜂科技两年攒一亿小时数据背后:一场亏本收数据的众包实验

一台头戴设备,三个鱼眼相机,操作者反复叠衣服、擦桌子,每小时报酬12元。这是觅蜂派平台上数采众包者的日常。觅蜂科技成立于2026年2月,由智元控股,定位具身智能无本体数据服务商,董事长姚卯青同时是智元合伙人、具身业务部总裁。

希鸥网观察到,这个赛道正陷入一场荒诞的军备竞赛。全球有效具身数据仅几十万小时,行业公认要达到GPT-3.5级别的泛化能力,需要一亿小时量级。觅蜂科技声称截至8月31日已采集百万小时无本体有效数据,第20000套MEgo设备下线,按此进度不到两年就能触达一亿小时。

但数据的量不等于质。纯头显EGO数据有效率仅10%到20%,叠衣服数据早已泛滥,再多几百小时毫无意义。触觉、手部精细动作等关键维度,纯头显根本捕捉不到。数据维度缺失直接制约机器人泛化能力,这是物理世界数据与互联网文本数据的本质差异。

成本结构更是一笔拧巴的账。行业高质量无本体数据每小时卖200到300元,觅蜂众包采集的纯头显数据只卖10到15元,与付给采集者的报酬基本持平。加上设备、审核、存储成本,每收一小时数据都在亏钱。一套头戴加腕部设备成本约2万元,免费发放意味着单台设备沉没成本要靠未来数据服务收入覆盖。

存储成本随数据量线性膨胀。每50小时数据需1.4T存储空间,100小时至少3T。若真达到千万甚至亿级小时,存储账单将指数级上升。觅蜂科技的商业模式底层逻辑是:用众包压低采集成本,用平台聚合第三方数据公司,最终向模型和科研机构提供数据服务。但数据定价权、有效性、独立性问题,每一个都足以动摇这个闭环。

希鸥网认为,觅蜂科技特殊之处在于智元既是控股股东又是潜在大客户。其他本体厂商是否愿意把数据交给一家智元系公司,将决定其第三方平台定位的成色。智元体系内子公司互为客户、互为场景,外部投资方同时是产品客户,增长含金量有待追问。

创业早期最忌把复杂当高级。觅蜂科技团队若在十人规模就搬来大公司那套KPI和矩阵管理,众包业务不可能跑起来。目标清楚、分工明确、反馈及时、激励到位,这四件事做到就及格。管理没有标准答案,适合当下业务节奏的就是好的。

创始人要敢于承认“我不知道”。觅蜂科技的众包模式前无成功先例,Comma.ai在自动驾驶领域的数据众包实验最终转向卖硬件,车队回传数据沦为副产品。如果姚卯青团队不敢直面模式缺陷,用数据量掩盖经济账算不平的事实,决策就会持续偏离理性轨道。

现金流比利润重要十倍。觅蜂科技免费发设备、亏本收数据,账面数据资产再漂亮,银行账户只认现金。创业者必须建立现金流预警机制,保持至少三个月的运营资金储备。数据存储成本每月都在流出真金白银,而数据变现周期可能长达三年以上,中间的资金缺口靠融资填还是靠收入填,决定公司生死。

金鸥品牌榜·2026年度创新案例库开放申报了。免费提报,独立评估,入榜品牌将获得电子版《入榜证明》及年度专题公示,优秀案例可获得深度专访+全平台分发。如需修改或发布文章,请加微信号:sheisceo

阅读量:1531
阅读时间:3分钟