在算力和参数被巨头垄断的AI赛道上,中小型科技企业该去哪找生存空间?一家珠海企业正用自身的实践证明,不拼大参数,靠扎根细分场景的里寻“硬需求”,同样能穿过市场竞争的窄门。
随着越来越多中国企业扬帆出海,跨境电商、跨境文旅、海外数字化服务等场景遍地开花,市场对本地化AI能力的需求正以前所未有的速度攀升。然而,小语种优质训练数据的严重短缺,正成为制约这一进程的关键瓶颈——直接套用英文或中文大模型进行翻译,不仅语言习惯与本地文化格格不入,更面临严峻的数据出境合规风险。
这也顺势砸出了一块被忽视的硬需求。深绎未来科技(广东横琴)有限公司(以下简称“深绎未来”)将目光投向小语种人工智能赛道,从解决优质训练数据不足这一基础问题入手,搭建覆盖数据生产、模型训练和行业应用的技术体系。
目前,深绎未来主打高质量多模态数据集、小语种主权大模型、行业智能体全栈业务,旗下全资子公司深译信息科技(珠海)有限公司成立于2018年,是国家高新技术企业、专精特新中小企业、瞪羚企业、珠海市新质生产力企业。
“通用大模型赛道已经挤满了人,小语种虽然偏,但需求真实存在。”深绎未来创始人兼CEO林余楚说。
深绎未来做的第一件事是建设高质量数集评建一体平台——“深数工场DeepData Factory”,平台约500个AI技能模块矩阵及“研建用评”体系,构建国内首个“采标洗测用”五位一体全闭环数据生产平台。目前沉淀的数据覆盖17个行业,部分数据资产拿到了全国首批数据资产登记证书。
有了数据基石,再训练模型。公司自研的“深绎未来葡语大模型”是国内第一个面向葡语系国家并通过国家网信办备案的大模型。基于模型能力,公司进一步开发面向具体行业场景的智能体应用,精准赋能跨境贸易和文旅客户。
这套“数据—模型—应用”的闭环流程,可以复制到任何一个新的小语种国家。林余楚介绍,依托珠琴澳协同区位优势,深绎未来打通了跨境数据合规运营通道,面向葡西语系及“一带一路”共建国家,打造“一国一模型、模型带应用”的规模化扩张模式。2026年上半年,深绎未来营业收入增长率同比达400%,增长势头强劲。
“未来我们将持续深耕底层数据技术与小语种主权大模型研发,坚持技术自主可控,持续丰富智能体落地场景。”林余楚表示。
南方+记者 张紫微