
智东西8月27日报道,昨日,北京AI基础设施创企博伦智汇宣布完成千万级天使轮融资。本轮融资由专注AI及AI Infra赛道、同时布局过大模型训练框架的一线产业基金投资。本轮资金将主要用于核心技术迭代、产品打磨、核心技术团队扩充,加速公司在AI算力产业的市场拓展与业务落地。博伦智汇2026年4月成立于北京,是一家专注于大规模异构算力调度的人工智能基础设施公司,业务覆盖企业私有化算力部署与自营Token工厂,入口级智能硬件产品也在研发之中。博伦智汇CEO刘进治毕业于浙江大学,硕士毕业于墨尔本大学市场营销专业,曾任职于英特尔、摩托罗拉并担任团队负责人,推动硅谷分布式系统软件公司WANdisco在中国落地。公司CTO杨光曾任职于西门子、IBM、Oracle等跨国企业,此前担任矩量无限技术负责人、技术副总裁,主要研究云原生、AI基础设施和国产异构算力调度。▲博伦智汇CEO刘进治(图源:中关村区块链产业联盟)
博伦智汇团队成员覆盖算力产业链的多个环节,核心团队成员背景包括天数智芯、华为、趋动科技等企业,在云原生容器、大模型训练与推理全栈技术领域拥有多年实战经验。博伦智汇称,2016 年,团队核心成员在清华系NLP创业团队中开展自然语言处理的AI落地探索;2023年,团队操盘国内第一批英伟达SuperPOD训练集群,SuperPOD是由多台英伟达DGX服务器组成的大规模AI计算集群,主要用于大模型训练。此后随着国产算力崛起,团队又在早期进入国产GPU生态与技术体系,在英伟达与国产卡的协同调度上积累了大量一线工程经验。公司自研了面向Token的大规模分布式架构TOLD(Token-Oriented Large-scale Distributed Architecture),该技术栈已在由英伟达GPU和国产GPU组成的万卡级异构集群中完成实际验证。TOLD主要面向大模型推理场景,能够对分布在不同地区、采用不同芯片架构的算力资源进行统一管理和调度。系统可以根据不同模型在不同芯片上的运行效率分配任务,使多种GPU在同一框架下协同工作,同时提供大模型一键适配和B2B2C多租户服务能力。当前,不同品牌和型号的GPU在计算能力、软件生态、算子支持及适用模型方面存在差异。企业在接入国产GPU时,往往需要重新进行模型适配和推理引擎优化。博伦智汇希望通过统一的调度和适配层,降低不同GPU接入及模型迁移的成本,并提高算力集群的整体利用率和Token产出效率。目前,博伦智汇已经启动商业化,业务覆盖企业私有化部署和自营Token工厂。企业私有化部署主要面向拥有自建算力资源的客户,通过异构算力调度、模型适配和推理服务,提高现有GPU集群的使用效率;自营Token工厂则将底层算力转化为Token服务,为企业和AI应用提供推理能力。博伦智汇还在研发入口级智能硬件产品,希望连接云端、端侧和家庭场景。公司认为,随着端侧算力进一步进入家庭,智能硬件将成为用户调用云端及本地AI能力的重要入口。随着GPU产品持续迭代,市场中还将长期存在不同品牌、代际和性能水平的算力卡。博伦智汇计划根据芯片性能、模型特点和任务需求进行梯级调度,让高性能GPU承接高并发、低延迟任务,将部分批量推理及低负载任务分配给其他算力资源,提高不同代际GPU的利用效率。
博伦智汇成立仅4个月便完成千万级天使轮融资,并将自研异构算力调度技术推进至万卡级集群验证和商业化阶段。完成本轮融资后,公司将继续投入异构算力调度、大模型推理及相关基础设施产品。随着AI算力重心逐渐从集中训练延伸至持续推理,企业关注的重点不再只是拥有多少张GPU,还包括这些GPU能否稳定运行、适配更多模型,并以更低成本产出Token。博伦智汇下一阶段需要验证的,是其调度架构能否在更多芯片、模型和客户环境中稳定复制,并持续改善GPU利用率和Token生产成本。9月20-21日,智东西主办的2026全球AI芯片峰会将在上海举行,设有开幕式,大模型AI芯片、Agent推理芯片、具身智能芯片3场高峰论坛,以及Token工厂异构混训混推、超节点、AI芯片架构创新、新型存储器、大模型KV Cache5场技术研讨会。
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。