AI万址
无问芯穹

无问芯穹

无问芯穹是M×N异构算力运营商,连接多种大模型与多种芯片架构。提供大模型API服务、GPU极值算力、ComfyUI云端托管和Agent平台。4090低至0.99元/卡时,支持华为昇腾等国产芯片,适合大模型开发团队、AIGC内容公司和需要国产算力替代的企业。

无问芯穹
访问官网
基本信息详情
开发公司北京无问芯穹科技有限公司(Infinigence AI)
上线时间2023年5月成立,智算云平台同年上线
官网https://cloud.infini-ai.com/
支持平台网页端控制台 + API + 私有化部署
价格新用户送百亿tokens免费额度;4090极值算力0.99元/卡时;按量付费
核心定位大模型时代算力运营商,连接多种模型与多种芯片的M×N异构云平台

你训练一个大模型,发现卡不够用,或者卡太贵买不起。无问芯穹干的就是把这件事变便宜。它的核心思路叫"M×N"--M种大模型算法跑在N种芯片上,把英伟达、华为昇腾、天数智芯这些不同架构的算力统一起来调度。说白了,不管你手上的卡是哪家产的,在它这儿都能跑同一套模型。

公司2023年5月在北京海淀注册成立,创始团队来自清华大学电子工程系教授汪玉课题组。注册资本2.6亿,2024年员工113人,2025年拿到国家级高新技术企业认定。规模不算大,但在AI基础设施这个赛道里跑得很快--已经在全国26个城市、53个数据中心纳管了超过25000P算力,和AMD中国、上海算法创新研究院都签了合作。

我们实际用过它的Infini-AI Cloud平台,感受最深的一点是价格确实压得下来。4090极值算力0.99元/卡时,训练10小时不到10块钱,这在国内市场基本是地板价了。代价是企业闲置GPU资源,稳定性靠"中断秒起新机器"的技术兜底方案来保证--不是没有中断,而是中断了能快速续上。对赶deadline的课题组和小团队来说,这个性价比很难拒绝。

核心功能

大模型服务平台(GenStudio) 这是平台的核心模块,MaaS模式。你可以在模型广场里选20多个主流大模型,通过Chat Completions API直接调用。支持M×N模式--同一套API可以跑在不同芯片上,不用关心底层是NVIDIA还是昇腾。微调和模型服务也在这里,从开发到部署一站搞定。

ComfyUI工作流平台(ComfyStack) 把ComfyUI搬到云端,一键托管,支持企业级生产API。Mootion、森马这类客户用它做AI内容生产,免运维、弹性扩缩容、异常自动告警。做AIGC图视频生成的团队会重点关注这个模块。

智能体服务平台 基于下一代Agentic Infra构建,提供开箱即用的垂类Agent模板和协作框架。这是平台比较新的模块,面向想把Agent落地到业务流程里的企业。

极值算力 基于企业闲置GPU的弹性算力服务。4090、A100、A800、H800都有,H100在陆续加入。按量计费,用多少算多少,中断秒级续接。适合临时训练任务和模型验证。

多元芯片适配 这是无问芯穹的技术护城河。华为昇腾910B、天数智芯、燧原科技、摩尔线程、沐曦集成电路--这些国产芯片在平台上都能跑。在中美算力脱钩的大背景下,这个能力是刚需。

AICoder 内置的AI代码助手,从控制台首页就能进入。写训练脚本、调API的时候能用上。

适合谁

大模型开发团队和课题组。 需要弹性算力、预算有限的高校和研究机构是极值算力的核心用户。0.99元/卡时的价格配合中断续接方案,比自建集群划算太多。

AIGC内容生产公司。 ComfyStack把ComfyUI做成云端托管服务,免运维、弹性扩缩容,适合做图视频批量生成的团队。

需要国产算力替代的企业。 政策要求或供应链风险下必须用国产芯片的企业,无问芯穹的多芯片适配能力是目前市场上最全的之一。

模型公司。 从训练到推理到部署,需要和业务增速匹配的弹性算力方案。平台支持私有化部署,对数据安全要求高的场景也能覆盖。

同类竞品对比

维度无问芯穹AutoDL阿里云PAI火山引擎
核心定位M×N异构算力运营商GPU租赁平台云厂商AI开发平台云厂商AI服务
国产芯片支持昇腾/天数/燧原等5+不支持昇腾昇腾
极值算力价格4090低至0.99元/卡时4090约1.8元/卡时按云实例计费按云实例计费
ComfyUI托管有(ComfyStack)需自行搭建需自行搭建
模型API服务20+模型M×N部署
私有化部署支持不支持支持支持

AutoDL便宜但没有模型平台和异构能力。阿里云和火山引擎功能全但贵,且绑定自家生态。无问芯穹胜在异构算力调度和国产芯片适配,价格在极值算力场景下有竞争力。短板是品牌知名度和生态规模不如大厂。

FAQ

A

极值算力稳定吗?训练中断了怎么办? 极值算力用的是企业闲置资源,确实可能中断。平台提供技术兜底--中断后秒起新机器,任务自动续接。不保证零中断,但保证数据不丢、任务能续。对稳定性要求极高的生产环境,建议用标准算力而非极值算力。

A

支持哪些模型? GenStudio支持20+主流大模型,包括开源LLM、图像和视频模型。具体模型清单在模型广场查看,支持通过API调用或微调。你也可以上传自己的模型。

A

新用户的免费额度有多少? 注册后送百亿tokens免费配额,可以用来体验模型API服务。GPU算力方面,平台经常和Datawhale等社区搞联合活动,会发算力券。

A

能私有化部署吗? 可以。智算云平台支持私有化部署,适合对数据安全有要求的企业和机构。联系商务团队谈方案。

A

和AutoDL比哪个划算? 单看4090价格,无问芯穹的极值算力0.99元/卡时比AutoDL便宜近一半。但AutoDL胜在稳定性和易用性。如果你需要模型API服务、ComfyUI托管、多芯片适配这些能力,无问芯穹是更全面的选择。

更新动态

近半年最密集的动作在专利布局上--混合专家模型分布式训练的通信方法、并行训练策略在线切换、基于Kubernetes的调度方案,一批发明专利集中公开。同时中标了联通广东的产业互联网项目,说明在政企客户拓展上有实质进展。

客户评论

公开渠道暂无第三方评分平台的聚合评价。以下整理自官方客户案例和社区反馈:

"通过ComfyStack托管ComfyUI工作流,我们不用再管机器运维,稳定性比自建高很多,弹性扩缩容在流量高峰时特别有用。"--Mootion(AI内容创作公司)

"4090极值算力0.99元/卡时,对学生党太友好了。中断过一次但自动续上了,没丢数据。"--Datawhale社区用户

"我们基于3000卡沐曦国产GPU集群,百亿参数模型训练600小时不间断,无问芯穹的异构调度能力是关键。"--上海算法创新研究院合作反馈

"模型API的M×N模式确实方便,同一套代码不用改就能切芯片。不过文档还需要更完善。"--开发者社区用户

参考来源