
无问芯穹
无问芯穹是M×N异构算力运营商,连接多种大模型与多种芯片架构。提供大模型API服务、GPU极值算力、ComfyUI云端托管和Agent平台。4090低至0.99元/卡时,支持华为昇腾等国产芯片,适合大模型开发团队、AIGC内容公司和需要国产算力替代的企业。
| 基本信息 | 详情 |
|---|---|
| 开发公司 | 北京无问芯穹科技有限公司(Infinigence AI) |
| 上线时间 | 2023年5月成立,智算云平台同年上线 |
| 官网 | https://cloud.infini-ai.com/ |
| 支持平台 | 网页端控制台 + API + 私有化部署 |
| 价格 | 新用户送百亿tokens免费额度;4090极值算力0.99元/卡时;按量付费 |
| 核心定位 | 大模型时代算力运营商,连接多种模型与多种芯片的M×N异构云平台 |
你训练一个大模型,发现卡不够用,或者卡太贵买不起。无问芯穹干的就是把这件事变便宜。它的核心思路叫"M×N"--M种大模型算法跑在N种芯片上,把英伟达、华为昇腾、天数智芯这些不同架构的算力统一起来调度。说白了,不管你手上的卡是哪家产的,在它这儿都能跑同一套模型。
公司2023年5月在北京海淀注册成立,创始团队来自清华大学电子工程系教授汪玉课题组。注册资本2.6亿,2024年员工113人,2025年拿到国家级高新技术企业认定。规模不算大,但在AI基础设施这个赛道里跑得很快--已经在全国26个城市、53个数据中心纳管了超过25000P算力,和AMD中国、上海算法创新研究院都签了合作。
我们实际用过它的Infini-AI Cloud平台,感受最深的一点是价格确实压得下来。4090极值算力0.99元/卡时,训练10小时不到10块钱,这在国内市场基本是地板价了。代价是企业闲置GPU资源,稳定性靠"中断秒起新机器"的技术兜底方案来保证--不是没有中断,而是中断了能快速续上。对赶deadline的课题组和小团队来说,这个性价比很难拒绝。
核心功能
大模型服务平台(GenStudio) 这是平台的核心模块,MaaS模式。你可以在模型广场里选20多个主流大模型,通过Chat Completions API直接调用。支持M×N模式--同一套API可以跑在不同芯片上,不用关心底层是NVIDIA还是昇腾。微调和模型服务也在这里,从开发到部署一站搞定。
ComfyUI工作流平台(ComfyStack) 把ComfyUI搬到云端,一键托管,支持企业级生产API。Mootion、森马这类客户用它做AI内容生产,免运维、弹性扩缩容、异常自动告警。做AIGC图视频生成的团队会重点关注这个模块。
智能体服务平台 基于下一代Agentic Infra构建,提供开箱即用的垂类Agent模板和协作框架。这是平台比较新的模块,面向想把Agent落地到业务流程里的企业。
极值算力 基于企业闲置GPU的弹性算力服务。4090、A100、A800、H800都有,H100在陆续加入。按量计费,用多少算多少,中断秒级续接。适合临时训练任务和模型验证。
多元芯片适配 这是无问芯穹的技术护城河。华为昇腾910B、天数智芯、燧原科技、摩尔线程、沐曦集成电路--这些国产芯片在平台上都能跑。在中美算力脱钩的大背景下,这个能力是刚需。
AICoder 内置的AI代码助手,从控制台首页就能进入。写训练脚本、调API的时候能用上。
适合谁
大模型开发团队和课题组。 需要弹性算力、预算有限的高校和研究机构是极值算力的核心用户。0.99元/卡时的价格配合中断续接方案,比自建集群划算太多。
AIGC内容生产公司。 ComfyStack把ComfyUI做成云端托管服务,免运维、弹性扩缩容,适合做图视频批量生成的团队。
需要国产算力替代的企业。 政策要求或供应链风险下必须用国产芯片的企业,无问芯穹的多芯片适配能力是目前市场上最全的之一。
模型公司。 从训练到推理到部署,需要和业务增速匹配的弹性算力方案。平台支持私有化部署,对数据安全要求高的场景也能覆盖。
同类竞品对比
| 维度 | 无问芯穹 | AutoDL | 阿里云PAI | 火山引擎 |
|---|---|---|---|---|
| 核心定位 | M×N异构算力运营商 | GPU租赁平台 | 云厂商AI开发平台 | 云厂商AI服务 |
| 国产芯片支持 | 昇腾/天数/燧原等5+ | 不支持 | 昇腾 | 昇腾 |
| 极值算力价格 | 4090低至0.99元/卡时 | 4090约1.8元/卡时 | 按云实例计费 | 按云实例计费 |
| ComfyUI托管 | 有(ComfyStack) | 无 | 需自行搭建 | 需自行搭建 |
| 模型API服务 | 20+模型M×N部署 | 无 | 有 | 有 |
| 私有化部署 | 支持 | 不支持 | 支持 | 支持 |
AutoDL便宜但没有模型平台和异构能力。阿里云和火山引擎功能全但贵,且绑定自家生态。无问芯穹胜在异构算力调度和国产芯片适配,价格在极值算力场景下有竞争力。短板是品牌知名度和生态规模不如大厂。
FAQ
极值算力稳定吗?训练中断了怎么办? 极值算力用的是企业闲置资源,确实可能中断。平台提供技术兜底--中断后秒起新机器,任务自动续接。不保证零中断,但保证数据不丢、任务能续。对稳定性要求极高的生产环境,建议用标准算力而非极值算力。
支持哪些模型? GenStudio支持20+主流大模型,包括开源LLM、图像和视频模型。具体模型清单在模型广场查看,支持通过API调用或微调。你也可以上传自己的模型。
新用户的免费额度有多少? 注册后送百亿tokens免费配额,可以用来体验模型API服务。GPU算力方面,平台经常和Datawhale等社区搞联合活动,会发算力券。
能私有化部署吗? 可以。智算云平台支持私有化部署,适合对数据安全有要求的企业和机构。联系商务团队谈方案。
和AutoDL比哪个划算? 单看4090价格,无问芯穹的极值算力0.99元/卡时比AutoDL便宜近一半。但AutoDL胜在稳定性和易用性。如果你需要模型API服务、ComfyUI托管、多芯片适配这些能力,无问芯穹是更全面的选择。
更新动态
近半年最密集的动作在专利布局上--混合专家模型分布式训练的通信方法、并行训练策略在线切换、基于Kubernetes的调度方案,一批发明专利集中公开。同时中标了联通广东的产业互联网项目,说明在政企客户拓展上有实质进展。
客户评论
公开渠道暂无第三方评分平台的聚合评价。以下整理自官方客户案例和社区反馈:
"通过ComfyStack托管ComfyUI工作流,我们不用再管机器运维,稳定性比自建高很多,弹性扩缩容在流量高峰时特别有用。"--Mootion(AI内容创作公司)
"4090极值算力0.99元/卡时,对学生党太友好了。中断过一次但自动续上了,没丢数据。"--Datawhale社区用户
"我们基于3000卡沐曦国产GPU集群,百亿参数模型训练600小时不间断,无问芯穹的异构调度能力是关键。"--上海算法创新研究院合作反馈
"模型API的M×N模式确实方便,同一套代码不用改就能切芯片。不过文档还需要更完善。"--开发者社区用户
参考来源
- ▸企查查 | 北京无问芯穹科技有限公司企业报告, 企业工商信息、专利和经营动态的权威来源
- ▸无问芯穹官方帮助文档 | 常见QA, 平台功能、计费方式和技术架构的官方说明
- ▸Datawhale CSDN | 提供免费4090!一杯奶茶钱灵活使用主流GPU算力, 无问芯穹与Datawhale联合算力活动的详细介绍
- ▸AI产品库 | 无问芯穹产品档案, 产品体系、技术优势和融资信息的第三方整理
