模型服务(MaaS)工具 (5 个工具)

阿里云百炼是阿里云推出的一站式大模型服务平台,集成通义千问全系列大模型及DeepSeek、Kimi、GLM、MiniMax等第三方主流模型,涵盖文本生成、图像生成、音视频处理、向量计算等多模态能力。平台旗舰模型包括通义千问Max(262K上下文,输入0.006元/千Token)、通义千问Plus(1M上下文,输入0.0008元/千Token)、通义千问Flash(1M上下文,输入0.00015元/千Token)和通义千问Coder(1M上下文,输入0.001元/千Token)。新用户每个模型可领100万Token免费额度,有效期3个月,覆盖通义千问、DeepSeek、Kimi、GLM等11款以上主流多模态模型。平台采用开通免费、按需付费模式,文本按输入输出Token分别计费,图像按张计费,视频按秒计费。Token Plan订阅服务个人版39元/月起,团队版150元/月起,可灵活调用11款以上多模态模型及智能体工具,夜间调用Qwen3.7系列低至2折。

百度千帆ModelBuilder是百度智能云推出的大模型企业级MaaS平台,提供文心大模型全系列API服务及42+国内外主流大模型统一调用能力,日均调用超7亿次。平台旗舰模型ERNIE-3.5-8K与ERNIE-Speed-8K永久免费,QPS高达50,个人开发和小项目完全够用。新用户每个模型可领100万Token免费额度,覆盖ERNIE-4.5-Turbo、DeepSeek-R1、DeepSeek-V3.1、Qwen3系列、ERNIE-X1-Turbo等主力模型,有效期3个月。文心大模型4.5输入价格仅0.004元/千tokens、输出0.016元/千tokens,约为GPT4.5价格的1%;文心X1输入0.002元/千tokens、输出0.008元/千tokens,约为DeepSeek-R1的一半。千帆V2接口完全兼容OpenAI协议,改两行代码即可迁移。2026年1月百度发布文心5.0正式版,参数达2.4万亿,采用原生全模态统一建模技术。平台内置审计日志、A2A协议、百度搜索工具原生集成,是政务和企业场景的首选MaaS平台。

火山方舟是字节跳动旗下火山引擎推出的一站式大模型服务平台,提供模型能力拓展、专业算法服务、安全可信会话无痕、高并发算力保障四大核心能力。平台主推Doubao-Seed系列模型,包括旗舰Doubao-Seed-2.1 Pro(输入6元/百万token、输出30元/百万token)、Doubao-Seed-Evolving(输入6元/百万token、输出30元/百万token)、Doubao-Seed-2.0系列、Doubao-Seed-1.6系列,同时集成DeepSeek-V4-Pro、DeepSeek-R1、GLM-5.2、GLM-4.7等第三方主流模型。Doubao-Seed-1.6系列采用分段计费,输入长度0-32K时输入0.8元/百万token,输出2-8元/百万token;Doubao-Seed-1.6-flash输入低至0.15元/百万token。平台支持上下文缓存,缓存命中价低至0.03元/百万token,大幅降低重复计算成本。协作奖励计划二期全面升级,免费每日领取单模型最高500万Tokens。方舟CLI上线支持Claude Code、Cursor、TRAE等主流工具,方舟Coding Plan与Agent Plan提供订阅制服务。具备链路全加密、数据高保密、环境强隔离、操作可审计四重安全能力,会话无痕。

华为云MaaS(ModelArts Studio)是华为云推出的一站式大模型即服务平台,定位为企业与开发者的大模型敏捷应用枢纽。平台提供60+业界主流模型基于昇腾AI云服务进行适配,涵盖文本生成、视觉理解、视频生成、图片生成、向量化等多种能力,覆盖99%业界SOTA模型。预置DeepSeek-V4-Flash、openPangu-2.0-Flash、通义千问、GLM、Kimi、Llama等主流开源大模型,均基于昇腾算子与显存优化,模型全、免配置、免调优、性能优。平台提供模型在线体验、模型调用、模型调优、模型部署全栈工具,资源分钟级获取。支持全参微调、LoRA微调、增量预训练,支持将预置模型或调优后自定义模型部署为资源专享推理服务。预置1000+在线部署和本地部署MCP服务,支持零代码创建大模型Agent。统一API和URL入驻三方平台,支持一次对接获取所有模型及应用。已对接OpenClaw、Claude Code、Cursor、Cline、Cherry Studio、Dify、RAGFlow等主流开发工具。

腾讯云混元大模型(Tencent HY)是腾讯公司全链路自研的大模型API服务,为企业客户提供便捷、可靠的大模型推理服务。平台包含腾讯自研的混元大模型系列及优秀的第三方大模型DeepSeek系列,旗舰模型包括Tencent HY 2.0 Think(最大输入128K,最大输出64K,擅长文创、多轮、指令遵循)、Tencent HY 2.0 Instruct(MoE架构快思考模型,文创写作强实用性)、Hy3 preview(代码生成、长上下文与Agent能力扎实)及Hunyuan-large-role(角色一致性深度对话)。混元采用混合专家模型(MoE)结构,推动性能提升和推理成本下降,最大支持256K上下文,大海捞针指标达99.9%。新用户首次开通服务可享文本生成模型共享100万token、embedding模型专属100万token免费额度,1年有效期。支持AI搜索联网插件,整合腾讯优质内容生态和全网搜索。腾讯混元已通过深度合成服务算法备案,中国人工智能发明专利TOP1,服务腾讯会议、腾讯广告、腾讯客服等核心业务。
