趁手
预约演示

00能力 · 接口 · 提供方,三层分开

客户有没有显卡都能用的 AIGC 平台

能力写在模型接口上,不写在具体模型和硬件上。客户有显卡就本地跑,没显卡就全走云 API,两者混合也行。同一个工作台,换一份部署配置,能力一行不改。

预约演示
本地出片 restage 换装产线 · 自研产线出品 30s · 720×1280

01这套东西怎么搭的

能力只依赖接口,接口由部署配置指向提供方

  1. 01

    三层分开

    能力是你看到的按钮,接口是能力需要的模型种类(生文、生图、生视频、配音、转写、解析文档、向量),提供方是谁来兑现接口。

  2. 02

    配置指向

    能力只依赖接口,部署时用一份配置把接口指向提供方;换一家云厂商或换一张显卡,只改配置和一个适配器,能力不动。

  3. 03

    三种形态

    同一套能力交付成三种形态:纯 API 版一台普通服务器就能装,单机版装在你自己那台带卡的机器上,混合版本地跑得动的跑本地、跑不动的走云。

  4. 04

    证据在平台层

    AIGC 标识、字体白名单、授权登记,还有每一单花了多少钱或多少 GPU 分钟,都记在平台层,不管这一单是哪个提供方跑的。

接口只有七个

接口 做什么
text.generate 生成和改写文字,含翻译、提示词扩写
image.generate 文生图、图生图、局部重绘
video.generate 文生视频、图生视频、参考图生视频
video.upscale 视频放大
tts.speak 配音,可选零样本克隆声音
asr.transcribe 转写并给出词级时间戳
doc.parse / embed 文档解析和向量化,给文件智能和知识库用

接口不随厂商变。换一家云厂商或换一张显卡,改的是适配器和一份配置,能力一行不改。

02先用它干什么

两件省手的,三件省脑的

省手的是本来要一遍遍做的活;省脑的是本来要坐下来想、要翻资料的活。

省手

  • 商品场景图

    传一张商品图,选场景,一分钟内出四张。

    image.generate

  • 多语配音与字幕

    传中文视频,拿回英文或日文版,原说话人声音,字幕对齐。

    asr.transcribe · text.generate · tts.speak

省脑

  • 文案与话术

    商品描述、直播话术、公众号稿,按品牌口吻三版。

    text.generate

  • 文件智能与知识库

    合同标书出要点风险;公司文件问一句答一句带出处。

    doc.parse · embed · text.generate

  • 手绘讲解片

    传手册或制度文件,出带板书的讲解视频。

    doc.parse · text.generate · image.generate · tts.speak

看完整能力目录 →

03装在哪

同一套能力,三种交付形态

摸底阶段替你选一种,选完就是一份配置的事。

  • 01

    纯 API 版

    没有显卡,或者不想管硬件

    • 一台普通 Linux 主机,2 核 4G 起,你的内网或云上都行
    • 七个接口全部指向云厂商
    • 成本按调用量,平台按单记账

    数据路径素材经过所指定的云厂商。

  • 02

    单机版

    有一台带显卡的工作站或服务器

    • 控制面、worker、本地引擎装在同一台机器
    • 显存决定能跑什么:24 GB 能出视频,16 GB 只出图和配音,视频走云
    • 素材不出公司,这是它的卖点

    数据路径素材不出公司。

  • 03

    混合版

    有显卡但不够用,或者有多台机器

    • 本地 worker 可以多台,云端提供方兜底
    • 接口按需求分流:敏感素材只走本地,通用任务走云
    • 忙时自动溢出到云,闲时全在本地

    数据路径打了「仅本地」标记的接口永不出公司,其余走云的部分经过所指定的云厂商。

三种形态怎么选 →

拿你自己的素材试一次

体验入口用的是访客名额,不用注册。想看全部能力和当场切提供方,约一次三十分钟的演示。

预约演示