FA API · 大模型中转站

一个接口,聚合主流大语言模型。登录后即可创建密钥、调试与查看用量。

FA API
仪表盘
你的中转站使用概览
可用模型
–
聚合多家厂商
API 密钥
–
已创建的密钥
今日调用
–
今天已发起的调用
调用次数
–
累计成功调用
总 Tokens
–
输入 + 输出(服务端精确聚合)

最近调用

时间模型调用密钥Tokens
模型广场
中转站已聚合的大语言模型,全部通过统一接口调用
API 密钥
创建并管理你的 API 密钥,用于标识调用归属与用量统计

我的密钥

名称密钥状态创建时间操作
在线调试
选择模型,即时体验流式对话效果

支持多轮对话,自动携带最近 12 条上下文;回答支持 Markdown 与代码块展示。

发送第一条消息,开始调试
用量记录
每次成功调用的 Token 消耗明细
时间模型调用密钥输入输出合计
我的钱包
积分用于支付模型调用消耗;按模型分档计价(未定价模型 1 积分 / 1000 tokens,单次调用向上取整)
当前余额
–
积分
按模型分档计费未定价模型 1 积分 / 1000 tokens充值码向站长获取余额不足将无法发起调用

🎁 邀请有礼

你的邀请码(新用户注册 7 天内兑换,双方各得 20 积分):

–

↔ 积分转赠

对方 uid 可在「管理后台-用户用量排行」或请对方在钱包页查看

月度账单

月份调用次数Tokens消耗积分
ⓘ 历史月份(分档计价上线前)不记录积分,消耗积分显示为 0

积分流水

时间变动变动后余额说明
知识库
上传资料,对话与智能体会自动检索引用(M12:分词命中率评分排序)

检索测试台

点击选择或拖入 .txt / .md / .pdf / .docx 文件(单个 ≤ 5MB)

文件名分块数大小上传时间操作
智能体
给定目标,自动「计划 → 执行(带工具)→ 反思」;执行期间请保持页面打开

任务进度实时落库,Token 超限自动熔断;反思判定目标达成可提前结束;方向偏离或失败自动重规划。中断的任务可在历史列表中恢复执行。

启动任务后,这里实时展示计划与执行过程

历史任务

接入文档
统一接口规范与调用示例

1. 接口概述

FA API 采用 OpenAI Chat Completions 兼容协议(仅流式),一次接入即可调用模型广场中的全部模型。所有请求经由中转站网关转发,无需自行管理各厂商的 API Key 与地址差异。

# 网关地址(应用发布域名下)
POST /.cloud/llm/chat/completions
Content-Type: application/json

{
  "model": "<模型 ID,见模型广场>",
  "messages": [
    { "role": "system", "content": "You are a helpful assistant." },
    { "role": "user", "content": "你好" }
  ],
  "stream": true
}

ⓘ 首条消息必须为 system;接口仅支持 stream: true。当前版本的鉴权基于应用访问会话(浏览器内自动携带),API 密钥用于调用归属与用量统计;跨域程序化直连需在应用发布域名下进行。

2. 公开 API · 程序化调用(M10)

除网页调试外,FA API 提供 OpenAI 兼容公开接口:任意程序、脚本或第三方工具,使用你的 sk-mh- 密钥即可调用。服务端强制扣费与限流(每密钥 60 次/分钟,可在后台为密钥设置总量/月度配额);密钥支持启停与过期时间。

# 网关地址(与站点同域)
POST https://api123.store/v1/chat/completions
Authorization: Bearer sk-mh-你的完整密钥
Content-Type: application/json

{
  "model": "auto",
  "messages": [
    { "role": "system", "content": "You are a helpful assistant." },
    { "role": "user", "content": "你好" }
  ],
  "stream": true          # true = SSE 流式透传;false 或省略 = 返回完整 JSON(服务端聚合)
}

# 查看可用模型(OpenAI 兼容格式)
GET https://api123.store/v1/models

ⓘ 与 OpenAI SDK 搭配:将 base_url 设为本地址、api_key 设为 sk-mh- 密钥即可。密钥在「API 密钥」页创建(仅创建时展示一次)。调用按模型分档扣积分,流水与月度账单在「我的钱包」可查。

3. 调用示例(JavaScript)

// 使用中转站 SDK
const cloud = WorkBuddyCloud.createWorkBuddyCloud({
  endpoint: 'https://api123.store',
  publishableKey: 'wbpk_H2zD2ouL0iJQR1rEj5gAvF_oYvKVWcuAU2hIw8aCa32zM4RWQX7jER8',
});

const models = await cloud.llm.models.list();   // 拉取模型列表

for await (const chunk of cloud.llm.chat.completions.create({
  model: 'glm-4.6',
  messages: [{ role: 'system', content: 'You are a helpful assistant.' },
              { role: 'user', content: '用一句话介绍你自己' }],
  stream: true,
  stream_options: { include_usage: true },
})) {
  process.stdout.write(chunk.choices[0]?.delta?.content ?? '');
}

4. 能力说明

· 多模型聚合:模型广场实时展示全部可用模型及上下文长度、多模态、推理能力等元信息。

· 统一用量:每次调用返回 usage(prompt / completion / total tokens),可在「用量记录」查看明细。

· 密钥管理:密钥采用 SHA-256 哈希加密存储,完整密钥仅创建时展示一次。

· 积分计费:按模型分档计价(站长在后台为各模型设定单价),未定价模型按 1 积分 / 1000 tokens;余额可在「我的钱包」查看并附月度账单,充值码兑换充值,流水可追溯。

· 多模态:在线调试支持附加图片(需选择支持多模态的模型),实现图片理解对话。

· 智能体:支持单 Agent 与多角色协作两种模式,任务进度落库、中断可恢复、可定时重跑。

· 安全:客户端限流(每分钟 30 次)、数据一键备份导出、暗色模式。