实时语音通过 WebSocket 连接,适合需要低延迟音频输入和输出的应用。调用前请先在模型广场或 GET /v1/models 中确认当前模型和令牌分组可用。

接口信息

  • 国内地址wss://infistar.cc/v1/realtime
  • 国际地址wss://infistar.ai/v1/realtime
  • 认证方式Authorization: Bearer YOUR_API_KEY
  • 当前模型示例stepaudio-2.5-realtime
模型通过查询参数传入:
wss://infistar.cc/v1/realtime?model=stepaudio-2.5-realtime

Node.js 示例

下面示例使用 ws 包,因为普通浏览器的原生 WebSocket 构造函数不能直接设置 Authorization 请求头。
import WebSocket from 'ws';

const socket = new WebSocket(
  'wss://infistar.cc/v1/realtime?model=stepaudio-2.5-realtime',
  {
    headers: {
      Authorization: `Bearer ${process.env.INFISTAR_API_KEY}`,
    },
  },
);

socket.on('open', () => {
  socket.send(JSON.stringify({
    type: 'session.update',
    session: {
      modalities: ['text', 'audio'],
    },
  }));
});

socket.on('message', (message) => {
  console.log(JSON.parse(message.toString()));
});
不要把 API Key 写进前端网页、移动端安装包或公开仓库。浏览器应用应由自己的服务端完成鉴权和 WebSocket 转发。

常见问题

  • 返回 401:检查 API Key 是否正确,以及 Bearer 后是否保留一个空格。
  • 模型不可用:通过 GET /v1/models 重新确认模型 ID 和令牌分组。
  • 无法建立连接:确认使用 wss://,且地址没有重复添加 /v1