无限星河AI 不仅提供基础的文本对话,也支持多种主流模型的常用高阶能力。通过合理配置这些功能,您可以提升应用的交互体验与智能化程度。

流式输出

为了实现类似 ChatGPT 网页端的“打字机”效果,建议在请求中使用流式输出。
  • 配置方式:在请求体中设置 "stream": true
  • 技术优势
    • 首字响应快:用户无需等待整个长段落生成完毕即可看到第一行字。
    • 减少超时风险:在生成超长文本时,持续的数据流可以保持连接活跃。
流式输出与非流式输出延迟对比图

图片理解

部分多模态模型可以接收图片并进行分析。请先在模型广场确认模型能力。
  • 实现方式:在 messages 数组中传入 image_url
  • 适用场景:识图答疑、提取发票信息、网页截图分析。
  • 计费说明:图片计费方式由所选模型决定,调用前请查看模型广场。

工具调用

允许模型根据用户需求调用您预设的外部工具(如查询天气、搜索数据库、执行代码)。
  • 流程规范
    1. 在请求中定义 tools 字段。
    2. 模型返回 tool_calls
    3. 您的程序执行工具逻辑后,将结果返回给模型。
  • 优势:让 AI 能够结合外部工具处理实时数据和业务数据,降低单纯依赖模型回答带来的不确定性。
函数调用逻辑时序图

JSON 格式输出

如果您在开发自动化系统,需要模型返回结构化数据而非自然语言,可以使用此模式。 仅在所选模型支持 JSON Mode 时使用。
  • 配置方式
    1. 在请求中设置 "response_format": { "type": "json_object" }
    2. 并在 System Prompt 中明确告知模型:“必须返回 JSON 格式”。
  • 优势:降低代码解析错误的概率。

长度与性能控制

  • Max Tokens:建议根据业务需求合理设置输出长度限制,防止模型因过度发散导致意外的 Token 消耗。
  • Temperature (温度):较低数值通常更稳定,较高数值通常更有随机性。并非所有模型都支持该参数。

模型特定功能

  • 思考模式:仅在模型支持时启用对应参数。
  • 长上下文:上下文长度由具体模型决定,请以模型广场说明为准。
开始开发前先核对API 总览身份认证与权限管理;网关地址与客户端路径请查看API 网关配置规范