应用开发开发教程
在应用中调用模型
在应用中调用模型:沿用平台当前公开 SDK 合同,区分本地模拟、联网调试与正式运行。
应用必须把当前请求的 session 显式传入调用客户端。推荐在一次请求范围创建轻量包装,但复用进程级 httpx.Client 连接池:
import httpx
from jusp_sdk.runtime import RuntimeHttpClient
pool = httpx.Client(
trust_env=False,
limits=httpx.Limits(max_connections=100, max_keepalive_connections=20),
)
def expand_text(session, text: str):
client = RuntimeHttpClient(
session=session,
client=pool,
)
return client.chat_completions({
"messages": [{"role": "user", "content": text}],
})
def optimize_prompt(session, prompt: str, request_id: str, model: str):
client = RuntimeHttpClient(
session=session,
client=pool,
)
return client.optimize_prompt({
"clientRequestId": request_id,
"model": model,
"generationMode": "t2i",
"originalPrompt": prompt,
"mediaSpec": {"orientation": "square", "imageCount": 1},
"referenceInputs": [],
})常用快捷方法:
| Python 方法 | 运行操作 |
|---|---|
services(**filters) | 查询可调用服务 |
openapi() | 读取本地/公网 OpenAPI 合同 |
models() | 查询调试模式可调用模型别名 |
voices() / voice(id) | 查询调试模式音色目录与详情 |
preview_admission(payload) | 调试模式预检媒体请求,不创建任务 |
chat_completions(payload) | 文本/多模态对话 |
embeddings(payload) | 向量化 |
rerank(payload) | 重排 |
ocr(payload) | OCR |
audio_transcriptions(payload) | 语音转写 |
optimize_prompt(payload) | 提示词优化,使用公开 model 别名并要求 clientRequestId |
upload_input_asset(...) | 调试模式上传短期输入素材 |
get_job(...) | 查询异步任务 |
head_asset(...) / download_asset(...) | 检查并读取调试结果素材 |
request(method, path, ...) | 调 SDK 允许的 v2 路径 |
本地模拟和联网调试额外支持 image_generation、video_generation、audio_generation 和 document 快捷方法;正式应用的异步媒体统一使用 create_job。