Create a response
curl --request POST \
--url https://gateway.omnia-voice.com/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "Qwen/Qwen3-32B",
"input": "<unknown>",
"instructions": "<string>",
"stream": false,
"temperature": 123,
"top_p": 123,
"max_output_tokens": 123,
"stop": "<unknown>",
"seed": 123,
"response_format": {},
"text": {},
"tools": [
{}
],
"tool_choice": "<unknown>",
"parallel_tool_calls": true,
"reasoning": {},
"reasoning_effort": "<string>",
"metadata": {},
"user": "<string>"
}
'import requests
url = "https://gateway.omnia-voice.com/v1/responses"
payload = {
"model": "Qwen/Qwen3-32B",
"input": "<unknown>",
"instructions": "<string>",
"stream": False,
"temperature": 123,
"top_p": 123,
"max_output_tokens": 123,
"stop": "<unknown>",
"seed": 123,
"response_format": {},
"text": {},
"tools": [{}],
"tool_choice": "<unknown>",
"parallel_tool_calls": True,
"reasoning": {},
"reasoning_effort": "<string>",
"metadata": {},
"user": "<string>"
}
headers = {
"Authorization": "Bearer <token>",
"Content-Type": "application/json"
}
response = requests.post(url, json=payload, headers=headers)
print(response.text)const options = {
method: 'POST',
headers: {Authorization: 'Bearer <token>', 'Content-Type': 'application/json'},
body: JSON.stringify({
model: 'Qwen/Qwen3-32B',
input: '<unknown>',
instructions: '<string>',
stream: false,
temperature: 123,
top_p: 123,
max_output_tokens: 123,
stop: '<unknown>',
seed: 123,
response_format: {},
text: {},
tools: [{}],
tool_choice: '<unknown>',
parallel_tool_calls: true,
reasoning: {},
reasoning_effort: '<string>',
metadata: {},
user: '<string>'
})
};
fetch('https://gateway.omnia-voice.com/v1/responses', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));<?php
$curl = curl_init();
curl_setopt_array($curl, [
CURLOPT_URL => "https://gateway.omnia-voice.com/v1/responses",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => json_encode([
'model' => 'Qwen/Qwen3-32B',
'input' => '<unknown>',
'instructions' => '<string>',
'stream' => false,
'temperature' => 123,
'top_p' => 123,
'max_output_tokens' => 123,
'stop' => '<unknown>',
'seed' => 123,
'response_format' => [
],
'text' => [
],
'tools' => [
[
]
],
'tool_choice' => '<unknown>',
'parallel_tool_calls' => true,
'reasoning' => [
],
'reasoning_effort' => '<string>',
'metadata' => [
],
'user' => '<string>'
]),
CURLOPT_HTTPHEADER => [
"Authorization: Bearer <token>",
"Content-Type: application/json"
],
]);
$response = curl_exec($curl);
$err = curl_error($curl);
curl_close($curl);
if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}package main
import (
"fmt"
"strings"
"net/http"
"io"
)
func main() {
url := "https://gateway.omnia-voice.com/v1/responses"
payload := strings.NewReader("{\n \"model\": \"Qwen/Qwen3-32B\",\n \"input\": \"<unknown>\",\n \"instructions\": \"<string>\",\n \"stream\": false,\n \"temperature\": 123,\n \"top_p\": 123,\n \"max_output_tokens\": 123,\n \"stop\": \"<unknown>\",\n \"seed\": 123,\n \"response_format\": {},\n \"text\": {},\n \"tools\": [\n {}\n ],\n \"tool_choice\": \"<unknown>\",\n \"parallel_tool_calls\": true,\n \"reasoning\": {},\n \"reasoning_effort\": \"<string>\",\n \"metadata\": {},\n \"user\": \"<string>\"\n}")
req, _ := http.NewRequest("POST", url, payload)
req.Header.Add("Authorization", "Bearer <token>")
req.Header.Add("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)
defer res.Body.Close()
body, _ := io.ReadAll(res.Body)
fmt.Println(string(body))
}HttpResponse<String> response = Unirest.post("https://gateway.omnia-voice.com/v1/responses")
.header("Authorization", "Bearer <token>")
.header("Content-Type", "application/json")
.body("{\n \"model\": \"Qwen/Qwen3-32B\",\n \"input\": \"<unknown>\",\n \"instructions\": \"<string>\",\n \"stream\": false,\n \"temperature\": 123,\n \"top_p\": 123,\n \"max_output_tokens\": 123,\n \"stop\": \"<unknown>\",\n \"seed\": 123,\n \"response_format\": {},\n \"text\": {},\n \"tools\": [\n {}\n ],\n \"tool_choice\": \"<unknown>\",\n \"parallel_tool_calls\": true,\n \"reasoning\": {},\n \"reasoning_effort\": \"<string>\",\n \"metadata\": {},\n \"user\": \"<string>\"\n}")
.asString();require 'uri'
require 'net/http'
url = URI("https://gateway.omnia-voice.com/v1/responses")
http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true
request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer <token>'
request["Content-Type"] = 'application/json'
request.body = "{\n \"model\": \"Qwen/Qwen3-32B\",\n \"input\": \"<unknown>\",\n \"instructions\": \"<string>\",\n \"stream\": false,\n \"temperature\": 123,\n \"top_p\": 123,\n \"max_output_tokens\": 123,\n \"stop\": \"<unknown>\",\n \"seed\": 123,\n \"response_format\": {},\n \"text\": {},\n \"tools\": [\n {}\n ],\n \"tool_choice\": \"<unknown>\",\n \"parallel_tool_calls\": true,\n \"reasoning\": {},\n \"reasoning_effort\": \"<string>\",\n \"metadata\": {},\n \"user\": \"<string>\"\n}"
response = http.request(request)
puts response.read_body{}{
"error": {
"message": "<string>",
"type": "<string>",
"code": "<string>"
}
}{
"error": {
"message": "Invalid API key",
"type": "invalid_request_error",
"code": "invalid_api_key"
}
}{
"error": {
"message": "Insufficient balance. Please top up your wallet.",
"type": "insufficient_quota",
"code": "insufficient_balance"
}
}{
"error": {
"message": "The model 'x' does not exist or is not available.",
"type": "invalid_request_error",
"code": "model_not_found"
}
}Inference API
Create a response
OpenAI’s Responses API. Supports streaming (usage settled on the terminal response.completed event).
POST
/
responses
Create a response
curl --request POST \
--url https://gateway.omnia-voice.com/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "Qwen/Qwen3-32B",
"input": "<unknown>",
"instructions": "<string>",
"stream": false,
"temperature": 123,
"top_p": 123,
"max_output_tokens": 123,
"stop": "<unknown>",
"seed": 123,
"response_format": {},
"text": {},
"tools": [
{}
],
"tool_choice": "<unknown>",
"parallel_tool_calls": true,
"reasoning": {},
"reasoning_effort": "<string>",
"metadata": {},
"user": "<string>"
}
'import requests
url = "https://gateway.omnia-voice.com/v1/responses"
payload = {
"model": "Qwen/Qwen3-32B",
"input": "<unknown>",
"instructions": "<string>",
"stream": False,
"temperature": 123,
"top_p": 123,
"max_output_tokens": 123,
"stop": "<unknown>",
"seed": 123,
"response_format": {},
"text": {},
"tools": [{}],
"tool_choice": "<unknown>",
"parallel_tool_calls": True,
"reasoning": {},
"reasoning_effort": "<string>",
"metadata": {},
"user": "<string>"
}
headers = {
"Authorization": "Bearer <token>",
"Content-Type": "application/json"
}
response = requests.post(url, json=payload, headers=headers)
print(response.text)const options = {
method: 'POST',
headers: {Authorization: 'Bearer <token>', 'Content-Type': 'application/json'},
body: JSON.stringify({
model: 'Qwen/Qwen3-32B',
input: '<unknown>',
instructions: '<string>',
stream: false,
temperature: 123,
top_p: 123,
max_output_tokens: 123,
stop: '<unknown>',
seed: 123,
response_format: {},
text: {},
tools: [{}],
tool_choice: '<unknown>',
parallel_tool_calls: true,
reasoning: {},
reasoning_effort: '<string>',
metadata: {},
user: '<string>'
})
};
fetch('https://gateway.omnia-voice.com/v1/responses', options)
.then(res => res.json())
.then(res => console.log(res))
.catch(err => console.error(err));<?php
$curl = curl_init();
curl_setopt_array($curl, [
CURLOPT_URL => "https://gateway.omnia-voice.com/v1/responses",
CURLOPT_RETURNTRANSFER => true,
CURLOPT_ENCODING => "",
CURLOPT_MAXREDIRS => 10,
CURLOPT_TIMEOUT => 30,
CURLOPT_HTTP_VERSION => CURL_HTTP_VERSION_1_1,
CURLOPT_CUSTOMREQUEST => "POST",
CURLOPT_POSTFIELDS => json_encode([
'model' => 'Qwen/Qwen3-32B',
'input' => '<unknown>',
'instructions' => '<string>',
'stream' => false,
'temperature' => 123,
'top_p' => 123,
'max_output_tokens' => 123,
'stop' => '<unknown>',
'seed' => 123,
'response_format' => [
],
'text' => [
],
'tools' => [
[
]
],
'tool_choice' => '<unknown>',
'parallel_tool_calls' => true,
'reasoning' => [
],
'reasoning_effort' => '<string>',
'metadata' => [
],
'user' => '<string>'
]),
CURLOPT_HTTPHEADER => [
"Authorization: Bearer <token>",
"Content-Type: application/json"
],
]);
$response = curl_exec($curl);
$err = curl_error($curl);
curl_close($curl);
if ($err) {
echo "cURL Error #:" . $err;
} else {
echo $response;
}package main
import (
"fmt"
"strings"
"net/http"
"io"
)
func main() {
url := "https://gateway.omnia-voice.com/v1/responses"
payload := strings.NewReader("{\n \"model\": \"Qwen/Qwen3-32B\",\n \"input\": \"<unknown>\",\n \"instructions\": \"<string>\",\n \"stream\": false,\n \"temperature\": 123,\n \"top_p\": 123,\n \"max_output_tokens\": 123,\n \"stop\": \"<unknown>\",\n \"seed\": 123,\n \"response_format\": {},\n \"text\": {},\n \"tools\": [\n {}\n ],\n \"tool_choice\": \"<unknown>\",\n \"parallel_tool_calls\": true,\n \"reasoning\": {},\n \"reasoning_effort\": \"<string>\",\n \"metadata\": {},\n \"user\": \"<string>\"\n}")
req, _ := http.NewRequest("POST", url, payload)
req.Header.Add("Authorization", "Bearer <token>")
req.Header.Add("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)
defer res.Body.Close()
body, _ := io.ReadAll(res.Body)
fmt.Println(string(body))
}HttpResponse<String> response = Unirest.post("https://gateway.omnia-voice.com/v1/responses")
.header("Authorization", "Bearer <token>")
.header("Content-Type", "application/json")
.body("{\n \"model\": \"Qwen/Qwen3-32B\",\n \"input\": \"<unknown>\",\n \"instructions\": \"<string>\",\n \"stream\": false,\n \"temperature\": 123,\n \"top_p\": 123,\n \"max_output_tokens\": 123,\n \"stop\": \"<unknown>\",\n \"seed\": 123,\n \"response_format\": {},\n \"text\": {},\n \"tools\": [\n {}\n ],\n \"tool_choice\": \"<unknown>\",\n \"parallel_tool_calls\": true,\n \"reasoning\": {},\n \"reasoning_effort\": \"<string>\",\n \"metadata\": {},\n \"user\": \"<string>\"\n}")
.asString();require 'uri'
require 'net/http'
url = URI("https://gateway.omnia-voice.com/v1/responses")
http = Net::HTTP.new(url.host, url.port)
http.use_ssl = true
request = Net::HTTP::Post.new(url)
request["Authorization"] = 'Bearer <token>'
request["Content-Type"] = 'application/json'
request.body = "{\n \"model\": \"Qwen/Qwen3-32B\",\n \"input\": \"<unknown>\",\n \"instructions\": \"<string>\",\n \"stream\": false,\n \"temperature\": 123,\n \"top_p\": 123,\n \"max_output_tokens\": 123,\n \"stop\": \"<unknown>\",\n \"seed\": 123,\n \"response_format\": {},\n \"text\": {},\n \"tools\": [\n {}\n ],\n \"tool_choice\": \"<unknown>\",\n \"parallel_tool_calls\": true,\n \"reasoning\": {},\n \"reasoning_effort\": \"<string>\",\n \"metadata\": {},\n \"user\": \"<string>\"\n}"
response = http.request(request)
puts response.read_body{}{
"error": {
"message": "<string>",
"type": "<string>",
"code": "<string>"
}
}{
"error": {
"message": "Invalid API key",
"type": "invalid_request_error",
"code": "invalid_api_key"
}
}{
"error": {
"message": "Insufficient balance. Please top up your wallet.",
"type": "insufficient_quota",
"code": "insufficient_balance"
}
}{
"error": {
"message": "The model 'x' does not exist or is not available.",
"type": "invalid_request_error",
"code": "model_not_found"
}
}Authorizations
Your workspace API key, e.g. sk_sovereign_..., sent as Authorization: Bearer .
Body
application/json
Example:
"Qwen/Qwen3-32B"
The input to respond to — a string or a structured input array.
System-style instructions for the model.
Stream the response as server-sent events.
Maximum output tokens.
Stop sequences.
Text/format options.
Reasoning options for reasoning-capable models.
Response
A response object. Usage is reported as input_tokens / output_tokens.
The response is of type object.
⌘I