Model Routes — ML Junction docs

GET /v1/models/{public_model}/routes returns every active serving route for a public model. The backend orders routes by 30-day uptime descending, then input price ascending, then route priority.

curl "$ASTRO_BASE_URL/v1/models/gpt-5.5/routes"
{
  "route_id": "openai-gpt-5.5-global-standard",
  "provider": "openai",
  "provider_model": "gpt-5.5",
  "company": "openai",
  "region": "global",
  "endpoint_type": "serverless",
  "priority": 100,
  "quantization": "unknown",
  "context_tier": "extended",
  "context_window_tokens": 1050000,
  "max_output_tokens": 128000,
  "capabilities": {
    "streaming": true,
    "tools": true,
    "parallel_tools": true,
    "json_object": true,
    "json_schema": true,
    "vision": true,
    "audio": false,
    "pdf": true,
    "reasoning": true,
    "prompt_caching": true,
    "modalities": {
      "input": ["text", "image", "pdf"],
      "output": ["text"]
    },
    "supported_params": ["temperature", "top_p", "seed"]
  },
  "stats": {
    "throughput_tps": 86.4,
    "latency_p50_ms": 280,
    "latency_p95_ms": 540,
    "latency_p99_ms": 910,
    "uptime_30d": 99.94
  },
  "privacy": {
    "supports_zdr": true,
    "zdr_enabled": false,
    "training_allowed": false,
    "retention": "provider_api_policy",
    "privacy_rank": 3
  },
  "pricing": {
    "currency": "USD",
    "input_per_mtok": 1.25,
    "cached_input_per_mtok": 0.125,
    "output_per_mtok": 10,
    "effective_from": "2026-06-13T00:00:00Z",
    "effective_to": null,
    "source": "https://..."
  }
}

An unknown model returns 404. Individual telemetry keys or the complete stats object may be absent until the route has enough observations.

Canonical URL: https://mljunction.com/docs/model-routes