v3.2.0
Added
- Gateway MVP (api/gateway/, gateway_app.py): OpenAI-compatible proxy on :8080 with pre-check, stream reserve, mid-flight kill, proxy-only ingest
- Shared budget gate (api/budget_gate.py) — /check and Gateway reuse same logic
- Docs: docs/gateway.md, demos/gateway_demo.py
- Docker: gateway service in lite compose; Dockerfile copies full api/ tree (fixes Intelligence module gap)
Changed
- Engine / API / Gateway version 3.2.0; Phase G P1 complete (P2 LiteLLM/TPM/predictive deferred)
- make demo prints Gateway URL; make demo-gateway for mock self-check
Notes
- Stream kill uses heuristic token estimate when provider omits usage chunks (same as SDK wrap())
- Helm gateway deployment deferred to Phase G.1 — same image, uvicorn gateway_app:app