
OpenAI’s new voice AI models slash latency and costs for real-time agents
OpenAI rolls out GPT-Realtime-2.1 and its mini sibling, cutting p95 latency by at least 25% and slashing token costs via smarter caching—ideal for low-latency voice assistants.










