OpenAI lança gpt-realtime-2.1 e mini com reasoning configurável e p95 25% mais baixa pra voice agents em produção
Nova geração da Realtime API cortou p95 de latência em ~25% via cache melhorada, adicionou "reasoning effort" configurável, alphanumeric recognition mais preciso e melhor handling de silêncio/ruído/interrupção. A variante mini estreia tier de raciocínio a custo baixo pra deploys production-scale.