OpenAI Announces GPT-6.1 Sol and Introduces 'Ultrafast' 300 Tok/s Tier at DevDay 2026
Sub-second inference loops at 300 tokens per second paired with aggressive prompt caching discounts unlock economically viable low-latency autonomous agent systems for enterprise production.