| Grok 4.6 API endpoint | TBD | Consumer launch on grok.com/SuperGrok/X Premium+ confirmed since Aug 7. No grok-4-6 model ID in xAI's public API catalog as of Aug 8 — only grok-4-5, grok-4-3, grok-4-1-fast confirmed. Watch api.x.ai release notes. |
| Qwen3.8-Max open weights | ~August 10–11, 2026 | 2.4T MoE, 95B active, 1M context, $2/$6/MTok API live since Aug 3. Open weights on HuggingFace and ModelScope confirmed "next week" as of Aug 3 — still not released as of Aug 8. License terms still unannounced. |
| Google Imagen 4 API shutdown | August 17, 2026 | imagen-4.0-generate-001, imagen-4.0-ultra-generate-001, imagen-4.0-fast-generate-001 shut down on Aug 17. Migration requires switching from client.models.generate_images() to client.models.generate_content(); number_of_images parameter removed (each call produces one image). Migrate to Gemini 3.1 Flash Image. 9 days remain. |
| Anthropic Workbench sunset + experimental prompt tools retirement | August 17, 2026 | /v1/experimental/generate_prompt, improve_prompt, templatize_prompt will return errors. Export saved prompts from the Console banner before this date. |
| OpenAI Assistants API shutdown | August 26, 2026 | Every request to /v1/assistants, /v1/threads, /v1/runs will fail. Migrate to Responses API + Conversations API — architecture change required. |
| OpenAI o3 retirement | August 26, 2026 | Migrate to GPT-5.6 Sol/Terra/Luna. |
| DALL·E GPT retirement from ChatGPT | August 30, 2026 | Download images before this date. |
| GPT-5.4 / GPT-5.4 mini retirement from Codex (ChatGPT sign-in) | August 31, 2026 | API key–authenticated Codex sessions unaffected. |
| Google Gemini temperature/top_p/top_k — silent ignore → hard error | Future model gen | Currently silently ignored on Gemini 3.6 Flash and 3.5 Flash-Lite. Will return HTTP 400 on future Gemini model generations. Strip these parameters now to avoid a future breaking change. |
| Grok 4.7 | Late August / early September 2026 | 2.1T parameter model; xAI describes as "all-around better than 4.6 but slightly slower to serve." |
| llama.cpp default server port change: 8080 → 9931 | Upcoming (no date set) | Migration notice merged in b10240; actual port change pending. Update docker-compose, reverse-proxy configs, and hardcoded port references now. |
| EU AI Act Article 50 — Watermarking enforcement | December 2, 2026 | C2PA + SynthID are the de facto standard stack. |