| Qwen3.8-Max open weights | ~August 10–12, 2026 | 2.4T MoE, 95B active, 1M context, $2/$6/MTok API live since Aug 3. Alibaba promised open weights "next week" from Aug 3 — 6 days have elapsed with no drop. License terms still unannounced. First-ever Max-class Qwen model to ship open weights if it lands. Watch Hugging Face (huggingface.co/Qwen) and ModelScope. |
| Grok 4.6 API endpoint | TBD (overdue) | Consumer launch on grok.com/SuperGrok/X Premium+ was confirmed around Aug 7. No grok-4-6 model ID in xAI's public API catalog as of Aug 9 — only grok-4-5, grok-4-3, grok-4-1-fast confirmed. Musk stated "around August 7" on Jul 30. Now 2+ days past stated target with no API or model card. Watch api.x.ai/docs/models. |
| Anthropic Workbench sunset + experimental prompt tools retirement | August 17, 2026 — 8 days | /v1/experimental/generate_prompt, improve_prompt, templatize_prompt will return errors. Export saved prompts from the Console banner before this date. |
| Google Imagen 4 API shutdown | August 17, 2026 — 8 days | imagen-4.0-generate-001, imagen-4.0-ultra-generate-001, imagen-4.0-fast-generate-001 shut down. Migration: switch from client.models.generate_images() to client.models.generate_content(); number_of_images parameter removed. Migrate to Gemini 3.1 Flash Image. |
| OpenAI Assistants API shutdown | August 26, 2026 — 17 days | Every request to /v1/assistants, /v1/threads, /v1/runs will fail. Migrate to Responses API + Conversations API — architecture change required. |
| OpenAI o3 retirement | August 26, 2026 — 17 days | Migrate to GPT-5.6 Sol/Terra/Luna. |
| DALL·E GPT retirement from ChatGPT | August 30, 2026 — 21 days | Download images before this date. Use ChatGPT Images going forward. |
| GPT-5.4 / GPT-5.4 mini retirement from Codex (ChatGPT sign-in) | August 31, 2026 — 22 days | API key–authenticated Codex sessions unaffected. |
| Gemini Robotics ER 1.6 Preview shutdown | August 31, 2026 — 22 days | Migrate to gemini-robotics-er-2-preview. |
| Google Gemini temperature/top_p/top_k — silent ignore → hard error | Future model gen | Currently silently ignored on Gemini 3.6 Flash and 3.5 Flash-Lite. Will return HTTP 400 on future Gemini model generations. Strip these parameters now. |
| Grok 4.7 | Late August / early September 2026 | 2.1T parameter model; xAI describes as "all-around better than 4.6 but slightly slower to serve." |
| llama.cpp default server port change: 8080 → 9931 | Upcoming (no date set) | Migration notice merged in b10240; actual port change pending. Update docker-compose, reverse-proxy configs, and hardcoded port references now. |
| EU AI Act Article 50 — Watermarking enforcement | December 2, 2026 | C2PA + SynthID are the de facto standard stack. |