Modelle, Anbieter, Kurse, Tools — kompakt, DE, scannbar. Style andblack.de.
Einfacher Querschnitt — subjektiv/aggregiert, keine Finanzberatung.
1. Claude Fable 5.1 / Mythos 5.1 | Anthropic | Neues Arbeitspferd mit 1M Kontext, günstige Caches, Sitzt an der Spitze der Agent/Long-Kontext-Nutzung. 2. GPT-6 Astra | OpenAI | Frisch für „Work“-Nutzung, Agents API, hält den Produktivitäts-Ton an. 3. GLM-5.3 (+Flash) | Z.ai/Zhipu | Stärkstes aktuelles Open-Modell im Coding, emergente Cyber-Talente – Momentum im OSS-Lager. 4. DeepSeek V4.1-Flash | DeepSeek | Unglaublich effizienter 552B-MoE, drückt Kostenkurve nach unten, inkl. Multimodal. 5. Grok 4.6 | xAI | Kompetitives Agent-/Coding-Modell; Grok 5 in Arbeit (Polymarket: 87 % bis 18.09.). 6. Gemini 3.5 (Flash/Pro) | Google | Breite Agentic-Integration (Spark, Islands of Junk); Momentum nach Schwächephase. 7. Kimi K3 | Moonshot | Größtes (hypothetisch) Open-Weight-Modell, Preisdruck auf Proprietary; Weights weiter offen. 8. Qwen 3.5 / Qwen 4 (bald) | Alibaba | Verlässliche Open-Weight-Familie; Qwen 4 im September erwartet. 9. Mistral (Medium/Large, Devstral) | Mistral | Souveränes EU-Gegenmodell, €3 Mrd. für Ausbau. 10. Llama 4 / Muse Spark | Meta | Breite OSS-Adoption; Fokus wandert zu Muse Spark / neue Agentenlinie. _Hinweis: Aggregierter Querschnitt auf Basis öffentlicher Benchmarks/Reputation/Adoption. Kein wissenschaftlicher Anspruch, keine Anlageberatung._
| Ticker | Kurs | 1-Tages-Change | |--------|------------|---------------| | MSFT | $495,63 | −2,84 % | | GOOGL | $338,50 | −1,16 % | | AMZN | $256,78 | −0,82 % | | META | $648,03 | +6,12 % | | NVDA | $218,29 | −4,45 % | | AMD | $516,13 | **+13,15 %** | | ORCL | $150,28 | −2,44 % | | IBM | $243,29 | +3,66 % | | BABA | $109,30 | −2,24 % | | TSM | $433,24 | +3,89 % | _Keine Kaufempfehlung. Private Firmen (OpenAI, Anthropic, xAI, Mistral, DeepSeek, Moonshot, Schwarz, Aleph Alpha) sind nicht börsennotiert._ Nach Anbieter (sortiert nach Relevanz) === ### OpenAI - **GPT-6 Astra** produktiv (09.09.): jetzt in ChatGPT Work, Codex, API; „nächste Generation Intelligenz für die Arbeit“. Research-Vorstellung am 03.09. Quelle: openai.com. ### Anthropic - Fable 5.1 / Mythos 5.1 (01.09.): 1M Kontext, Cache-Reads auf $0,25/M gesenkt; aber zwei Breaking Changes (kein forced tool_choice mehr, Thinking-Bindungen). Quelle: anthropic.com - **Smart reports (Beta)** im E-Commerce-/Büro-Slot (10.09.). ### Google – Gemini - Google startet September mit KI-Momentum nach langer Verluststrecke; Assoziations-Erzählung „Agentic era“ (Spark, Gemini-Live-Tools). Quelle: CNBC / Google Blog. ### xAI – Grok - **Grok 4.6** im API; Grok 5 weiter in Training. Polymarket sieht 87 % für „nächstes Grok (4.7+)“ bis 18.09. ### Meta – Llama - Fokus verschiebt sich Richtung Muse Spark als Llama-Nachfolger; kein großes Llama-Release im Fenster. ### DeepSeek - **V4.1-Flash** (10.09.): asymmetrische Encoder-Decoder-Architektur, 552B-MoE, native multimodale Sicht. KV-Cache nur 1/4 HBM und 1/8 SSD des Vorgängers. **V4-Pro wird ab 14.09. auf V4.1-Flash geroutet**, bis V4.1-Pro kommt; Preise gesenkt (Off-Peak = 50 %). ### Moonshot / Kimi - Kimi K3 bleibt wichtig: 2,8T-Parameter-Open-Weight-Modell, „DeepSeek-Schock II“-Narrativ; Druck auf Bewertungen der US-Proprietary-Labs hält an. Quelle: Fortune, Constellation Research. ### Z.ai / Zhipu (GLM) - **GLM-5.3**: +50 % Coding-Leistung ggü. GLM-5.2, Emergente Cyber-Fähigkeiten (2.436 gefundene Vulns, inkl. 1.097 mittel/hoch). Weights in ~2 Wochen. Auch **GLM-5.3-Flash** für Agents. - 🔶 GERÜCHT: Berichten zufolge hat GLM-5.3 in Cursor eine ernsthafte Schwachstelle gefunden (VentureBeat) – unbestätigt in Details. ### Mistral / European - **€3 Mrd. Funding** für souveräne, Open-Weight-KI (08.09.); weiteres Signal für EU-Souveränitäts-Track. ### Schwarz Digits / Aleph Alpha / STACKIT - Fokus: **Cohere–Aleph-Alpha-„Global AI Powerhouse“** auf STACKIT-Cloud; am 16.09. Partner Summit von Schwarz Digits in Wiesbaden. Kein neues Modell-Release im Fenster, aber laufender Ausbau des Souveränitäts-Ökosystems. ### Alibaba / Qwen - Qwen 4 im September erwartet (API); Qwen 3.8-Weights zuvor – Gemeinde-Stand. ### 🔶 GERÜCHT (Sammlung) - Grok 5 / „nächstes Grok“ bis 18.09. (Polymarket). - GLM-5.3-Schwachstelle in Cursor (VentureBeat). - Qwen 4 Release im September (r/Qwen_AI).
—
vLLM ist die verbreitetste Open-Source-Engine zum effizienten Servieren großer Sprachmodelle (PagedAttention, Continuous Batching, OpenAI-kompatible API). Mit den jüngsten Releases reicht der Haltegriff von Inkling-Support über DeepSeek-V4-Optimierungen bis zu GLM-5.2-MoE-Sequenz-Parallel – damit der faktische Standard fürs Self-Hosting von Open-Weight-Modellen wie Kimi K3, GLM-5.3 oder DeepSeek V4.1.
Kurzportrait, keine Kaufempfehlung.
Web-Ansicht · Style andblack.de · 2026-09-12