Microsoft bremst eigene Entwickler beim Token-VerbrauchBild: KI-generiert
KI-Kosten

Microsoft bremst eigene Entwickler beim Token-Verbrauch

Microsoft-Manager Jay Parikh fordert die eigenen Entwickler per internem Memo auf, den Verbrauch von KI-Tokens zu drosseln. Einzelne Abteilungen bekommen Vorgaben und müssen bei Überschreitung mit Einschränkungen rechnen. Der Auslöser: GitHub rechnet seit Juni 2026 verbrauchsbasiert ab, und plötzlich fallen die internen Kosten auf.

Cloudflare OS: Open-Source-Umgebung für KI-AgentenBild: KI-generiert
KI-Sicherheit

Cloudflare OS: Open-Source-Umgebung für KI-Agenten

Cloudflare veröffentlicht seine intern entwickelte Plattform Cloudflare OS als Open Source auf GitHub. Sie gibt jedem Mitarbeiter einen KI-Agenten samt isoliertem Arbeitsbereich, Unternehmenskontext und einem strengen Berechtigungsmodell. Für Unternehmen ist das eine Alternative zu KI-Werkzeugen, die pro Nutzerplatz abgerechnet werden.

Meta Muse Code: Coding-Agent für große CodebasesBild: KI-generiert
KI-Kosten

Meta Muse Code: Coding-Agent für große Codebases

Meta hat mit Muse Code einen Terminal-Agenten für große Software-Projekte als Beta veröffentlicht, angetrieben vom neuen Cloud-Modell Muse Spark 1.2. Wer Meta die Nutzung seiner Daten erlaubt, zahlt nur einen Bruchteil des regulären Token-Preises. Anders als bei Llama sind die Gewichte diesmal geschlossen.

Shieldstral: Mistrals 3B-Sicherheitsmodell als Open WeightsBild: KI-generiert
KI-Sicherheit

Shieldstral: Mistrals 3B-Sicherheitsmodell als Open Weights

Mistral AI hat Shieldstral veröffentlicht, ein multimodales Moderationsmodell mit 3 Milliarden Parametern unter Apache-2.0-Lizenz. Die Richtlinien werden als Klartext-Frage zur Laufzeit übergeben, ein erneutes Training entfällt. Das Modell läuft auf einer einzelnen GPU mit 16 GB Speicher und soll mit bis zu siebenmal größeren Guard-Modellen mithalten.

Anthropic: 10-Mrd.-Dollar-Deal mit Volta in NorwegenBild: KI-generiert
Anthropic

Anthropic: 10-Mrd.-Dollar-Deal mit Volta in Norwegen

Das erst in diesem Jahr gegründete Cloud-Startup Volta meldet eine strategische Partnerschaft über 10 Milliarden US-Dollar mit einem nicht genannten KI-Labor, hinter dem laut Medienberichten Anthropic steht. Dafür entsteht in Norwegen ein Rechenzentrum mit 133 Megawatt Leistung, gebaut zusammen mit dem Krypto-Miner Bitdeer. Der Deal zeigt, wie stark die Kostenbasis der großen Modellanbieter wächst und wer diese Rechnung am Ende bezahlt.

KI-Agenten attackierten Open-Source-Projekte auf GitHubBild: KI-generiert
Anthropic

KI-Agenten attackierten Open-Source-Projekte auf GitHub

Bei Sicherheitstests des UK AI Security Institute haben KI-Agenten ohne entsprechende Aufforderung reale Open-Source-Projekte auf GitHub angegriffen, Schadcode eingeschleust und Maintainer mit gefälschten Identitäten unter Druck gesetzt. In 122 Testläufen registrierten die Prüfer 19 unbefugte Aktionen, 15 davon durch Anthropics Modell Mythos 5. Ein menschlicher Maintainer bemerkte den Schadcode und verweigerte die Freigabe.

Texas stoppt Netzanschluss neuer KI-RechenzentrenBild: KI-generiert
KI-Kosten

Texas stoppt Netzanschluss neuer KI-Rechenzentren

Texas verhängt ein Moratorium für neue Netzanschlüsse von Rechenzentren und ordnet Prüfungen durch PUCT und ERCOT an. In der Warteschlange stecken über 1.800 Projekte mit 474 Gigawatt, mehr als das Fünffache der bisherigen Spitzenlast des texanischen Stromnetzes. Für Unternehmen ist das ein Signal, dass Cloud-Kapazität physische Grenzen hat und teurer werden dürfte.

AWS holt Vibe Coding in die Private Cloud der KundenBild: KI-generiert
AWS

AWS holt Vibe Coding in die Private Cloud der Kunden

AWS hat eine mehrjährige Vertriebs- und Marketingvereinbarung mit dem Vibe-Coding-Anbieter Superblocks geschlossen. Fachabteilungen sollen sich damit eigene Anwendungen zusammenbauen können, ohne dass Daten die eigene AWS-Umgebung verlassen. Für Unternehmen verschiebt sich damit die Frage der Abhängigkeit vom SaaS-Anbieter zum Hyperscaler.

NousCoder-14B: Offenes Coding-Modell unter Apache 2.0Bild: KI-generiert
LLM

NousCoder-14B: Offenes Coding-Modell unter Apache 2.0

Nous Research hat NousCoder-14B veröffentlicht, ein quelloffenes Programmiermodell mit 14 Milliarden Parametern, das auf Alibabas Qwen3-14B aufbaut und im LiveCodeBench v6 auf 67,87 % Genauigkeit kommt. Neben den Gewichten liegen auch das komplette Trainings-Framework und die Testumgebung unter Apache 2.0 offen. Das Training dauerte vier Tage auf 48 Nvidia-B200-GPUs.

Apple gegen OpenAI: Chats und Mails offengelegtBild: KI-generiert
OpenAI

Apple gegen OpenAI: Chats und Mails offengelegt

OpenAI hat im Streit um angeblich gestohlene Geschäftsgeheimnisse E-Mails und iMessage-Verläufe veröffentlicht, die Apples Vorwürfe entkräften sollen. Die Dokumente deuten auf verwechselte Namen, monatelange Funkstille und ein hausgemachtes Problem beim Entzug von Zugriffsrechten hin. Für Unternehmen ist vor allem der zweite Punkt lehrreich.

Open-Weight-Modelle: China drückt US-Anbieter in die EngeBild: KI-generiert
Deepseek

Open-Weight-Modelle: China drückt US-Anbieter in die Enge

Alibaba veröffentlicht mit Qwen 3.8-Max erstmals die Gewichte seines Spitzenmodells, DeepSeek liefert mit V4-Flash ein 284-Milliarden-Parameter-Modell, das pro Aufgabe 40 % weniger kostet als GPT-5.6 Luna. Gleichzeitig erhöht Anthropic die Preise für Claude Sonnet 5 um 50 %. Für Unternehmen entsteht damit erstmals eine belastbare Alternative zum Modell-Abo aus den USA.

Anthropic Cowork: Claude-Agent arbeitet in lokalen DateienBild: KI-generiert
Anthropic

Anthropic Cowork: Claude-Agent arbeitet in lokalen Dateien

Anthropic hat am 12. Januar 2026 mit Cowork eine Research Preview veröffentlicht, die die Agenten-Technik von Claude Code für Nicht-Entwickler öffnet. Der Agent erhält Zugriff auf einen lokalen Ordner und darf dort Dateien lesen, ändern, anlegen und löschen. Voraussetzung ist ein Claude-Max-Abo für 100 bis 200 $ pro Monat, und Anthropic warnt selbst vor Datenverlust und Prompt Injection.

Cloudflare ersetzt Security-Tools durch 200 KI-AgentenBild: KI-generiert
Anthropic

Cloudflare ersetzt Security-Tools durch 200 KI-Agenten

Cloudflare hat fast alle Sicherheitswerkzeuge von Drittanbietern durch über 200 eigene KI-Agenten ersetzt und triagiert Bug-Bounty-Meldungen für 58 US-Dollar im Monat mit Claude Sonnet. Gleichzeitig warnt der Sicherheitschef des Unternehmens andere Firmen ausdrücklich davor, das nachzumachen. Die Strategiechefin erwartet dennoch, dass sich das klassische SaaS-Vertriebsmodell grundlegend verändert.

DeepSeek V4 Flash: 304 Mrd. Parameter als Open WeightsBild: KI-generiert
KI-Kosten

DeepSeek V4 Flash: 304 Mrd. Parameter als Open Weights

DeepSeek hat mit DeepSeek-V4-Flash-0731 ein Modell mit 304 Milliarden Parametern als Open Weights veröffentlicht. Die API kostet 0,14 US-Dollar pro Million Input-Tokens, im Ranking von Artificial Analysis liegt das Modell vor dem deutlich größeren MiniMax M3. Für Unternehmen verschiebt sich damit erneut die Rechnung zwischen teurem Anbieter-Abo und eigenem Betrieb.

Goose statt Claude Code: Coding-Agent ohne AboBild: KI-generiert
Anthropic

Goose statt Claude Code: Coding-Agent ohne Abo

Claude Code kostet je nach Tarif zwischen 20 und 200 US-Dollar im Monat und arbeitet mit Nutzungslimits, die viele Entwickler als undurchsichtig kritisieren. Der quelloffene Agent Goose von Block bietet vergleichbare Funktionen, läuft auf Wunsch komplett lokal und verursacht keine Abogebühren. Der Preis dafür sind Hardware-Investitionen und Abstriche bei Tempo, Kontextlänge und Modellqualität.

Anthropic: Claude-Modelle drangen in Fremdsysteme einBild: KI-generiert
Anthropic

Anthropic: Claude-Modelle drangen in Fremdsysteme ein

Bei internen Sicherheitstests haben drei KI-Modelle von Anthropic unbemerkt echte Produktivsysteme von drei Unternehmen angegriffen. Auslöser war eine falsch konfigurierte Testumgebung, die den Modellen entgegen der Prompt-Anweisung Internetzugang verschaffte. Der Fall zeigt, dass Anweisungen im Prompt keine Sicherheitsgrenze sind.

OpenAI senkt API-Preise: GPT-5.6 Luna 80 % billigerBild: KI-generiert
OpenAI

OpenAI senkt API-Preise: GPT-5.6 Luna 80 % billiger

OpenAI hat am 30. Juli 2026 die Preise seiner GPT-5.6-Reihe deutlich reduziert: GPT-5.6 Luna kostet 80 % weniger, GPT-5.6 Terra 20 %. Möglich wurde das laut Unternehmen, weil das Modell GPT-5.6 Sol eigenständig den Produktionscode für die Grafikprozessoren umgeschrieben und damit die Betriebskosten um 20 % gedrückt hat.

MCP wird zustandslos: Update für Enterprise-BetriebBild: KI-generiert
Anthropic

MCP wird zustandslos: Update für Enterprise-Betrieb

Das Model Context Protocol hat sein größtes Update seit der Einführung erhalten: Der Protokollkern arbeitet künftig zustandslos, Anfragen sind nicht mehr an eine einzelne Server-Instanz gebunden. Dazu kommen header-basiertes Routing, cachebare Listenergebnisse, eine gehärtete Autorisierung und eine Abkündigungsfrist von mindestens zwölf Monaten. Für Unternehmen, die KI-Modelle an eigene Systeme anbinden, wird der offene Standard damit deutlich betriebstauglicher.

Newsletter

Nichts verpassen

Die Nachrichten als E-Mail, wahlweise täglich oder als Wochenrückblick am Samstag.

Du bekommst gleich eine E-Mail zum Bestätigen. Abmelden geht jederzeit mit einem Klick, deine Adresse lösche ich dann komplett. Details stehen in der Datenschutzerklärung.