Das KI-Briefing vom 8. Oktober fasst die vergangenen 24 Stunden zusammen: Günstigere Modelle und Agenten auf dem Gerät rückten gleichzeitig vor. Anthropic brachte ein billigeres Haiku 5.5 plus API-Guthaben für Abonnenten, NVIDIA und Microsoft bauten die Agenten-Laufzeit direkt in Windows-PCs, und ein Bericht über KI-Angriffswerkzeuge gegen südkoreanische Banken mahnt die Abwehr. Alle sieben Meldungen unten wurden am 7. oder 8. Oktober 2026 veröffentlicht oder berichtet und lassen sich auf ihre Originalquellen zurückführen; heute bereits einzeln behandelte Themen wie die GPT-6-Chatversion und Perplexitys Embedding-Modelle werden nicht wiederholt.
Anthropic veröffentlicht Claude Haiku 5.5: 1 Mio. Kontext zum neuen Tiefpreis
Anthropic stellte Claude Haiku 5.5 am 7. Oktober über das GitHub Release von Claude Code v2.1.293 bereit und machte es zum Standard-Haiku der Anthropic API: 1 Mio. Token Kontext, 0,10 US-Dollar pro Million Eingabe-Tokens und 0,50 für Ausgabe, bei Prompts über 100K Tokens 0,50 und 2,50. Am selben Tag kündigten offizielle Konten zwei Kostenänderungen an: Cache-Lesevorgänge bei Claude Sonnet 5.5 wurden auf 0,10 US-Dollar pro Million Tokens halbiert, was laut Unternehmen lange Aufgaben um rund 20 Prozent günstiger macht; Claude Max und Team erhalten monatliches Platform-API-Guthaben - 100 US-Dollar bei Max 5x, 200 bei Max 20x, bis 500 teilbar bei Team - für beliebige Modelle inklusive Haiku 5.5. Für Vielnutzer ist das direkte Ersparnis, für Einzelabonnenten zusätzliches programmierbares Kontingent.
NVIDIA und Microsoft mit RTX Spark: Windows-PCs für Agenten umgebaut
NVIDIA kündigte am 7. Oktober im offiziellen Blog an, Windows-Agenten-PCs gemeinsam mit Microsoft voranzutreiben. Die neue Plattform RTX Spark kombiniert eine Blackwell-RTX-GPU mit bis zu 6.144 Kernen und eine Grace-CPU mit bis zu 20 Kernen, bis zu 128 GB gemeinsamen Speicher und rund ein Petaflop FP4-Leistung. Laptops sind vorbestellbar und erscheinen am 16. Oktober, kompakte Desktops folgen im November, mit Geräten von Acer, ASUS, Dell, HP, Lenovo, Microsoft, MSI und Gigabyte. Softwareseitig sind Microsoft Execution Containers (MXC) allgemein verfügbar, sodass Agenten unter OS-Kontrolle dauerhaft im Hintergrund laufen. Vorgeschaut wurde auch eine DGX Station für Windows mit GB300-Chip, 748 GB kohärentem Speicher und bis zu 20 PetaFLOPS - genug für Billionen-Parameter-Modelle lokal. Das Agenten-Schlachtfeld wandert von der Cloud auf den Schreibtisch.
Bericht: Einzelner Angreifer mit KI-Werkzeugen gegen südkoreanische Banken
The Decoder berichtete am 8. Oktober unter Berufung auf CrowdStrike, ein mutmaßlich einzelner Angreifer habe von Ende September bis Anfang Oktober 2026 mit dem quelloffenen KI-Penetrationstest-Werkzeug ARTEX mehrere südkoreanische Finanzinstitute angegriffen und große Datenmengen gestohlen; allein bei der Shinhan Bank seien über 25.000 Datensätze mit Namen, Kontakten, Einkommen und Kreditlimits abgeflossen. Die Finanzaufsicht hielt eine Krisensitzung ab, der Präsident forderte Aufklärung. Solche Werkzeuge fänden Schwachstellen automatisch, sodass eine Person in Tagen schaffen könne, wofür früher ein Team nötig war. Details beruhen auf Sicherheitsfirma und Medien, vollständige Bestätigungen der Institute stehen aus - aber KI hat das Tempo von Angriffen auf Banken verändert.
Nemotron-Systeme nach Feintuning auf Goldniveau bei IOI und IMO
Das Nemotron-Team von NVIDIA schrieb am 7. Oktober auf Hugging Face, Systeme auf Basis von Nemotron 3 mit überwachtem Feintuning, Reinforcement Learning und rückkopplungsgetriebener Inferenz hätten bei der Informatik-Olympiade IOI 2026 535,4 von 600 Punkten erreicht - über Goldschwelle und menschlichem Bestwert, in einem inoffiziellen Lauf unter gleichen Bedingungen - und bei der Mathematik-Olympiade IMO 2026 30 von 42 Punkten, über der offiziellen Goldschwelle von 29, bewertet von offiziellen IMO-Prüfern. Modelle, Daten und Rezepte sind auf Hugging Face offen. Für das offene Ökosystem heißt das: Mit Fachdaten plus Erzeugen-Prüfen-Verbessern-Schleife zur Inferenzzeit lässt sich ein Allzweckmodell ohne Neutraining der Basis auf Spitzenniveau bringen.
Microsoft Research macht Agent Lightning v1.0 quelloffen
Microsoft Research Asia veröffentlichte Agent Lightning v1.0 am 7. Oktober im offiziellen Forschungsblog, rund 3.500 Codezeilen. Der Ansatz lässt genau das Gerüst, das Agenten im Betrieb ausführt, selbst am Reinforcement-Learning-Training teilnehmen, statt Agentenlogik im Trainingsrahmen nachzubauen. Das senkt den Aufwand, echte Geschäftsagenten laufend weiterzutrainieren, und passt zu Teams, die Agentenprodukte bereits betreiben. Das Framework ist quelloffen und bewusst schlank.
Google öffnet SynthID-Detector-Portal für Bild, Video und Audio
Google stellte am 7. Oktober über seinen offiziellen Account das SynthID-Detector-Portal vor: Nutzer laden Bild, Video oder Audio hoch, das Portal sucht nach SynthID-Wasserzeichen von Google oder Partnern als Hinweis auf KI-Erzeugung. Geprüft wird das Wasserzeichen, nicht die Wahrheit selbst - kein Wasserzeichen beweist keine menschliche Urheberschaft -, aber Redaktionen, Moderation und Marken erhalten einen offiziellen Schnellcheck für Herkunftsfragen.
GPT-6 Luna Decisions auf OpenRouter verfügbar
OpenRouter gab am 7. Oktober die Verfügbarkeit von GPT-6 Luna Decisions bekannt: eine Entscheidungs-Schnittstelle für Anwendungen, die Text, JSON oder Bilder entgegennimmt und typisierte Auswahl mit Wahrscheinlichkeiten zurückgibt, etwa um zwischen Modellen, Werkzeugen oder Aktionen zu wählen. Preis: 0,10 US-Dollar pro Million Eingabe-Tokens, Ausgabe kostenlos, 1 Mio. Kontext; laut OpenRouter unter Berufung auf OpenAIs Entwicklerkonto bis zu zehnmal schneller als GPT-6 Luna über die Responses API. Wer viel Routing und Klassifikation betreibt, sollte Latenz und Genauigkeit erst mit wenig Verkehr testen.