AI & Tech News Hub
CHAOSNODE
Latest in AI, Tech, Tools & Tutorials — Curated daily
GitHub macht Copilot billiger - ohne dass das Modell schlauer werden muss
Vier Eingriffe im Harness statt im Modell GitHub-Engineer Erik Krogh Kristensen beschreibt vier Änderungen, mit denen Copilot weniger Tokens verbraucht, ohne Task-Qualität zu …
Google feuert drittes Flash-Modell in sechs Wochen ab: Gemini 3.8 Flash
Dritter Flash-Release in Rekordzeit Google legt nach: Gemini 3.8 Flash ist bereits das dritte Flash-Modell in sechs Wochen. Vom versprochenen Gemini 3.5 Pro fehlt weiterhin jede …
LFM2.5-350M mit GRPO feintunen: Strukturierte Outputs in 100 Schritten deutlich besser
Kleine Modelle sind fuer strukturierte Outputs notorisch unzuverlaessig - kaputtes JSON, fehlende Felder, falsche Item-Counts. Ein neuer HuggingFace-Guide zeigt jetzt einen …
Loop Engineering, Squads, Harnesses: GitHub sortiert das neue KI-Vokabular
Begriffe, die Devs jetzt kennen sollten Im GitHub Podcast haben Cassidy Williams und Marlene Mhangami die Begriffslawine sortiert, die AI-Coding-Tools gerade über die Dev-Welt …
Schwarzer Tag fuer die KI: ChatGPT, Claude, Grok und Codex gleichzeitig offline
Es ist vermutlich der unfreiwilligste Lasttest des Jahres: Am 3. September 2026 gingen gleich drei grosse KI-Anbieter gleichzeitig in die Knie. ChatGPT warf 404-Fehler, Claude …
Anthropic sperrt zahlende Max-Kunden wegen verdächtiger Signale
Ein Fall, der gerade mehrfach aufschlägt: Entwickler Kix Panganiban erhielt ohne Vorwarnung eine Sperrung seines Claude-Accounts - mit dem Standard-Template der …
Audit: Ein Drittel der Perplexity-Zitate belegt die behauptete Zahl nicht
Zwei unabhängige Studien haben am selben Tag die Quellenkultur von Perplexity auseinandergenommen - mit ernüchternden Ergebnissen für die Verlässlichkeit von KI-Suchmaschinen. Haus …
BenchMIRT: Was messen LLM-Benchmarks wirklich?
Das Allen Institute for AI (Ai2) hat BenchMIRT vorgestellt - eine Methode, um LLM-Benchmarks bis auf die Ebene einzelner Prompts zu auditieren. Die Grundfrage: Wenn ein Modell bei …
ChatGPT-Desktop-App schleppt ein komplettes LibreOffice mit sich herum
Simon Willison hat beim Aufräumen seines ~/.cache-Ordners eine Kuriosität entdeckt: Die OpenAI Codex Desktop-App (mittlerweile in ChatGPT aufgegangen) installiert im Verzeichnis …
Efficient Frontier der LLM-Inferenz: Tradeoff oder Frontier-Verschub?
Baseten hat einen kompakten Überblick veröffentlicht, wie Inference-Engineering eigentlich funktioniert - und warum nicht jede Optimierung gleich viel wert ist. Die Kernidee: Der …
IBM Granite Time Series Models laufen nativ in Confluent Flink
IBM bringt seine Granite Time Series Foundation Models (TSFM) stream-nativ in Confluent Cloud - als Native Inference direkt in Apache Flink. Das Portfolio umfasst vier …
Lokale LLMs auf dem M4 Pro Mac mini: Ein praxistauglicher Stack
Kevin Lewis zeigt seinen kompletten lokalen LLM-Stack auf einem M4 Pro Mac mini mit 48 GB RAM - und das Setup dauert laut ihm rund 30 Minuten. Der Server bedient alles: den …