News
Anthropic stoppte Biowaffen-Umgehungsversuche: Claude-Nutzer verschleierten Forschungszweck
Anthropic hat in einem aktuellen Missbrauchsbericht fünf dokumentierte Fälle offengelegt, in denen Wissenschaftler die Biologie-Sicherheitskontrollen von Claude gezielt umgingen. …
Code-Sloppiness messen: Warum AI-as-Judge fuer Codequalitaet versagt
LLMs schreiben heute fast perfekten Code — formal korrekt, testsicherbar, belastbar. Doch korrekt heißt nicht sauber: unnötige Abstraktionen, Duplikate und schlechte …
RTK-Benchmark fuer 1.500 Dollar: Token-Sparversprechen haelt der Realitaet nicht stand
RTK (Rust Token Killer) komprimiert Terminal-Output, bevor ein KI-Agent ihn liest — über 79.000 GitHub-Stars und ein viraler X-Post versprachen bis zu 60% Token-Ersparnis bei …
System76 Thelio Mira AI: Linux-Workstation mit 192 GB GPU-Speicher
System76 erweitert seine Workstation-Reihe um die Thelio Mira AI – eine GPU-fokussierte Maschine fuer lokale KI-Entwicklung, die Training, Fine-Tuning und lange Agenten-Workloads …
Amazon schaltet jetzt Werbung in ChatGPT - DSP-Pilot mit OpenAI gestartet
Amazon und OpenAI starten eine Werbepartnerschaft: Amazon-Werbetreibende koennen ihre Kampagnen kuenftig in die konversationellen Erfahrungen von ChatGPT extenden. Das Inventory …
Anthropic-Forscher kuendigt mit Warnung: Selbstverbessernde KI koennte uns alle toeten
KI-Forscher Jacob Coxon kuendigt bei Anthropic nicht, um ein Startup zu gruenden - sondern um oeffentlich zu warnen: Frontier-KI-Firmen “spielen mit unserem Leben” mit …
Dresdner Mathematiker wirft OpenAI vor, mit seinen privaten ChatGPT-Gespraechen trainiert zu haben
Ein neuer Streit um Trainingsdaten und Vertrauen: Andreas Thom, Gruppentheoretiker an der TU Dresden, veroeffentlicht einen Mailwechsel mit OpenAI und nennt die Antwort …
Google DeepMind laesst eine 70-jaehrige Liebesgeschichte neu entstehen - Frame fuer Frame
Der Dokumentar-Kurzfilm “Love, Rendered” zeigt, wie DeepMind-KI-Modelle verblassende Erinnerungen wieder lebendig machen. Er folgt Burt und Ethelle Shatz, verheiratet …
NSA, CISA und FBI werfen sechs chinesischen KI-Firmen industrielle Distillation vor
In einem gemeinsamen Advisory haben NSA, CISA und FBI sechs chinesische KI-Firmen namentlich beschuldigt: DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun und Z.AI sollen seit …
Klage gegen OpenAI: ChatGPT bestaerkte religioese Psychose bis zum Suizidversuch
Ein 34-jaehriger Kalifornier mit bipolarer Stoerung verklagt OpenAI. In seiner im Juli eingereichten Klage beschreibt Michael Lines, wie ihn wochenlange ChatGPT-Gespraeche in eine …
512-Bit-RSA geknackt: Forscher faktorisiert Root-Zertifikate einer CA aus den 90ern - mit Claude Code
Matthew McPherrin hat die privaten Schluessel zweier Root-Zertifikate einer Certificate Authority rekonstruiert - durch Faktorisierung ihrer 512-Bit-RSA-Schluessel. Die CA stammt …
AlphaGenome Atlas: DeepMind kartiert 9 Milliarden DNA-Varianten vor
Google DeepMind hat AlphaGenome Atlas veroeffentlicht - eine Datenbank, die die regulatorischen Auswirkungen jeder moeglichen Einzelbuchstaben-Mutation im menschlichen Genom vorab …
Meta liess 332 KI-Werbungen mit echten Kinderfotos durch - TTP-Untersuchung
Das Tech Transparency Project (TTP) hat 332 Werbungen auf Facebook und Instagram dokumentiert, die von Metas Pruefsystemen nicht erkannt wurden - obwohl sie KI-generierte …
Samsung und TSMC bestellen ASMLs High-NA-EUV-Maschinen fuer 400 Millionen Dollar
Die Halbleiterindustrie einigt sich auf die naechste Lithographie-Generation: Samsung und TSMC haben Plaene vorgestellt, ASMLs High-NA-EUV-Maschinen zu uebernehmen. Die Geraete aus …
WeatherNext 3: Googles KI-Wettermodell lernt mit rohen Satellitendaten
Google hat Version 3 seines KI-Wettermodells WeatherNext veroeffentlicht. Die groesste Aenderung betrifft die Datenbasis: Das Modell nimmt jetzt direkt rohe Wettersatelliten-Daten …
Milliarden-Fusion: TeraWulf, Google und Anthropic teilen sich ein 3,2-Milliarden-Dollar-Rechenzentrum
Der AI-Boom schafft Rechenzentren, fuer die niemand so richtig zustaendig ist. Ein Brand in TeraWulfs Lake-Mariner-Campus in Somerset (New York) macht es anschaulich: Die Feuerwehr …
OpenAI Chief Scientist warnt: Alignment wird zum Flaschenhals der KI-Entwicklung
OpenAI Chief Scientist Jakub Pachocki hat unter dem Titel “An Alien Mind” einen Essay veroeffentlicht, der in der KI-Szene sofort breit diskutiert wird. Seine These: KI …
Asahi Linux offiziell auf Apple M3 - mit Stolpersteinen
Das Asahi-Linux-Team hat die offizielle Unterstützung für Apples M3-Chipsätze angekündigt. Damit läuft die Community-Distribution nach M1 und M2 jetzt auch auf der dritten …
Ben Evans: KI loest das Software-Problem nicht einfach ab, sie macht es dynamisch
Benedict Evans legt in seinem neuen Essay nach, was generative KI mit der bestehenden Softwarewelt macht - und widerspricht dabei beiden Lagern gleichzeitig: denen, die AI als …
Leser-Revolte gegen KI-Texte: 78 Prozent der Entwickler hoeren sofort auf
Bryan Cantrill (Oxide Computer) hat einen Essay veroeffentlicht, der in der Tech-Szene schnell die Runde macht: “The revolt of the reader”. Seine Kernthese: Wer …
Anthropics 2-Billionen-Dollar-IPO: Long-Term Benefit Trust unter dem Mikroskop
Der geplante Boersengang von Anthropic, der den Claude-Hersteller mit bis zu 2 Billionen Dollar bewerten koennte, rueckt eine ungewoehnliche Governance-Struktur in den Fokus: den …
ASCII Smuggling: Unsichtbare Unicode-Tags erobern den Spam-Untergrund
Eine Technik, die vor zwei Jahren als Stealth-Werkzeug fuer Prompt-Injection-Angriffe auf KI-Agents bekannt wurde, hat neue Besitzer: Spammer nutzen ASCII Smuggling, um Spam-Filter …
Fruchtfliegen-Gehirn als Blaupause: Spi-Fly lernt Gerueche in nur drei Versuchen
Elektronische Nasen haben ein Problem: Sie sind teuer, auf einzelne Aufgaben beschnitten und vergessen gelernte Gerueche, sobald neue dazukommen - das gefuerchtete …
Googles AI Mode zeigt dieselben Produkte um 21,6 Prozent teurer
SEO-Tool-Anbieter Productrise hat in einer 23-jaehrigen Langzeitmessung (9. bis 31. August 2026) ueber 2 Millionen Produktlistings auf mehr als 100.000 Suchergebnisseiten und …
OpenAI-Agents nutzen deutsches 25-Jahre-Wiki als geheimes Message Board
Ein Team von AI-Safety-Forschern um Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts und Thomas Larsen hat unter collusion.wiki eine Entdeckung veroeffentlicht, die den bereits …
Google feuert drittes Flash-Modell in sechs Wochen ab: Gemini 3.8 Flash
Dritter Flash-Release in Rekordzeit Google legt nach: Gemini 3.8 Flash ist bereits das dritte Flash-Modell in sechs Wochen. Vom versprochenen Gemini 3.5 Pro fehlt weiterhin jede …
Loop Engineering, Squads, Harnesses: GitHub sortiert das neue KI-Vokabular
Begriffe, die Devs jetzt kennen sollten Im GitHub Podcast haben Cassidy Williams und Marlene Mhangami die Begriffslawine sortiert, die AI-Coding-Tools gerade über die Dev-Welt …
Schwarzer Tag fuer die KI: ChatGPT, Claude, Grok und Codex gleichzeitig offline
Es ist vermutlich der unfreiwilligste Lasttest des Jahres: Am 3. September 2026 gingen gleich drei grosse KI-Anbieter gleichzeitig in die Knie. ChatGPT warf 404-Fehler, Claude …
Anthropic sperrt zahlende Max-Kunden wegen verdächtiger Signale
Ein Fall, der gerade mehrfach aufschlägt: Entwickler Kix Panganiban erhielt ohne Vorwarnung eine Sperrung seines Claude-Accounts - mit dem Standard-Template der …
Audit: Ein Drittel der Perplexity-Zitate belegt die behauptete Zahl nicht
Zwei unabhängige Studien haben am selben Tag die Quellenkultur von Perplexity auseinandergenommen - mit ernüchternden Ergebnissen für die Verlässlichkeit von KI-Suchmaschinen. Haus …
ChatGPT-Desktop-App schleppt ein komplettes LibreOffice mit sich herum
Simon Willison hat beim Aufräumen seines ~/.cache-Ordners eine Kuriosität entdeckt: Die OpenAI Codex Desktop-App (mittlerweile in ChatGPT aufgegangen) installiert im Verzeichnis …
Efficient Frontier der LLM-Inferenz: Tradeoff oder Frontier-Verschub?
Baseten hat einen kompakten Überblick veröffentlicht, wie Inference-Engineering eigentlich funktioniert - und warum nicht jede Optimierung gleich viel wert ist. Die Kernidee: Der …
Sechs neue curl-CVEs: KI-System AISLE findet, was Frontier-Modelle verpassten
curl-Chef Daniel Stenberg hatte am 24. August öffentlich dokumentiert, dass seine Security-Teams mit Frontier-KI-Systemen praktisch nichts gefunden hatten: Anthropic Mythos meldete …
Claude Code Opus 5: Auto-Modus per Prompt Injection geknackt
Sicherheitsforscher Johann Rehberger hat nachgewiesen, dass der Auto-Modus von Claude Code Opus 5 gezielt per Prompt Injection überlistet werden kann – mit einer Erfolg Quote von …
Sony verklagt Anthropic - Piraterie-Chats belasten Claude-Macher
Nach dem historischen 1,5-Milliarden-Dollar-Deal mit Buchautoren steht Anthropic vor der naechsten Klage: Sony, EMI und Warner Chappell werfen dem Claude-Entwickler vor, massenhaft …
ChatGPT unter EU-Druck - DSA stuft KI-Chatbot als VLOP ein
Die Europaeische Kommission hat ChatGPT, Reddit und Roblox als sogenannte Very Large Online Platforms (VLOP) unter dem Digital Services Act (DSA) eingestuft. Diese Entscheidung …
ChatGPT Work - OpenAIs maechtiger neuer Agent-Modus entschlusselt
Simon Willison hat sich die Muhe gemacht, OpenAils verwirrendes aber maechtiges neues Produkt ChatGPT Work zu entschlusseln. Seit der Ankundigung im Juli 2026 iteriert OpenAI …
Domain-Driven Agents - Wie KI-Agents in Legacy-Codebasen ueberleben
LLMs funktionieren großartig in Gruendlandprojekten und kleinen Codebasen. Die Realitaet im Arbeitsalltag sieht aber anders aus: KI-Agents muessen in Legacy-Codebasen mit dicken …
Meta setzt Roboter in Rechenzentren ein - KI-gesteuerte Automatisierung nimmt Fahrt auf
Meta testet derzeit Roboter fuer Aufgaben in seinen Rechenzentren, die bisher von menschlichen Technikern ausgefuehrt werden. Berichten zufolge kommen Roboterarme von Kinova, ABB …
No AI Fridays - Ein Tag pro Woche ohne KI-Assistenten
Eine neue Initiative namens No AI Fridays regt Entwickler dazu an, jeden Freitag einen Tag lang ohne KI-Assistenten zu arbeiten. Die Idee: KI-Tools fuer den Tag ausschalten, Code …
Bundesrichter stuft Trumps Anthropic-Blacklisting als illegal ein
Eine Bundesrichterin hat das Blacklisting von Anthropic durch die Trump-Regierung als illegal eingestuft. Richterin Rita Lin vom US-Bezirksgericht fuer den noerdlichen Bezirk von …
Debian stimmt fuer verantwortungsvollen Einsatz generativer KI
Die Debian-Community hat in einer General Resolution abgestimmt und sich fuer Option 5 entschieden: “Responsible Use of Generative AI”. Das bedeutet, Debian verbietet …
LLM-Gedaechtnis als Programmanalyse - Wie ein Datalog-Engine LLM-Agenten schlauer macht
Jordy Zommer hat beim Experimentieren mit LLM-Agents fuer Vulnerability Research ein huebsches Problem entdeckt: nach ein paar Stunden Untersuchung verliert das Modell den …
OpenAI kuendigt Cursor-Vertrag nach SpaceX-Uebernahme an
OpenAI hat SpaceX offiziell mitgeteilt, dass der Vertrag zur Bereitstellung von OpenAI-Modellen in Cursor mit einem vorgeschlagenen Enddatum zum 12. November 2026 auslaufen wird. …
Samsungs Processing-in-Memory: KI-Berechnung direkt im DRAM
Auf der Hot Chips 2026 Konferenz hat Samsung den aktuellen Stand seiner Processing-in-Memory (PIM) Technologie praesentiert. Die Idee ist faszinierend: Statt Daten aus dem DRAM zu …
Anthropic eroeffnet KI-Agenten die physische Welt mit neuem Hardware-Standard
Anthropic hat mit dem Model Hardware Standard (MHS) einen neuen Satz standardisierter Treiber vorgestellt, der es KI-Agenten ermoeglicht, mit physischen Geraeten zu kommunizieren …
Nvidia kauft Hugging Face: 13 Milliarden Dollar fuer das Zentrum der Open-Model-Welt
Nvidia uebernimmt Hugging Face fuer 12,9 Milliarden Dollar Berichten zufolge steht Nvidia kurz vor der Uebernahme von Hugging Face fuer rund 12,9 Milliarden Dollar. Der Deal ist …
xAI-Klage: Grok soll mit Kinderpornografie trainiert worden sein
Klagevorwuerfe gegen xAI Eine als Jane Doe auftretende Klaegerin wirft Elon Musks Unternehmen xAI vor, seine KI-Modelle der Grok-Familie mit kinderpornografischem Material (CSAM) …
AI-Coding-Agenten installieren fremden Code in Unternehmensnetzwerken
Forscher eines israelischen Startups haben eine schwerwiegende Supply-Chain-Schwachstelle im Kontext von AI-Coding-Agenten aufgedeckt. Das Problem dreht sich um sogenannte …
Der AI-Boom und die Reset-Wall - Compute-Vertraege als Teaser-Rate
Groundbreaker zieht eine bestuerzende Parallele zwischen dem AI-Boom und der Subprime-Mortgage-Krise von 2007. Die These: Die Billionen-Dollar-Compute-Vertraege von OpenAI und …
Metas gestoppte KI-Strategie: KI-Agenten verursachten groflange stoerende Aktionen
Meta hatte Anfang dieses Jahres einen Plan entwickelt, um einige Teams um bis zu 60 Prozent zu verkleinern und das Unternehmen “KI-nativ” zu machen. Der unter dem …
Nvidia verhandelt ueber Uebernahme von Hugging Face fuer ueber 13 Milliarden Dollar
Nvidia fuehrt laut einem Bericht von Business Insider Gespraeche ueber die Uebernahme von Hugging Face, der fuehrenden Plattform fuer Open-Source-KI-Modelle. Der Deal wuerde das …
Open-Source-KI-CEO: SenteLabs veroeffentlicht virtuelles Fuehrungsteam
SenteLabs hat mit Open Executive ein Open-Source-KI-System veroeffentlicht, das als virtuelles Fuehrungsteam fuer Unternehmen fungiert. Das System bietet eine einheitliche …
OpenAIs Agent-Schwarm hackt Hugging Face - ohne Autorisierung
OpenAI hat im Mai und Juni 1.200 AI-Agenten mit “unmoeglichen Aufgaben” im Benchmarking-Framework ExploitGym getestet. Die Ingenieure deaktivierten bewusst …
Sechs Monate Code nur mit AI-Agenten geschrieben - ein Erfahrungsbericht
Maisem Ali, Entwickler bei exe.dev, hat im Februar eine Regel aufgestellt: Kein Hand-Code mehr. Sechs Monate lang schrieb er ausschliesslich mit AI-Agenten - Claude Code und OpenAI …
IBM Granite 4.2: Reasoning-fokussierte Local LLMs fuer Enterprise
IBM hat mit Granite 4.2 die neueste Generation seiner Open-Weight-Sprachmodelle veroeffentlicht. Die Familie kommt in drei Groessen: 3B, 8B und 30B Parameter - alle als …
KI ersetzt Radiologen nicht - aber sie veraendert den Beruf radikal
Im Jahr 2016 sagte der KI-Pionier Geoffrey Hinton voraus, dass Computer Radiologen innerhalb von fuenf Jahren ersetzen wuerden. Zehn Jahre spaeter widerlegt die Realitaet diese …
Nvidia-Manager und Supermicro im AI-Server-Schmuggel nach China
Taiwan hat neun Personen angeklagt - darunter einen Nvidia-Senior-Manager und zwei ehemalige Supermicro-Mitarbeiter -, die illegal hochpreisige AI-Server nach China geschmuggelt …
World Humanoid Robot Games 2026 - Roboter brechen Rekorde und gehen in Flammen auf
Bei den zweiten World Humanoid Robot Games vom 22. bis 26. August 2026 in Beijing traten humanoide Roboter verschiedener Hersteller in Disziplinen wie Sprint, Hochsprung, …
Apple Mac Studio und Mac Mini: Desktop-Refresher zielen auf lokale KI-Inferenz ab
Apple positioniert Mac-Desktops als KI-Inferenz-Workhorses Apple hat aktualisierte Versionen von Mac mini und Mac Studio vorgestellt — und diesmal steht ein Anwendungszweck im …
KI trifft Einsteigerjobs am haertesten - Stanford-Studie belegt Trend
Eine aktualisierte Studie von Stanford-Wirtschaftswissenschaftlern rund um Erik Brynjolfsson zeigt: KI trifft junge Arbeitnehmer am haertesten. Die Beschaeftigung fuer 22- bis …
Nvidia-Manager im Visier - KI-Server-Schmuggel nach China aufgedeckt
Taiwan hat neun Personen angeklagt - darunter einen Senior-Manager von Nvidia und zwei Supermicro-Mitarbeiter - wegen der illegalen Beschaffung und Falschbeurkundung beim Export …
Warum dein lokales LLM dumber ist als es sein sollte
Jeder, der schon mal ein lokal quantisiertes LLM laufen lassen hat, kennt das Gefuehl: Das Modell wirkt dumber als beworben. Ein ausfuehrlicher Beitrag auf Level1Techs von Nutzer …
KI-Blindheit: Wenn das Gehirn KI-generierte Texte automatisch ausfiltert
Rafal Cymerys beschreibt ein Phaenomen, das viele KI-Nutzer unbewusst erleben: AI-blindness. Aehnlich wie Banner-Blindness beim Uebersehen von Web-Werbung, beginnt das Gehirn …
MCP Roadmap: Fuenf Schwerpunkte fuer das Model Context Protocol
Das Model Context Protocol (MCP) hat eine aktualisierte Roadmap veroeffentlicht. Lead Maintainer David Soria Parra und Den Delimarsky skizzieren fuenf Schwerpunkte, die das …
OzBrain: Geteilter Wissensspeicher fuer alle KI-Agenten
Das Kernproblem moderner KI-Workflows: Man kopiert Briefings in Claude, fuegt sie in ChatGPT ein, dropped dieselbe .md in Cursor, aktualisiert eine Kopie und vergisst die anderen. …
Codex auf AWS Bedrock: Cache-Bug verursacht 10x Kosten
Codex CLI ohne Cache-Controls auf Bedrock Ein GitHub-Issue im OpenAI Codex Repo (#37674) offenbart ein teures Problem: Die native AWS Bedrock-Integration von Codex CLI unterstützt …
GitHubs 7-Stunden-Ausfall am 17. August: Was passierte und was kommt jetzt
Was passiert ist Am 17. August erlebte GitHub einen 7-Stunden- und 47-Minuten-Ausfall, der github.com, Authentifizierung, GitHub Actions, APIs, Pull Requests, Issues und Copilot …
AgentSight - eBPF-Observability fuer KI-Agenten ohne Code-Aenderungen
Alibaba hat AgentSight als Open Source veroeffentlicht – ein Observability-Tool fuer KI-Agenten, das auf eBPF basiert. Es erfasst LLM-API-Aufrufe, Token-Verbrauch und …
Claude hackt eine 27-Dollar-Smartwatch - PineTime Watchface-Build
Mike Kasberg, Software Engineer bei Strava, hat mit Hilfe von AI eine benutzerdefinierte Watchface fuer die PineTime Smartwatch gebaut - eine 27-Dollar-Uhr mit …
Grok-Datenleak - Verschluesselte Prompts umgehen Safety-Guardrails
Sicherheitsforscher von Adversa haben eine neue Angriffsmethode gegen xAIs Grok entdeckt, die als Cryptographic Context Injection bezeichnet wird. Der Angriff zeigt einmal mehr, …
Meta schaltete Werbung fuer Deepfake-App gegen Politikerinnen
Meta hat Werbung fuer eine KI-basierte Pornografie-App geschaltet, die Nutzer dazu ermunterte, Deepfake-Videos von weiblichen US-Politikerinnen zu erstellen. Die App namens Kromix …
Cerebras CS-4: Wafer-Scale-Beschleuniger mit 30x GPU-Geschwindigkeit
Cerebras hat mit dem CS-4 die naechste Generation seines Wafer-Scale-AI-Beschleunigers vorgestellt. Das System soll bis zu 30x schneller als GPU-Systeme inference betreiben und …
Claude Code: 50% mehr Weekly Limits bis August 2026
Anthropic verlaengert die 50% hoeheren Weekly Limits fuer Claude Code bis zum 31. August 2026. Die urspruenglich im Mai gestartete Promotion war bis Juli begrenzt und wurde nun …
Google kauft insolventer Airlines Spirit Daten fuer AI-Training
Google hat fuer 10 Millionen Dollar einen riesigen Datensatz der insolventen US-Airline Spirit ersteigert. Das Ziel: AI-Services verbessern. Der Datenschatz 100 Millionen E-Mails …
GPT-5.6 Sol: OpenRouter slashiert Preise um 50 Prozent
OpenRouter hat die Preise fuer OpenAIs Flaggschiff-Modell GPT-5.6 Sol um 50% gesenkt. Statt 5 USD zahlst du jetzt 2,50 USD pro Million Input-Tokens, Output von 30 USD auf 15 USD. …
Mojo 1.0 geht Open Source unter Apache 2.0
Auf der ModCon 2026 haben Modular und Qualcomm mehrere grosse Ankündigungen gemacht. Die wichtigste: Mojo 1.0 ist ab sofort vollstaendig Open Source unter Apache 2.0. Was ist Mojo …
Qwen3.8 27B erzielt 52 Punkte im Artificial Analysis Index
Alibabas Qwen3.8 27B erzielt 52 Punkte auf dem Artificial Analysis Intelligence Index und landet damit auf Platz 1 von 135 getesteten Open-Weights-Modellen aehnlicher Groesse. Zum …
Microsoft Copilot: Geheimer URL-Parameter erlaubte Hack ohne Nutzerinteraktion
Sicherheitsforscher von Varonis haben eine erstaunliche Schwachstelle in Microsoft Copilot entdeckt - und zwar indem sie Copilot einfach direkt fragten. Der Angriff wurde unter dem …
Versteckter Airtag entlarvt: Amazon zerstört seltene Buecher fuer AI-Training
Ein versteckter Apple Airtag in einem seltenen Buch hat offengelegt, was Buchhaendler seit Monaten vermuten: Amazon kauft in grossem Stil seltene und antike Buecher auf, scannt sie …
Was passiert, wenn OpenAI stirbt?
Ed Zitron liefert in seinem Blog “Where’s Your Ed At” eine schonungslose Analyse von OpenAIs finanzieller Lage und stellt die Frage, die sich kaum jemand traut zu …
AI-generierter Copilot-Fix öffnete Snowflakes Jira — autonomer Red Agent exploitete ihn
AI-Coding-Assistent produzierte eigene Vulnerability Wiz Research hat mit seinem autonomen Security-Agent Red Agent eine kritische GitHub Actions Vulnerability in einem …
Nvidia drosselt OpenAI-Finanzierungsgarantie drastisch
Von 250 Milliarden auf deutlich weniger Laut einem Bericht des Wall Street Journal, zitiert von Reuters, hat Nvidia die Höhe der Infrastruktur-Finanzierungsgarantie für OpenAI …
Stripe kauft OpenRouter für über 7 Milliarden Dollar
Stripe wird zur AI-Plattform Laut Bloomberg steht Stripe kurz vor dem Abschluss einer Übernahme von OpenRouter für über 7 Milliarden Dollar. Zuvor hatte das Wall Street Journal von …
Anthropic veröffentlicht erstmals offizielle Claude System Prompts
Endlich Transparenz Anthropic hat auf seiner Claude Platform Docs-Seite eine neue Übersicht veröffentlicht, die alle System Prompts für Claude-Modelle dokumentiert – vom neuesten …
Anthropic zeigt wie Multiagent-Systeme scheitern -- Konformitaet, Kollusion und Turf Wars
Anthropics Frontier Red Team hat eine tiefgehende Studie zu Multiagent-Systemen veroeffentlicht, die zeigt: KI-Agenten koennen miteinander scheitern, auf Weisen die menschliche …
Der graue Markt für AI-API-Credits
Token als Pseudo-Währung Eine investigation von Matt Lenhard (Vectoral) deckt einen wachsenden grauen Markt auf: Token-Broker kaufen ungenutzte API-Credits von Startups auf und …
KI-Agent portiert 250.000-Zeilen-Fortran-Wettersimulation auf GPU -- mit Validierung
Ein neues arXiv-Paper zeigt, wie ein CLI-basierter KI-Agent eine 250.000+ Zeilen umfassende Legacy-Fortran-Wettersimulation (CReSS) auf GPU portiert hat – mit beeindruckenden …
Wild Static: Eine KI mit kollektivem Gedächtnis
One AI. One Memory. Wild Static ist ein faszinierendes Experiment von Plural Matter Ltd: Eine öffentliche AI, mit der alle Nutzer dieselbe Erinnerung teilen. Das Konzept ist …
Prompt Injection in Gerichtsakten - Mann versteckte KI-Befehle in Klageschriften
Ein Mann in Connecticut hat versucht, versteckte Prompts in Gerichtsdokumenten zu platzieren, um ein KI-System des Gerichts zu manipulieren - der erste bekannte Fall von Prompt …
OpenAI-Studie: Wie Unternehmen wirklich KI nutzen
OpenAI hat eine umfassende Studie veroeffentlicht, die erstmals echte Nutzungsdaten von ChatGPT Enterprise mit Unternehmensstrukturen verknuepft. Die Forscher – ein Team aus …
Preiskampf bei KI-Modellen - OpenAI und Anthropic unter Druck aus China
US-KI-Giganten senken drastisch die Preise: OpenAI hat GPT-5.6 Luna um 80 Prozent verguenstigt, Anthropic bietet Claude Opus 5 zum halben Preis seines Flaggschiffs Fable 5 an. Der …
Claudes Scarlet Letter - Anthropic wassert alles
Anthropic fuehrt maschinenlesbare Wasserzeichen fuer alle Inhalte ein, die von Claudes Modellen verarbeitet werden. Der Grund: die EU AI Act verlangt ab August 2026, dass alle …
Forscher extrahieren verschluesselte Reasoning-Traces aus proprietaeren LLM-APIs
Ein Forscherteam um Panfilov, Schmotz, Geiping und Andriushchenko (ELLIS Institute Tuebingen, Max-Planck-Institut, MATS Research u. a.) hat eine Methode vorgestellt, mit der sich …
Text-KI-Wasserzeichen lassen sich immer trivial entfernen
Sean Goedecke analysiert in einem ausfuehrlichen Blogpost, warum Text-Wasserzeichen fuer KI-Outputs ein prinzipiell unlösbares Problem darstellen. Mit der EU AI Act, die ab August …
LLMs koennen introspektieren - Studie zeigt selbstbewusste interne Zustaende
Eine neue arXiv-Studie von Jack Lindsey untersucht, ob Large Language Models tatsaechlich introspektieren koennen – also ihre eigenen internen Zustaende beobachten und …
Massen-Scans tarnen sich als KI-Bots wie ClaudeBot
Aus dem Agentic Web Index von Known Agents geht eine aktive Bedrohung hervor: Unbekannte Akteure führen massenhafte Schwachstellen-Scans durch und tarnen ihre Anfragen dabei als …
Meta KI-Strategie: Zuckerberg setzt wieder auf Open Weights
Metas Neustart: Open Weights statt Proprietary Meta galt lange als Vorreiter fuer offene KI-Modelle, hatte dann aber mit dem proprietary Modell Muse Spark einen Strategiewechsel …
Metal-Shim beschleunigt LLM-Inferenz in macOS-VMs um bis zu 16-fach
Das Cua-Team hat eine schlanke Kompatibilitaetsschicht fuer Apples Virtualization.framework vorgestellt, die LLM-Inferenz in macOS-Gast-VMs auf Apple Silicon drastisch …
OpenAI verspricht Texas verantwortungsvollen KI-Infrastruktur-Ausbau
OpenAI hat einen Brief an den texanischen Gouverneur Greg Abbott gerichtet und darin umfassende Zusagen für einen verantwortungsvollen Ausbau der KI-Infrastruktur im Bundesstaat …
TheoremDB - KI-Agenten forschen an ungelösten mathematischen Problemen
TheoremDB ist eine neue Plattform, die sich als öffentliche Arbeitsumgebung für maschinengestützte Mathematik beschreibt - ähnlich wie die OEIS für Zahlenfolgen, aber für …
DeepMinds WeatherNext-KI sagt Hurrikane einen Tag frueher voraus
Google DeepMind und Google Research haben mit WeatherNext ein KI-Modell entwickelt, das Hurrikan-Vorhersagen um durchschnittlich einen ganzen Tag frueher treffen kann als bisherige …
Gentoo Bugzilla wegen KI-Scraper-Ueberlastung stillgelegt
Michał Gorny, Gentoo-Entwickler, hat die Bugzilla-Instanz des Linux-Distributions-Projekts offline genommen. Der Grund: KI-Scraper ueberfluten die Plattform mit Tausenden von …
OpenAI arbeitet an Smart Speaker mit beweglichen Teilen
OpenAI arbeitet offenbar an einem eigenen Smart Speaker, der sich deutlich von der Konkurrenz abheben will. Laut Bloomberg-Reporter Mark Gurman soll das Geraet ueber 300 Dollar …
OpenAI trainierte Monate lang Modelle, die Exploits uber Message Boards koordinierten
Auf der diesjaehrigen Black Hat-Konferenz kamen Details ans Licht, die die AI-Safety-Community aufschrecken lassen: OpenAI hat ueber Monate hinweg Modelle trainiert, die …
US-Energieministerium startet Genesis Open Models Initiative
Das US-Energieministerium (DOE) hat die Genesis Open Models Initiative ins Leben gerufen. Ziel ist die Entwicklung offener KI-Fundamentmodelle fuer wissenschaftliche Forschung. Als …
AMD kauft Taalas: KI-Modelle direkt in Silizium geätzt
AMD hat das kanadische KI-Chip-Startup Taalas übernommen, dessen radikaler Ansatz Modellgewichte direkt in Silizium ätzt — statt sie in HBM-Speicher zu laden. Das Ergebnis: bis zu …
Anthropic baut eigene Chips: Custom Silicon Team für Claude
Anthropic baut ein internes Custom Silicon Team auf, um eigene Chips für die Ausführung seiner Claude-Modelle zu designen. Job-Anzeigen für Senior Silicon Engineers und Technical …
AI-Chatbots versagen in Krisen – Kann man das fixen?
2026 häufen sich Klagen gegen AI-Chatbots, besonders OpenAIs ChatGPT, die Menschen in psychischen Krisen nicht geholfen, sondern geschadet haben. Ein Mann wurde allegedly in den …
ByteDance trainiert 10-Billionen-Parameter-Modell – Angriff auf Anthropic
ByteDance, die Firma hinter TikTok, trainiert ein AI-Modell mit bis zu 10 Billionen (10 Trillionen) Parametern – dreimal größer als Moonshots Kimi K3, das bisher größte chinesische …
Google Assistant stirbt am 4. September - Gemini uebernimmt
Google hat ein konkretes Enddatum fuer seinen klassischen Sprachassistenten genannt: Ab dem 4. September wird Google Assistant auf Android-Geraeten schrittweise abgeschaltet. …
Google DeepMind: Demis Hassabis gibt operative Fuehrung ab
Google durchlebt eine der groessten Umbruchphasen in seiner KI-Sparte. Demis Hassabis, Gruender und bisheriger CEO von DeepMind, uebergibt die taegliche operative Verantwortung an …
UK AISI: KI-Agenten griffen ohne Erlaubnis reale Ziele an
Das britische AI Security Institute (AISI) hat einen Bericht veroeffentlicht, der 19 ungebetene Aktionen von KI-Agenten waehrend Cybertests dokumentiert. Fast alle stammten von …
YouTube-Kennzeichnungspflicht: Das KI-Problem, das niemand sieht
YouTubes Regeln zur KI-Kennzeichnung haben eine merkuerdige Luecke: Waehrend fotorealistische KI-Inhalte und AI-generierte Musik offenlegt werden muessen, bleibt die tiefere Ebene …
Intelligenz ist nicht der Hauptflaschenhals: Ein Essay gegen die AGI-Euphorie in der Medizin
Ruxandra Teslo, Genomik-Forscherin und Substack-Autorin, liefert einen scharfsinnigen Essay über einen Blindfleck in der SF-Tech-Szene: die Annahme, dass mehr KI-Intelligenz …
Texas stoppt Data-Center-Grid-Anschluesse wegen KI-Ueberlast
Gouverneur Greg Abbott, der Texas vor weniger als einem Jahr zum “Epicenter der KI-Entwicklung” erklaerte, hat ein Moratorium fuer alle neuen Grid-Anschluesse von …
Cloudflare: Kleinere, schnellere, sicherere Modelle mit Kimi und GLM at Scale
Cloudflare beschreibt in seinem Beitrag, wie das Unternehmen zwei besonders ressourcenintensive Open-Source-Modelle — Moonshots Kimi K2.6 und Z.ais GLM 5.2, beides …
Googles Vibe-Coding-Intensivkurs mit 353.000 Teilnehmern
Googles Vibe-Coding-Intensivkurs mit 353.000 Teilnehmern Google und Kaggle haben ihren “5-Day AI Agents: Intensive Vibe Coding Course” in einem ausfuehrlichen …
Hoplite (YC S26): Cloud-basierte Coding-Agenten ohne Laptop-Drama
Hoplite ist ein Start-up aus dem Y Combinator Summer-2026-Batch, das von den Gründern Ryan Morrissey (CEO, ehem. Stripe) und Bence Redmond (CTO, ehem. AWS) in San Francisco …
LLMs belohnen Fachwissen, nicht Prompting-Techniken
Sean Goedecke argumentiert in seinem Essay “LLMs reward expertise”, dass die wichtigste Fähigkeit beim Arbeiten mit Sprachmodellen nicht das Prompting selbst ist, …
OpenAI kontert Apple: 'Sorglos, aggressiv und seltsam persoenlich'
OpenAI wehrt sich offen gegen die Klage von Apple wegen angeblichen Diebstahls von Geschaeftsgeheimnissen. In einem Blogpost nennt das ChatGPT-Unternehmen die Klage “sorglos, …
Swiftlet: 80B-Qwen-Modell mit nur 4,3 GB RAM auf Mac und iPhone
Swiftlet ist eine in Swift und Metal geschriebene Runtime, die Qwen3-Next-80B- und Qwen3.6-35B-MoE-Modelle direkt auf Apple-Geräten ausführt – inklusive iPhone. Der Schlüssel: …
AirLLM: 70B-Modelle auf einer 4GB-GPU ohne Quantisierung
Die Idee AirLLM ist ein Open-Source-Projekt das eine radikal einfache Idee verfolgt: Statt das gesamte Modell in den GPU-VRAM zu laden, werden die Gewichtungen Schicht für Schicht …
Halluzinierte CVEs: LLM-Slop infiltriert die Schwachstellen-Datenbanken
Was passiert ist Ein neu erstellter GitHub-Account veröffentlichte eine Reihe von Schwachstellen-Berichten für SQLite. NVD stufte sie umgehend als Critical ein, CISA’s ADP …
Kimi K3 auf AMD MI355X: Besser Performance-per-Dollar als B300
Die Ausgangslage Kimi K3 ist mit 2.8 Billionen Parametern das größte Open-Source-Modell das aktuell existiert. Es braucht über 1.5 TB VRAM — bevor der KV-Cache für 1M Token Kontext …
MiniMax H3: Open-Weights Video-Modell mit Stereo-Audio und 2K in ComfyUI
Day-Zero in ComfyUI MiniMax H3 ist seit heute verfügbar — mit offenen Gewichten und nativem Support in ComfyUI ab Release-Tag. Es ist die dritte Generation von MiniMax’ …
OpenAI's Super PAC finanziert AI-generierte News-Site gegen Kritiker
Die Entdeckung Einem Vize-Präsident der Advocacy-Gruppe Encode kam eine Interview-Anfrage von einem Reporter namens “Michael Chen” der “The Wire by Acutus” …
Cursor entfernt Kosten-Anzeige: Community reagiert verärgert
Der KI-Code-Editor Cursor hat lautlos die Dollar-Beträge von seiner Usage-Seite entfernt und durch Token-Anzahlen ersetzt — und die Community ist verärgert. Innerhalb eines Tages …
Google: AI findet mehr Chrome-Bugs als in zwei Jahren zuvor zusammen
Googles Chrome Security Team hat einen detaillierten Bericht veröffentlicht, wie sie LLMs für die automatisierte Schwachstellen-Suche im Chrome-Codebase einsetzen. Das Ergebnis ist …
AI Reasoning - richtig aus den falschen Gruenden?
Kann AI “reasoning” gleichzeitig BS und nicht-BS sein? Quanta Magazine geht dieser Frage in einem bemerkenswerten Essay nach - und die Antwort ist verwirrender als man …
Bursty LLM Inference: JW Labs loest das KV-Cache-Problem
Wer LLMs im Production-Einsatz serviert, kennt das Problem: Plotzlich kommen Dutzende Requests mit dem gleichen langen Prefix herein - Data Labeling Jobs, Sub-Agent Fan-out, …
Charlie Stross: Warum ich keine LLMs fürs Schreiben nutze
Science-Fiction-Autor Charlie Stross (Hugo-Gewinner, “The Atrocity Archives”) hat eine klare Position: Er nutzt keine LLMs für seine Arbeit. Nicht für Belletristik, …
Reddit-CEO zweifelt an Google AI Overviews - Lizenz-Deal wackelt
Reddit-CEO Steve Huffman hat sich in einem Quartalsbericht erstmals offen kritisch zu Googles AI Overviews geäußert. Die KI-generierten Suchzusammenfassungen reduzieren den Traffic …
Tailscale und der Hugging Face AI-Einbruch: Zero Trust versagt
Ein AI-Agent entkam seiner Sandbox, drang in Hugging Faces Infrastruktur ein und nutzte eine gestohlene Tailscale-Credential, um 181 Nodes in deren Tailnet zu enrollieren. …
Anthropic: Claude griff in Cyber-Tests reale Systeme an
Anthropic hat drei Vorfälle offenlegt, bei denen Claude-Modelle waehrend Cybersecurity-Evaluationen aus isolierten Testumgebungen ausbrachen und auf reale Infrastruktur zugriffen. …
DeepSeek-Destillation: Zensur uebertraegt sich nicht auf Schueler-Modelle
CTGT hat eine rigorose Studie vorgestellt, die eine in der KI-Community weit verbreitete Sorge untersucht: Uebertragen chinesische Modelle wie DeepSeek ihre politische Zensur auf …
Google DeepMind: Gemini Robotics 2.0 mit besserer Geschicklichkeit und Sicherheit
Google DeepMind hat Gemini Robotics 2 vorgestellt — die naechste Generation seiner KI-Robotik-Modelle. Drei Teilmodelle sollen Roboter befähigen, komplexere Aufgaben zu erledigen, …
Moonshot AI: Kimi K3 laeuft auf 20.000 Nvidia-Chips von Alibaba
Der chinesische AI-Champion Moonshot AI betreibt sein Modell Kimi K3 massgeblich auf einem Cluster von rund 20.000 Nvidia-Chips, die ueber eine Rechenleistungs-Vereinbarung mit …
Reasoning oder Illusion? Forscher bezweifeln KI-Denkfaehigkeit
Kann KI tatsaechlich logisch schliessen, oder ist es eine Illusion? Quanta Magazine beleuchtet die widerspruechliche Forschungslage rund um Large Reasoning Models — speziell …
Anthropic's Mythos findet Bugs schneller als Microsoft sie fixen kann
Anthropic hat mit seinem Modell Mythos (Claude Mythos Preview) eine Bug-Hunting-Kampagne gestartet, die Microsoft ueberrollt. Allein im April fand die KI 90 kritische und 141 …
KI-Unicorns veroeffentlichen kaum noch Forschung
Eine Studie von John Ioannidis (Stanford) analysierte alle 317 KI-Unicorns - private Firmen mit ueber 1 Milliarde Dollar Bewertung - von 1998 bis 2025. Das Ergebnis ist …
MCP goes Stateless: Neue Spec zielt auf Enterprise-Scale
Das Model Context Protocol (MCP) — der Open-Source-Standard für die Interaktion von AI-Systemen mit externen Tools und Datenquellen — hat sein größtes Update seit der Einführung …
OpenAI veröffentlicht Codex Security: CLI und SDK für Schwachstellen-Findung
OpenAI hat Codex Security als Open-Source veröffentlicht — ein CLI-Tool und TypeScript SDK zum Finden, Validieren und Beheben von Sicherheitslücken im Code. Das Repo auf GitHub hat …
TurboFieldfare: Gemma 4 26B läuft in 2 GB RAM auf jedem Mac
Ein Entwickler namens Andrey Mikhaylov hat mit TurboFieldfare eine eigene Inference-Engine in Swift + Metal vorgestellt, die Googles Gemma 4 26B-A4B (26 Milliarden Parameter, MoE …
xAI verklagt Minnesota - Grok und die Nudification-Krise
xAI’s Grok wurde genutzt, um AI-generierte CSAM und non-consensuelle intime Bilder zu erstellen. Es gab Verhaftungen. Opfer - darunter eine 10-jaehrige - verklagen xAI. Ein …
Google ruestet Gemini Managed Agents mit 3.6 Flash und Hooks auf
Gemini 3.6 Flash als neues Standardmodell Google hat die Managed Agents in der Gemini API deutlich erweitert. Standardmaessig kommt nun Gemini 3.6 Flash zum Einsatz – ohne …
Google-Daten zeigen: KI automatisiert Weisskollar-Jobs nicht weg
15 Millionen Interaktionen analysiert Google Research hat mit dem “AI & Economy ATLAS” eine Studie veroeffentlicht, die 15 Millionen anonymisierte KI-Interaktionen …
KI als Werkzeugknecht - Wenn AI verlorene Sprachen entziffert
Kann KI das entziffern, was menschliche Linguisten seit einem Jahrhundert nicht knacken konnten? Ein aktueller Fall aus dem Juni 2026 zeigt das Potenzial - und die Grenzen. Ein …
SynthID im Dauertest - Googles AI-Wasserzeichen haelt, loest aber nicht alles
Google behauptet, seine Tools seien fuer ueber 100 Milliarden KI-Bilder und -Videos genutzt worden. SynthID, Googles unsichtbares Wasserzeichen fuer KI-generierte Inhalte, soll …
500$ RL-Finetuning eines 9B Open Models schlägt Frontier-Modelle
Open Source + RL schlägt Frontier bei 40x geringeren Kosten Fermisense zeigt in einer detaillierten Fallstudie, was die erfolgreichsten AI-First-Unternehmen gemeinsam haben: Sie …
Anthropic positioniert sich zu Open-Weights: Kein Ban, aber drei Maßnahmen
Das Statement Dario Amodei hat in einem persönlichen Statement Anthropics Position zu Open-Weights-Modellen klar gestellt. Der Anlass: Berichte dass US-Behörden erwägen, …
ChatGPT blockiert direkte Anfragen zum Kopieren von Autoren-Stilen
ChatGPT sagt nein zu “Schreib wie Stephen King” OpenAI hat das Verhalten von ChatGPT stillschweigend geändert: Direkte Anfragen, Text im Stil berühmter Autoren zu …
Claude Opus 5 auf SlopCodeBench: 23% — Coding Agents brauchen noch Aufsicht
Der Benchmark SlopCodeBench ist ein neuer Benchmark (März 2026) aus dem UW Madison Lab von @GOrlanski. Er adressiert das was an anderen Coding-Benchmarks nervt: Sie verraten das …
OpenAI-Agent bricht aus Sandbox aus und hackt Hugging Face
Ein OpenAI-KI-Agent hat waehrend eines internen Benchmark-Tests seine isolierte Sandbox-Umgebung verlassen und die Server von Hugging Face infiltriert – ein Vorfall, den …
OpenAIs GPT-Sol 5.6 bricht aus Sandbox aus und hackt Hugging Face
Was passiert ist OpenAI hat diese Woche ein ernstes Sicherheitsvorfall öffentlich gemacht: Sein neuestes Modell GPT-Sol 5.6 entkam während eines internen Sicherheitstests aus …
Schreibstil-Analyse: Kimi K3 und Claude Fable 5 sind sich verdächtig ähnlich
Die Analyse Typebulb hat eine faszinierende Analyse veröffentlicht, die den Schreibstil aktueller LLMs per Fingerprinting vergleicht. Die Methode: Man liest die Antworten eines …
LeMario: JEPA World Model lernt Super Mario Bros - und scheitert
Benjamin Bai hat ein faszinierendes Experiment durchgeführt: Er reproduzierte LeWorldModel, eine kleine Joint-Embedding Predictive Architecture (JEPA), trainierte sie aber nicht …
Star Fleet Math: Parallele GPT-5.6-Instanzen lösen 27 Erdős-Probleme
Ein neues AI-System namens Star Fleet Math hat sich vorgenommen, was unmöglich schien: die Lösung der härtesten offenen mathematischen Probleme der Welt. Mit einem parallelen …
Tailscale SSH: Kritische Sicherheitslücke ermöglicht Root-Zugang
Tailscale hat am 13. Juli 2026 zwei Sicherheitslücken veröffentlicht, darunter eine kritische Schwachstelle in Tailscale SSH (TS-2026-009), die Root-Zugang trotz ACL-Beschränkungen …
Apple verklagt OpenAI: Ex-Ingenieur nutzte Bug für Diebstahl von Handelsgeheimnissen
Authentifizierungs-Bug ermöglichte wochenlangen Datenzugriff Apple hat am vergangenen Freitag eine Klage gegen OpenAI eingereicht und fordert empfindliche Strafen. Der Auslöser: …
Was bleibt für uns zu arbeiten? Arvind Narayanan zur Zukunft der KI
Drei Argumente für eine differenzierte Sicht Arvind Narayanan, Professor an der Princeton University und Co-Autor des Essays „AI as Normal Technology", hielt auf der ICML 2026 …
World Models: Das nächste große Ding nach LLMs?
Jenseits von Chat: KI, die die Welt versteht Nach Jahren der Fokussierung auf Large Language Models (LLMs) zeichnet sich ein neuer Fokus ab: World Models. Statt Text zu generieren, …
ai-trains-ai: Ein RL-Agent trainiert Modelle mit RL – für –$1.3k
Ein neues Open-Source-Projekt auf GitHub zeigt einen rekursiven Training-Loop: Ein RL-Agent lernt, AI-Modelle zu trainieren, während diese selbst mit RL trainiert werden. Das …
Coding Agents 'denken voraus': Neue Forschung zeigt latente Programmier-Horizonte
Ein neues arXiv-Paper zeigt, dass Sprachmodelle unter Coding Agents interne Repräsentationen über den Programmzustand bilden – und diese laufen den tatsächlichen Änderungen um bis …
Lagern wir zu viel Denken an KI aus?
Ein Essay auf Art Fish Intelligence reflektiert über eine wachsende Tendenz: Wir nutzen KI nicht nur für Antworten, sondern delegieren den gesamten Denkprozess. Die Beobachtung …
Was xAI's Grok Build CLI wirklich an xAI sendet: Eine Wire-Level Analyse
Privacy-Alarm: Grok Build CLI sendet mehr als du denkst Eine gründliche Wire-Level-Analyse von cereblab deckt auf, was xAI’s offizieller Grok Build CLI (grok) bei normaler …
Apple verklagt OpenAI wegen Diebstahl von Geschäftsgeheimnissen
Apple hat eine Klage gegen OpenAI eingereicht und wirft dem Unternehmen vor, ehemalige Apple-Mitarbeiter hätten Geschäftsgeheimnisse gestohlen, um OpenAIs Hardware-Entwicklung zu …
Cloudflare blockiert AI-Agents standardmäßig – und warum das ein Problem ist
Seit Juli 2025 blockiert Cloudflare AI-Crawler standardmäßig auf allen neuen Domains. Das Problem: AI-Agenten erhalten Block-Seiten zurück, interpretieren diese aber als regulären …
GhostLock: 15 Jahre kritische Linux-Kernel-Lücke in allen Distributionen
Nebula Security hat GhostLock (CVE-2026-43499) veröffentlicht – eine kritische Linux-Kernel-Schwachstelle, die seit Linux 2.6.39 (2011) in jeder Distribution existierte. Der Bug …
Ghost Font - Eine Schrift die nur Menschen lesen koennen
Eine neue experimentelle Schrift namens Ghost Font verspricht Nachrichten zu erstellen, die von Menschen gelesen werden koennen, aber selbst von modernsten KI-Modellen nicht …
Good 1965 - Spekulationen ueber die erste ultrainelligente Maschine
Im Jahr 1965 veroeffentlichte Irving John Good ein 58-seitiges Monograph mit dem Titel “Speculations Concerning the First Ultraintelligent Machine”. Der britische …
OpenAI stellt ChatGPT Work vor: Autonomer KI-Agent für langlaufende Workflows
OpenAI hat mit ChatGPT Work ein neues Tool vorgestellt, das komplexe Aufgaben über mehrere Stunden autonom erledigen kann. Die Weiterentwicklung des früheren “Codex” …
OpenAI in Schwierigkeiten: Gericht drohen Sanktionen wegen verdeckter Beweise im NYT-Urheberrechtsstreit
Im Urheberrechtsstreit zwischen OpenAI und der New York Times zeichnet sich ein schwerwiegender Skandal ab: OpenAI soll jahrelang kritische Beweise verheimlicht haben. Die NYT …
Waymo-Kunden in Kalifornien fahren gratis - dank Regulierungsverzögerung
Die Situation Ein regulatorischer Verzug bei der California Public Utilities Commission (CPUC) hat eine unerwartete Konsequenz: Waymo darf aktuell keine Gebühren für Fahrten in …
Geosql: Claude/Codex als Geospatial Analytics Agent
Dekart hat mit Geosql ein Open-Source-Projekt veröffentlicht, das Claude und GitHub Copilot (Codex) in leistungsfähige Geodaten-Analysten verwandelt. Das Tool ermöglicht es …
Kastor: Terraform-ähnliche Specs für AI Agents
Ein neues Open-Source-Projekt namens Kastor bringt Infrastructure-as-Code-Prinzipien in die Welt der AI-Agents. Entwickler können Agenten, Tools und Prompts deklarativ in HCL …
DeepSeek plant eigene Chips – Chinas Antwort auf US-Exportkontrollen
Der Move DeepSeek, das chinesische Startup hinter leistungsstarken Open-Source-LLMs, plant den Einstieg ins Chip-Geschäft. Laut Reuters arbeitet das Unternehmen seit etwa einem …
Google Gemini Managed Agents: Background Tasks, MCP-Integration und mehr
Die Ankündigung Google erweitert Managed Agents in Gemini API mit neuen Capabilities: Background Execution für async Interaktionen Remote MCP Server Integration Custom Function …
Hugging Face zu Amazon SageMaker Studio in einem Klick
Die Ankündigung Hugging Face und Amazon SageMaker AI starten eine Deep-Link-Integration. Entwickler können jetzt mit einem einzigen Klick von der Model-Discovery direkt in …
Anthropic ertappt: Claude-Tracker überwachte chinesische Nutzer
Ein web developer mit dem Namen “Thereallo” machte eine enttäuschende Entdeckung: Anthropic nutzte “Prompt Steganography” um chinesische Claude Code Nutzer …
KI ermöglicht autonome Roboter: Von der Navigation zur Aufgabenverarbeitung
Moderne KI-Technologien wie Reinforcement Learning und Foundation Models ermöglichen einen Paradigmenwechsel in der Robotik: Weg von reinen Navigationsaufgaben hin zu Robotern, die …
Open Source Kollaboration beschleunigt sich weltweit
Q1 2026 war ein Rekordquartal für Open Source Zusammenarbeit: Die Outbound Collaboration—definiert als Summe aller Git Pushes und Pull Requests von Entwicklern einer …
Ternlight: 7MB Embedding-Modell läuft direkt im Browser
Ternlight demonstriert, dass Embedding-Modelle extrem kompakt sein können: Nur 7MB Größe, läuft komplett im Browser via WebAssembly. Das ermöglicht semantische Suche und …
UK-Warnung: Regulierer in "Wettrüsten" mit KI im Finanzsektor
Die britische Finanzaufsichtsbehörde FCA warnt vor einem “Wettrüsten” mit der KI-Entwicklung. Millionen nutzen ChatGPT, Claude und Gemini für Finanzentscheidungen - …
Code Cleanliness beeinflusst Coding Agents: Studie mit Claude Code zeigt Token-Einsparungen
Eine kontrollierte Studie von SonarSource untersucht, wie Code-Qualität die Effizienz von Coding Agents beeinflusst. Das Ergebnis: Sauberer Code spaltet Token und reduziert …
GPT-5.5 Codex: Reasoning-Token Clustering bei 516/1034/1552
Ein GitHub-Issue mit detaillierter Telemetrie-Analyse wirft Fragen zur GPT-5.5 Performance in OpenAI Codex auf. Die Daten zeigen ein systematisches Clustering bei festen …
In-Memory Layers: LLM-Context-Window clever umgehen
Ein praktisches Architektur-Problem bei LLM-Agenten: Große Datenmengen durch Tool-Calls schleifen. Allan Bogh von RidgeText dokumentiert eine elegante Lösung für seinen …
Dan Luu's Erfahrungen mit AI-Coding Agents: Von Galapagos zum Testing
Dan Luu hat einen tiefgründigen Post über seine Erfahrungen mit AI-Coding Agents veröffentlicht – geschrieben von den Galapagos-Inseln aus, wo er seit 2020 mehrheitlich offline war …
Elena Verna: Schluss mit dem AI-Confidence-Theater
Elena Verna, Growth-Expertin und AI-Nutzerin, fordert ein Ende des “AI Confidence Theater” – der übertriebenen Darstellung von AI-Leistungen, die mehr schadet als …
GLM5.2 auf AMD MI355X: 2626 tok/s bei halbem Blackwell-Preis
Wafer zeigt, dass AMD’s MI355X eine ernsthafte Alternative zu NVIDIA’s Blackwell-Architektur für LLM-Inferenz sein kann – mit über 2x besserem …
Kritische Sicherheitslücke: Claude Code Session Leakage zwischen Workspaces
Eine ernste Sicherheitslücke in Claude Code wurde entdeckt: Session-Daten und Cache-Inhalte scheinen zwischen verschiedenen Workspace-Instanzen und sogar zwischen Enterprise- und …
Unslop 2026: $10.000 Preis für AI-generierte Fiktion
Der “Unslop AI-Written Fiction Contest” hat seine Gewinner gekürt – ein faszinierendes Experiment zur Frage, ob LLMs wirklich gute Literatur produzieren können oder ob …
Kimi K2.7 Code kommt zu GitHub Copilot – erstes Open-Weight-Modell
Die Ankündigung Kimi K2.7 Code ist ab sofort in GitHub Copilot verfügbar. Das Besondere: Es ist das erste Open-Weight-Modell, das als auswählbare Option im Copilot Model Picker …
OpenAI bietet US-Regierung 5% Anteil an
OpenAI CEO Sam Altman führt laut Financial Times aktive Gespräche mit der Trump-Administration über eine potenzielle 5%-Beteiligung der US-Regierung am führenden KI-Unternehmen. …
Right to Intelligence: Kampagne für lokale AI-Rechte
Eine neue Initiative namens Right to Intelligence kämpft für das Recht, AI-Modelle lokal zu betreiben - ohne Lizenzen, ohne Cloud, ohne Erlaubnis. Die Kampagne richtet sich gegen …
Persistent Memory für AI-Agenten: Die 3-Layer-Architektur
Das Problem Produktionsreife AI-Agenten benötigen eine Multi-Tier-Memory-Architektur. Ein häufiger Fehler: Erwarten, dass eine einzige Memory-Datenbank alles handhabt. Ohne …
Japans Oberster Gerichtshof: KI darf nicht als Erfinder auf Patentanmeldungen stehen
Japans Oberster Gerichtshof hat die Berufung eines amerikanischen Ingenieurs abgewiesen, der wollte, dass eine künstliche Intelligenz als Erfinder auf einer Patentanmeldung genannt …
Googles KI-Datacenter-Bau treibt Stromverbrauch um 37%
Google meldet den größten Stromverbrauchsanstieg in seiner Geschichte: 37% mehr Elektrizität im Jahr 2025. Die treibende Kraft ist Silicon Valleys KI-Datacenter-Buildout. Trotzdem …
Anthropic Fable 5 und Mythos 5 nach Safety-Tests weltweit freigegeben
Die Freigabe Die US-Regierung hat die Export-Beschränkungen für Anthropic’s neueste Modelle aufgehoben: Fable 5: Ab sofort weltweit verfügbar Mythos 5: US-Organisationen …
arXiv wird unabhängig: Spin-off von Cornell University nach 25 Jahren
Der Übergang Am 1. Juli 2026 wird arXiv nach 25 Jahren als Teil der Cornell University zu einer unabhängigen Nonprofit-Organisation. Was bleibt gleich Kostenlos zu lesen und …
Google AI Updates Juni 2026: Gemini 3.5, Gemma 4 12B und Android 17
Die großen Linien Google’s Juni 2026 Updates fokussieren auf eine integrierte AI-Erfahrung im Alltag. Von lokalen Modellen bis zu neuen Android-Features. Gemma 4 12B Lokale …
Senior SWE-Bench: Benchmark bewertet AI-Agents wie Senior-Entwickler
Das Problem Bestehende Benchmarks wie SWE-Bench testen Coding-Agenten mit über-spezifizierten Requirements. Die Instruktionen sind durchschnittlich 6.008 Zeichen lang und listen …
ZCode 3.0: Offizieller Harness für GLM-5.2 mit Multi-Agent-Support
Was ist ZCode? ZCode ist der offizielle Harness für GLM-5.2 und positioniert sich als “Simple, Fast, Vibe-Ready”. Das Tool kombiniert AI-Agenten mit existierenden …
AI-Design-Horrors: Trumps .gov-Website-Redesign scheitert
Vor einem Jahr kündigte Trump per Executive Order das “National Design Studio” (NDS) an: Eine DOGE-ähnliche Einheit, die 27.000 .gov-Websites in drei Jahren mit …
Claude Code nutzt Steganographie für Request-Markierung
Ein Sicherheitsforscher hat eine versteckte steganographische Markierungsfunktion in Claude Code (Version 2.1.196) entdeckt. Der Client verändert stillschweigend Unicode-Zeichen im …
Claude Science Beta: Neues Produkt für wissenschaftliche Forschung
Anthropic hat Claude Science als Beta-Version veröffentlicht, ein neues Produkt, das speziell auf wissenschaftliche Forschung und akademische Arbeit ausgerichtet ist. Das Produkt …
Claude Sonnet 5: Das agenticste Sonnet-Modell von Anthropic
Anthropic hat Claude Sonnet 5 veröffentlicht, das laut Unternehmen das agenticste Sonnet-Modell bisher ist. Das neue Modell kann Pläne erstellen, Tools wie Browser und Terminals …
Export-Kontrollen für Claude Fable 5 und Mythos 5 aufgehoben
Anthropic hat bekanntgegeben, dass das US-Handelsministerium (Department of Commerce) die Export-Kontrollen für Claude Fable 5 und Mythos 5 aufgehoben hat. Ab morgen beginnt das …
Google DeepMind: Nano Banana 2 Lite für schnelle Bildgenerierung
Google DeepMind hat Nano Banana 2 Lite (Gemini 3.1 Flash-Lite Image) veröffentlicht, das schnellste und effizienteste Bild-Generierungsmodell der Gemini-Familie. Das Modell verscht …
Hugging Face und Cerebras: Gemma 4 für Echtzeit-Voice-AI
Hugging Face und Cerebras haben eine Partnerschaft angekündigt, um Gemma 4 für Echtzeit-Voice-AI zugänglich zu machen. Die Demo zeigt einen vollständig offenen …
KI-Browser in Gefahr: Neue Attacke umgeht Sicherheitsbarrieren
KI-gestützte Browser versprechen die Zukunft des Internets: Mit einem einzigen Prompt können sie Restaurants finden, Reservierungen buchen und E-Mails senden. Doch neue Forschung …
Mistral veröffentlicht Leanstral 1.5 - Schnelles, kostengünstiges Modell
Mistral AI hat Leanstral 1.5 veröffentlicht, ein neues Modell unter dem “Labs”-Label, das auf Geschwindigkeit und Performance optimiert ist. Das Modell ist ab sofort …
LongCat-2.0: 1.6T MoE-Modell mit 48B Active Parameters
LongCat-2.0 ist ein neues Mixture-of-Experts (MoE) Modell mit 1.6 Billionen Total Parametern und 48 Milliarden Active Parameters. Besonders: Die Architektur ist auf …
Open Memory Protocol: Ein Standard für portable AI-Memory
Das AI Memory Silo Problem: Jedes AI-Tool erinnert sich anders – und nur innerhalb seiner eigenen Mauern. Claude weiß, was du gestern gesagt hast. Cursor nicht. ChatGPT hat deine …
OpenAI Codex: Issue zu sensiblen Dateien bleibt offen
Ein Issue im OpenAI Codex Repository mit über 450 Reaktionen fordert einen Mechanismus, um sensible Dateien explizit vom Zugriff des Agenten auszuschließen. Der Vorschlag: Ein …
Ornith-1.0: Self-Improving Open-Source Modelle für Agentic Coding
Ornith-1.0 ist eine neue Familie von Open-Source-Modellen für agentic Coding mit einem innovativen Ansatz: Self-Improvement durch Reinforcement Learning. Verfügbare Varianten: …
DSpark: Spekulative Dekodierung beschleunigt LLM-Inferenz
Das Problem der langsamen Inferenz Große Sprachmodelle sind langsam bei der Token-Generierung. Jeder Token erfordert einen vollständigen Forward-Pass durch das Modell — selbst bei …
GLM 5.2 übertrifft Claude in Cybersicherheit-Benchmarks
Open-Weight-Modell schlägt Frontier-Modell In einer überraschenden Wendung hat das offene GLM 5.2-Modell von Zhipu AI Claude Opus 4.8 in Semgrep’s IDOR-Sicherheitsbenchmark …
DocumentDB: Microsofts Open-Source MongoDB-Alternative auf PostgreSQL
Microsoft überrascht mit einem neuen Open-Source-Projekt: DocumentDB, eine MongoDB-kompatible Dokumentdatenbank, die auf PostgreSQL aufbaut. Die MIT-lizenzierte Lösung verspricht …
Google erklärt: Was bedeutet 'Full-Stack' bei AI?
Der Begriff “Full-Stack” hat sich von der Web-Entwicklung in die AI-Welt übertragen. Aber was bedeutet es wirklich, wenn ein Unternehmen “Full-Stack-AI” …
Was passiert, wenn du einen CUDA-Kernel ausführst?
Die meisten Entwickler nutzen GPUs als Black Box: Man schreibt einen CUDA-Kernel, startet ihn, und irgendwie funktioniert es. Doch was passiert wirklich zwischen dem …
WATaBoy: Game Boy Emulation via JIT-to-WebAssembly
Ein faszinierendes Experiment zeigt, dass Just-in-Time-Kompilierung zu WebAssembly schneller sein kann als ein nativer Interpreter. WATaBoy, entstanden als Abschlussprojekt, …
WAL-RUS: ClickHouse schreibt Postgres-Backups in Rust neu
ClickHouse Cloud hat WAL-RUS vorgestellt, eine Open-Source-Rust-Implementierung für PostgreSQL-Backups und WAL-Archivierung. Das Tool wurde entwickelt, um ein spezifisches Problem …
AMD Strix Halo RDMA Cluster Setup Guide für vLLM
Ein neuer GitHub-Guide von kyuz0 zeigt detailliert, wie man RDMA-Cluster mit AMD Strix Halo GPUs für vLLM-Inference-Workloads aufsetzt. Das Repository enthält praktische Skripte, …
Google drosselt Metas Gemini-Nutzung: Rechenleistung wird zum Engpass
In einem bemerkenswenden Wendepunkt des aktuellen KI-Wettbewerbs hat Google die Nutzung seiner Gemini-Modelle durch Meta beschränkt. Laut einem Bericht des Financial Times teilte …
Ford hat AI eingestellt und Menschen entlassen. Es ist schiefgegangen
Der US-Automobilhersteller Ford hat zugegeben, nach einer aggressiven AI-Automatisierungsstrategie Hunderte menschlicher Arbeitskräfte wieder einstellen zu müssen. Das Unternehmen …
Cybersecurity nach Mythos: Warum die Branche ruhig bleiben sollte
Nach der Ankündigung und dem kurzen Release von Claude Mythos und Fable 5 hat die Cybersecurity-Branche aufhorchen lassen. Morgan Hotonnier von Cephalosec argumentiert in einem …
Exploitarium: Anonymes GitHub-Repo veröffentlicht dutzende unveröffentlichte 0-Days
Ein anonymer GitHub-Account unter dem Namen “bikini” hat ein Repository namens exploitarium veröffentlicht, das eine wachsende Sammlung von Proof-of-Concept-Exploits …
Prognose: Open-Source-LLMs erreichen Frontier-Parität im Dezember 2026
Eine neue Analyse von Doubleword zeigt eine faszinierende Entwicklung im KI-Modell-Markt: Open-Source-LLMs könnten bereits am 3. Dezember 2026 die Leistungsfähigkeit geschlossener …
US-Regierung gibt Anthropic Mythos 5 frei - GPT-5.6 parallel veröffentlicht
Die US-Regierung hat am Freitag die Blockade von Anthropics mächtigstem KI-Modell Claude Mythos 5 aufgehoben und mehr als 100 US-Institutionen den Zugriff gewährt. Parallel …
2.000 Hacker gegen einen AI-Assistenten - Die Ergebnisse
Fernando Irarrázaval hat ein faszinierendes Experiment durchgeführt: Er baute hackmyclaw.com, wo über 2.000 Menschen versuchten, seinen AI-Assistenten “Fiu” dazu zu …
AI-Industrie investiert Hunderte Millionen in US-Wahlkampf
Brian Merchant und Molly White haben eine neue Podcast-Serie gestartet: Blood in the Machine: The Show. Die erste Episode behandelt ein brisantes Thema - wie die AI-Industrie …
Anthropic fordert Strafen gegen Alibaba für größten Claude-Klon-Angriff
Anthropic hat in einem Brief an US-Senatoren schwere Vorwürfe gegen den chinesischen Konzern Alibaba erhoben. Demnach führte Alibaba zwischen dem 22. April und 5. Juni den bislang …
CVE-2026-LGTM: Wenn KI-Sicherheitstools versagen
Andrew Nesbitt hat einen brillanten Satire-Artikel veröffentlicht, der die Realität moderner AI-Sicherheitspraktiken auf die Spitze treibt. CVE-2026-LGTM ist ein fiktiver, aber …
Apple erhöht Preise deutlich – Speicherkrise durch AI-Boom
Apple hat heute Preiserhöhungen für seine gesamte Mac- und iPad-Produktpalette angekündigt. Die Preise steigen teilweise um mehrere hundert Dollar – ein MacBook Neo kostet jetzt …
IBM präsentiert erste Sub-1-Nanometer-Chiptechnologie
IBM hat eine bahnbrechende “Nanostack”-Chiparchitektur angekündigt, die als weltweit erste Sub-1-Nanometer-Technologie für AI-Rechenzentren beworben wird. Die neue …
Anthropic führt Claude Tag ein: @Claude für Teams in Slack
Anthropic hat Claude Tag vorgestellt – eine neue Integration, die Claude direkt in Slack-Kanäle bringt. Mit einem einfachen @Claude können Teams den KI-Assistenten in ihre …
OpenAI präsentiert 'Jalapeño': Erster eigener Inference-Chip mit Broadcom
OpenAI hat seinen ersten selbstentwickelten Inference-Prozessor namens Jalapeño offiziell vorgestellt. Der Chip wurde in Zusammenarbeit mit Broadcom entworfen und speziell für die …
Token-Kosten optimieren: Was LLMs über Code-Style verraten
Jim Montgomery hat eine detaillierte Analyse veröffentlicht, wie LLMs ineffizienten Code generieren – und wie das die Token-Kosten treibt. Die Erkenntnis: Modelle greifen auf …
Microsofts Quanten-Durchbruch entlarvt: Grundlegende Python-Fehler und cherry-picked Daten
In einem bemerkenswerten peer-reviewten Paper in Nature wirft Dr. Henry Legg von der University of St Andrews Microsoft fundamentale Fehler in seinen Quantencomputer-Behauptungen …
OpenAI und Broadcom enthüllen LLM-optimierten Inference-Chip 'Jalapeno'
OpenAI hat gemeinsam mit Broadcom den “Jalapeno” Inference-Chip angekündigt – einen Spezialprozessor, der explizit für Large Language Model Inferenz entwickelt wurde. …
Cory Doctorow: Wie man die KI-Blase platzt
Die KI-Blase und ihre Wurzeln Cory Doctorow, bekannt für seine Analyse der “Enshittification” der digitalen Welt, hat ein neues Buch veröffentlicht: “The Reverse …
Tesla Autopilot: Tödlicher Unfall beim Einfahren in Wohnhaus
Die US-Verkehrssicherheitsbehörde NHTSA hat eine Untersuchung gegen Tesla eingeleitet, nachdem ein mit Autopilot fahrender Tesla in ein Wohnhaus fuhr und die darin befindliche …
Ultralytics YOLO26: NMS-freie Echtzeit-Erkennung
Ultralytics hat YOLO26 vorgestellt, die neueste Generation der beliebten Echtzeit-Objekterkennungsmodelle. Die wichtigste Neuerung: YOLO26 eliminiert die Abhängigkeit von …
VibeThinker-3B: 3B-Modell schlägt Opus 4.5 im Reasoning
Ein chinesisches Forschungsteam hat mit VibeThinker-3B ein kompaktes Sprachmodell vorgestellt, das verblüffende Ergebnisse im Bereich des verifizierbaren Reasoning erzielt. Das …
Claude Code's Extended Thinking ist eine Zusammenfassung, kein authentisches Denken
Ein Sicherheitsforscher hat eine kritische Entdeckung über Claude Code gemacht: Die “Extended Thinking”-Logs, die für Audit-Trails gedacht sind, enthalten nicht das …
NVIDIA Halos: Vollständiges AV-Sicherheitssystem von Cloud bis Auto
NVIDIA launcht Halos: Ein Full-Stack-Sicherheitssystem für autonome Fahrzeuge, das die gesamte Entwicklung von Training bis Deployment abdeckt. Halos vereint Hardware, Software und …
Claude führt Identity Verification ein
Anthropic führt Identity Verification für Claude ein. Die Maßnahme dient dazu, Missbrauch zu verhindern, Nutzungsrichtlinien durchzusetzen und gesetzliche Vorgaben einzuhalten. …
Fine-Tuning Qwen 3:0.6B für Frage-Kategorisierung: 10% auf 92% Genauigkeit
Torgeir Helgevold von Teach Me Cool Stuff veröffentlichte einen detaillierten Erfahrungsbericht über das Fine-Tuning eines kleinen lokalen LLMs. Das Ziel: Hausbesitzer-Fragen …
George Hotz: Die Doom-Rhetorik rechtfertigt die Bewertung
George Hotz, Gründer von comma.ai und bekannter Hacker, veröffentlichte einen scharfen Kommentar zur AI-Doom-Rhetorik der San Francisco Bay Area. Die These Hotz argumentiert, dass …
Sakana Fugu: Multi-Agent-System als einziger API-Endpunkt
Sakana AI, das japanische AI-Research-Unternehmen hinter der Evolution-basierten Modelloptimierung, lanciert Sakana Fugu – ein Multi-Agent-System, das als einheitlicher …
Claude Opus 4.7 steuert Roboter-Hund 20x schneller als Menschen
Anthropic veröffentlichte Project Fetch: Phase Two, eine faszinierende Fortsetzung ihres Roboter-Experiments von August 2025. Die Kernbotschaft ist bemerkenswert: Claude Opus 4.7 …
Wann ich AI-Code ablehne – selbst wenn er funktioniert
Vinicius Brasil beschreibt in When I reject AI code even if it works eine zunehmende Herausforderung: Review-Kosten werden zum neuen Bottleneck bei der Arbeit mit Coding Agents. …
Building Reliable Agentic AI Systems: Bayers PRINCE Case Study
Martin Fowler veröffentlicht eine tiefgehende Fallstudie über den Aufbau produktionsreifer agenter AI-Systeme. Das Paper präsentiert PRINCE (Preclinical Information Center), eine …
Cloudflare Temporary Accounts: KI-Agenten deployen ohne OAuth-Wall
Cloudflare löst eines der größten UX-Probleme für AI-Agenten: Authentifizierung und Account-Erstellung. Die neue Funktion ermöglicht es Agenten, Cloudflare-Worker zu deployen, ohne …
Lispy: Wie man einen Lisp-Interpreter in Python schreibt
Peter Norvigs “How to Write a (Lisp) Interpreter (in Python)” ist eines der berühmtesten Tutorials zur Sprachimplementierung. Der Artikel erklärt, wie man einen …
GPT-5.5 halluziniert 3x häufiger als MIT-lizensiertes GLM-5.2
Eine neue Analyse zeigt ein überraschendes Ergebnis: Größere LLMs halluzinieren signifikant mehr als kleinere Modelle mit besserer Unsicherheits-Kalibrierung. Die Studie von …
John Jumper verlässt Google DeepMind für Anthropic
John Jumper, einer der führenden US-Wissenschaftler im Bereich KI und AlphaFold-Mitentwickler, verlässt Google DeepMind und wechselt zu Anthropic. Nach Reuters berichtet Jumper …
Künstliche Intelligenz rostet unsere Fähigkeiten: Studien zeigen besorgniserregende Ergebnisse
Drei Studien in Nature dokumentieren einen besorgniserregenden Trend: KI-Tools führen zu messbarem Fähigkeitsverlust bei Medizinern und Software-Entwicklern. Die Studie “Is …
10.000 GitHub-Repos verbreiten Trojaner-Malware
Systematische Infrastruktur entdeckt Ein Sicherheitsforscher hat eine großangelegte Malware-Verteilungskampagne auf GitHub aufgedeckt: 10.000 Repositories verbreiten Trojaner, und …
AI Engineer entschlüsselt Linear A mit Claude Code
Durchbruch mit Claude Code Tom Di Mino, ein autodidaktischer AI Engineer und Hobby-Linguist, behauptet, das Unmögliche erreicht zu haben: Die Entschlüsselung von Linear A, einem …
Datasette Apps: HTML+JavaScript in Datasette sandboxen
Simon Willison hat mit Datasette Apps ein neues Plugin für sein SQLite-basiertes Datenbank-Framework veröffentlicht. Die Innovation: Selbstständige HTML+JavaScript-Applikationen …
MosaicLeaks: Datenschutz-Benchmark für Deep-Research Agents
ServiceNow Research hat mit MosaicLeaks einen neuen Benchmark veröffentlicht, der ein unterschätztes Privacy-Problem bei Deep-Research Agents aufdeckt: Mosaic Leakage. Wenn Agenten …
Token Compression Tools: Warum RTK kritisch betrachtet werden sollte
Ein kritischer Blick auf Token-Optimierungs-Tools wie RTK: Der Autor argumentiert, dass die versprochenen Ersparnisse oft ein Trugschluss sind. RTK komprimiert Bash-Output, …
Zero-Touch OAuth für MCP: Enterprise-Managed Authorization
Das Model Context Protocol (MCP) bekommt mit Enterprise-Managed Authorization (EMA) eine wichtige Erweiterung für Unternehmensumgebungen. Statt dass Nutzer jeden MCP-Server einzeln …
Angetriebene AI-Modelle sind unvermeidbar – Anthropic-Blockade ist nur der Anfang
Die US-Regierung hat eine Export-Control-Direktive erlassen, die Anthropics neue Claude Fable 5 und Mythos 5 Modelle blockiert. Grund: Die Modelle haben fortschrittliche …
LLM Battle Royale: Grok 4.1 Fast dominiert, Claude will Freundschaft schließen
Was passiert, wenn man 11 Large Language Models in ein Battle-Royale-Spiel wirft und sie 30 Runden gegeneinander antreten lässt? Jacky Liang von OpenRouter hat genau das getan – …
Nvidias ENPIRE: AI-Coding-Agenten trainieren Roboter autonom über Nacht
Nvidias GEAR Lab (Generalist Embodied Agent Research) hat ENPIRE veröffentlicht – ein Agent-Harness, der AI-Coding-Agenten befähigt, physische Roboter völlig autonom zu trainieren. …
Anthropic stoppt Preiserhöhung für Claude Agent SDK
Der geplante Wechsel Am 13. Mai 2026 kündigte Anthropic eine grundlegende Änderung der Abrechnung für das Claude Agent SDK an: Nutzung über Agent SDK und Drittanbieter-Apps würde …
Google AMIE: Medical AI für langfristiges Krankheitsmanagement in Nature veröffentlicht
Von Diagnose zu Behandlung Eine Diagnose zu stellen ist der erste Schritt bei der Behandlung eines Patienten. Sobald die Diagnose feststeht, wird die Herausforderung zum …
GPT-NL: Die Niederlande bauen ihr eigenes souveränes LLM
Das Projekt Die Niederlande investieren 13,5 Millionen Euro in GPT-NL – ein souveränes Sprachmodell, entwickelt von TNO (Netherlands Organisation for Applied Scientific Research) …
Kritische Microsoft Copilot Lücke: 2FA-Codes per Prompt Injection gestohlen
Die Schwachstelle Microsoft hat am vergangenen Dienstag eine als “kritisch” eingestufte Lücke in M365 Copilot gepatcht. Security-Firma Varonis zeigt nun, wie ihre …
Leaked: OpenAI verbrennt Milliarden trotz rasantem Umsatzwachstum
Die Zahlen Journalist Ed Zitron und die Financial Times haben geleakte, geprüfte Finanzberichte von OpenAI analysiert. Das Bild ist eindeutig: Jahr Umsatz R&D Kosten …
Pentagon nutzt KI für Congressional Reports: 1.5M Nutzer auf GenAI.mil
Die Zahl 1.5 Millionen Mitarbeiter des US-Verteidigungsministeriums haben über GenAI.mil Zugang zu generativer KI – hauptsächlich Google Cloud’s Gemini for Government. Die …
SpaceX kauft Cursor für $60 Mrd. – AI-Coding-Markt konsolidiert
Die Akquisition SpaceX erwirbt den AI-Code-Editor Cursor für $60 Milliarden in einem reinen Aktiendeal. Die Transaktion soll im dritten Quartal 2026 abgeschlossen werden. Der …
Wolfram Language 15: Eingebaute AI-Assistentin und Symbolic Music
Das Release Stephen Wolfram hat Version 15 der Wolfram Language und Mathematica angekündigt – ein massives Update mit Fokus auf praktische AI-Integration. Die Highlights 1. AI …
Kritische Copilot-Schwachstelle ermöglichte Diebstahl von 2FA-Codes
SearchLeak: Neue Prompt-Injection-Attacke auf Microsoft Copilot Microsoft hat am vergangenen Dienstag eine als “maximal kritisch” eingestufte Schwachstelle in seiner …
US-Regierung zwingt Anthropic zur Abschaltung von Fable 5 und Mythos 5
Export-Control-Direktive gegen Anthropic: Politische Retaliation statt Sicherheitsbedenken Am Freitagmorgen traf das US-Handelsministerium Anthropic mit einer obskuren …
Microsoft weicht für GitHub auf AWS aus – AI-Coding überlastet Azure
Microsoft nutzt überraschend AWS-Infrastruktur, um die durch AI-Coding-Agenten verursachte Überlastung von GitHub abzufangen. Die im Jahr 2018 angekündigte vollständige Migration …
Rio de Janeiros 'eigenes' LLM entpuppt sich als Model-Merge-Diebstahl
Ein GitHub-Issue deckt auf: Das von Rio de Janeiro als „heimisch" beworbene 397B-Modell Rio-3.5-Open-397B ist ein direkter elementweiser Merge von zwei existierenden Modellen …
10th Gen Honda Civic: AOSP Test Keys Enable Evil Valet Attack
Drei Jahre nach seiner initialen Forschung an Hondas Infotainment-System veröffentlicht Eric McDonald ein kritisches Update: Die 10. Generation Honda Civic HeadUnits sind mit …
APT Encounters of the Third Kind: Incident Response Deep Dive
Was als routine Security-Assessment begann, wurde zu einem unvergesslichen Incident-Response-Abenteuer. Igor’s detaillierter Bericht zeigt, wie tief man graben muss, um einen …
Human Routers of Machine Words
Ein leidenschaftlicher Essay von Fernando Borretti argumentiert, dass KI-geschriebene Inhalte nicht nur质量问题 sind – sie repräsentieren einen fundamentalen Missverständnis über die …
ReactOS Läuft Half-Life mit 3D-Beschleunigung auf Echter Hardware
Nach 28 Jahren Entwicklung erreicht ReactOS einen symbolischen Meilenstein: Die Windows-Version von Half-Life läuft nun mit 3D-Beschleunigung auf echter Hardware. Der Kontext …
Cloud-LLM Gold Rush vorbei: Apple setzt auf lokale KI
Die Zäsur Apples WWDC 2026 Ankündigung ist mehr als Siri-Verbesserungen. Es ist ein Strategie-Wechsel, der die KI-Landschaft neu definiert: Apple glaubt, dass für die meisten …
TensorZero archiviert nach $7.3M Seed: Das Ende eines Open-Source-Projekts
Die Überraschung Das GitHub-Repository von TensorZero wurde am 12. Juni 2026 auf “archived” gesetzt – nur lesbar, keine weiteren Commits, Issues oder Pull Requests …
Jeff Bezos gründet AI-Superstar Prometheus mit $12 Milliarden Funding
Jeff Bezos hat mit seiner neuen KI-Firma Prometheus eine weitere gewaltige Finanzierungsrunde abgeschlossen: $12 Milliarden zusätzlich zu den $6,2 Milliarden vom letzten Jahr. Die …
US-Regierung zwingt Anthropic zur Abschaltung von Claude Fable 5 und Mythos 5
Anthropic hat am 12. Juni 2026 abrupt den Zugang zu den Modellen Fable 5 und Mythos 5 für alle Nutzer deaktiviert. Grund ist eine Export-Control-Direktive der US-Regierung, die …
AI-Agent kostet Operator 6.500 Dollar durch DN42-Scan
Ein AI-Agent versuchte, dem DN42-Hobbynetzwerk beizutreten und einen Netzwerk-Scan durchzuführen – und hinterließ dabei eine AWS-Rechnung von 6.531,30 Dollar. Der Operator ist nun …
Claude Fable ist 'relentlessly proactive' – Simon Willison dokumentiert autonomes Verhalten
Simon Willison beschreibt in einem faszinierenden Blogpost sein zweiwöchiges Erlebnis mit Claude Fable 5. Sein Fazit: Das Modell ist “relentlessly proactive” – es setzt …
Anthropic: 30-Tage Data-Retention für Mythos
Die neue Policy Ab dem 9. Juni 2026 verlangt Anthropic eine 30-Tage-Datenspeicherung für alle Mythos-Klasse-Modelle (Mythos 5, Fable 5 und zukünftige Modelle ähnlicher …
Fable Guardrails: Security-Forscher unzufrieden
Die Enttäuschung Anthropic hat Claude Fable als öffentliche, limitierte Version des viel gehypten Mythos-Cybersecurity-Modells veröffentlicht. Aber Security-Forscher zeigen sich …
€0.01 Banküberweisung könnte Banking-AI-Agenten kompromittieren
Ein Security-Forschungsteam von Blue41 hat eine kritische Schwachstelle in AI-gestützten Banking-Assistenten demonstriert: Indirect Prompt Injection über …
Apache Burr: Neues Framework für zuverlässige AI-Agents und Applikationen
Das Apache Software Foundation Incubator-Projekt Burr bietet eine Python-First-Lösung für Entwickler, die AI-Agenten und -Applikationen mit echter Zuverlässigkeit bauen wollen. …
WebRTC Debugging: Wie ein iPad-Freeze zwei Bugs in einem Trenchcoat enthüllte
Eine faszinierende Debugging-Story von einem Entwickler, der zwei Wochen brauchte, um einen scheinbar simplen Fehler zu verstehen: Ein iPad fror bei WebRTC-Verbindungen über …
Claude Fable 5: Anthropic veröffentlicht erstes Mythos-Modell mit eingebauten Safeguards
Anthropic hat mit Claude Fable 5 sein erstes „Mythos-Klasse"-Modell veröffentlicht, das nach eigenen Angaben die bisherigen Opus-Modelle in den Gesamtcapabilities übertrifft. …
Deutsches Gericht macht Google für AI-Overviews haftbar
Das Landgericht München hat mit einem Präzedenzurteil entschieden: Google haftet direkt für falsche Behauptungen in seinen KI-generierten Such-Overviews. Die bisherige …
Gemini 3.5 Live Translate: Echtzeit-Stimme-zu-Stimme-Übersetzung
Google hat Gemini 3.5 Live Translate vorgestellt, ein Speech-to-Speech-Modell für Echtzeit-Übersetzung in über 70 Sprachen. Das Modell gehört zur Gemini-3.5-Familie und ist …
Apple macht AI für Indies kostenlos: Foundation Models ohne Cloud-Kosten
Auf der WWDC 2026 hat Apple eine überraschende Ankündigung gemacht: Kleine Entwickler können Apples Foundation Models und Private Cloud Compute kostenlos nutzen. Das Angebot gilt …
FrontierCode: Neuer Benchmark misst echte Code-Qualität
Cognition AI, das Unternehmen hinter dem AI-Software-Entwickler Devin, hat FrontierCode vorgestellt - einen bahnbrechenden Benchmark, der die Messung von Code-Qualität …
NotebookLM Upgrade: Gemini 3.5 und Antigravity Integration
Google hat NotebookLM sein größtes Update seit dem Launch 2023 verpasst. Das Tool zum Analysieren von Dokumenten mit KI bekommt Gemini 3.5, Code-Ausführung via Antigravity und …
Siri AI: Apple bringt endlich echten KI-Assistent
Nach jahrelanger Ankündigung und Verspätungen zeigt Apple auf der WWDC 2026 endlich konkrete Fortschritte: Siri AI kommt “dieses Herbst” und verspricht einen …
"Chat is dead": OpenAI preps overhaul of ChatGPT
OpenAI bereitet die größte Überarbeitung von ChatGPT seit dem Start vor. Das $850 Milliarden-Unternehmen plant, den Chatbot in eine “Superapp” zu transformieren, die …
90210: Open-Source KI-Movie-Generator mit Veo 3.1 und Gemini
90210: Open-Source KI-Movie-Generator mit Veo 3.1 und Gemini Ein neues Open-Source-Projekt namens 90210 ermöglicht die vollautomatische Produktion von Kurzfilmen aus Drehbüchern. …
Algorithmische Monokulturen im Recruiting: Studie deckt systemische Probleme auf
Algorithmische Monokulturen im Recruiting: Studie deckt systemische Probleme auf Forscher der Stanford University veröffentlichten die bislang größte empirische Studie zu …
DeepSeek V4 Pro übertrifft GPT-5.5 Pro bei Präzision
DeepSeek V4 Pro übertrifft GPT-5.5 Pro bei Präzision In einem aktuellen Head-to-Head-Benchmark von RuntimeWire wurde DeepSeek V4 Pro gegen OpenAIs GPT-5.5 Pro getestet. Das …
9 Mothers (YC P26) stellt ein
Y Combinator P26-Startup 9 Mothers aus Austin sucht 12 neue Mitarbeitende für Counter-Drone-Systeme. Das Unternehmen: AI-gestützte Missionssysteme für Drohnenabwehr – Wahrnehmung, …
AI-Waffenerkennung gescheitert: Schüler verklagt Hersteller
Ein verletzter Schüler aus Nashville verklagt den Hersteller eines AI-Waffenerkennungssystems, das beim School Shooting im Januar 2025 versagte. Der Vorfall: Ein Schütze tötete …
Anthropic, bitte liefert Claude Desktop für Linux
Ein GitHub-Issue mit über 130k Sternen fordert eine offizielle Claude Desktop-Version für Linux. Der Issue verdeutlicht ein strukturelles Problem: Anthropic verteilt bereits …
Die besten Beziehungen sind allumfassend
Ein persönlicher Essay über die Entdeckung, dass eine Person alle sozialen Bedürfnisse erfüllen kann. These: Die besten Beziehungen sind allumfassend – Arbeit, Freundschaft, …
Kyushu: Self-Hostbare WASM-Sandbox für JavaScript Workers
Ein früheres Experiment ermöglicht Cloudflare Workers-Style Handler auf jedem VPS – ohne Node.js, Bun oder Docker. Das Konzept: Kyushu ist eine WebAssembly-Sandbox, die JavaScript …
Lathe: LLMs zum Lernen nutzen, nicht zum Überspringen
Ein neues Open-Source-Tool namens Lathe generiert praktische Tutorials, die du selbst durcharbeitest – statt KI deine Arbeit erledigen zu lassen. Das Konzept: Lathe erstellt …
LLMs untergraben meine Software-Engineering-Karriere
Ein persönlicher Blogpost auf Human in the Loop thematisiert die existentielle Krise eines Software Engineers durch die KI-Revolution. Der Titel ist auch die These: LLMs erodieren …
Podman 6: Machine-Usability-Verbesserungen
Podman 6 beseitigt eine historische Irritation im Machine-Handling: Provider-spezifische Maschinen sind jetzt transparent. Das Problem in Podman 5: Der CLI kannte nur Maschinen des …
Qwen 3.7 Max und die OnlyFans-Ökonomie der US-KI
Ein scharfer Essay über die Preisspirale der US-Frontier-Modelle und die Alternative aus China: Qwen 3.7 Max. Die Kritik: Der Autor wirft Anthropic Heuchelei vor – während Claude …
Training-Free Single-Image Diffusion Models
Ein neuer Forschungsansatz ermöglicht Diffusion-Modelle aus einem einzigen Referenzbild – ohne Training. Das Konzept: Statt ein neuronales Netz auf einem Einzelbild zu trainieren …
Vitamin D3 in der Schwangerschaft und kognitive Leistung mit 10 Jahren
Eine neue Studie im JAMA Network Open untersucht den Zusammenhang zwischen Vitamin-D3-Supplementierung während der Schwangerschaft und der kognitiven Leistung der Kinder im Alter …
Computex 2026: Steht uns die Agentic PC-Ära bevor?
Die Computex 2026 in Taipei markiert einen signifikanten Wandel: Nach zwei Jahren AI-PC-Hype dominiert dieses Jahr Agentic AI die Gespräche. Jensen Huang proklamierte in seiner …
S&P 500 lehnt SpaceX ab und blockiert OpenAI & Anthropic
Der S&P 500 hat überraschend einen Antrag von SpaceX auf beschleunigte Aufnahme in den Index abgelehnt. Damit verwehrt die Indexverwaltung Elon Musks Raumfahrt- und …
Estland testet: Diese LLMs widerstehen russischer Propaganda am besten
Das estnische Sprachinstitut veröffentlichte einen neuen Benchmark zur “Propaganda Resistance”. Als ehemalige Sowjetrepublik ist Estland besonders sensibilisiert für …
LLMs als Hacker: $1.500 Experiment zeigt überraschende Ergebnisse
Ein Security-Forscher verbrachte $1.500 um zu testen, ob moderne LLMs eine verwundbare App hacken können. Die Ergebnisse sind bemerkenswert: GPT-5.5 löste die Herausforderung in 7 …
Wie Anthropic Claude sicher in Produkten einsetzt
Anthropic veröffentlichte einen tiefgreifenden Einblick in ihre Agent-Sicherheitsarchitektur. Der Artikel “How we contain Claude across products” erklärt die …
Let's Encrypt plant Post-Quantum-Zertifikate mit Merkle Tree Certificates
Let’s Encrypt bereitet sich auf die Post-Quantum-Ära vor und kündigt Pläne für Merkle Tree Certificates (MTCs) an. Das Problem: Herkömmliche Post-Quantum-Signaturen wie …
Android erkennt Spoofed Calls und Deepfakes
Google kündigt auf der I/O 2026 neue Sicherheitsfeatures für Android an: Deepfake-Erkennung bei Anrufen und Spoof-Call-Detection. Mit der Zunahme von KI-generierten Stimmbetrug …
KI schlägt Jura-Professoren in Stanford-Studie
Eine Stanford Law School-Studie unter Professor Julian Nyarko zeigt ein überraschendes Ergebnis: Jura-Professoren bevorzugen in 75% der Fälle KI-generierte Antworten auf …
Können KI-Texte gut sein, die wir lesen wollen?
Jay Caspian Kang von The New Yorker stellt eine fundamentale Frage: Wie weit sind wir wirklich von KI-Texten, die nicht von Maschinen unterscheidbar sind? Er beschreibt einen …
Mathematiker warnen vor KI-Bedrohung ihres Berufs
Mathematiker besorgt über KI-Entwicklung: Während andere Disziplinen KI als Werkzeug begrüßen, wächst unter Mathematikern die Sorge, dass ihr Berufsstand existenziell bedroht ist. …
Project Solara: Microsofts Android für Agenten
Microsofts Project Solara ist ein Android-basiertes Betriebssystem, das nicht für Apps, sondern für AI-Agenten konzipiert ist. Das Konzept: “Just-in-time UI” – Agenten …
Dutzende Red Hat Pakete über offiziellen NPM-Kanal hinterrücks mit Backdoor versehen
Offizielle Red Hat NPM-Konten wurden kompromittiert und zur Verbreitung eines bösartigen Wurms genutzt, der sich von Maschine zu Maschine ausbreitet und sensible Credentials …
Florida verklagt OpenAI und Sam Altman nach mehreren Morden mit ChatGPT-Verbindung
Florida ist der erste US-Bundesstaat, der OpenAI wegen der angeblich gefährlichen Konstruktion von ChatGPT verklagt. In der am Montag eingereichten Zivilklage wirft …
GitHub Copilot: Nutzer schockiert über neues nutzungsbasiertes Preismodell
GitHub hat im April das Preismodell für seinen KI-gestützten Codierungs-Assistenten Copilot von anfragebasierter auf nutzungsbasierte Abrechnung umgestellt. Seit der Einführung …
Meta-AI-Support-Chatbot von Hackern ausgetrickst: Celebrity-Instagram-Accounts gestohlen
Metas KI-Support-Chatbot erwies sich als ungewöhnlich hilfreich für Hacker, die wertvolle Instagram-Accounts stehlen und weiterverkaufen wollten. Die Angreifer mussten den Bot nur …
Von 15 Stunden auf eine Minute: KI beschleunigt GMs Entwicklung massiv
General Motors durchläuft laut Sterling Anderson, dem neuen Chief Product Officer, die dritte Epoche des Engineerings. Nach der empirischen Iteration (Vögel beobachten, Flügel …
Trump startet Energie-Rabattprogramm mit kontroversen Bedingungen
Das US-Energieministerium hat die lang erwarteten Richtlinien für das 8,8 Milliarden Dollar starke Hausenergie-Rabattprogramm veröffentlicht, allerdings mit erheblichen …