Wissenschaft
KI-Forschung und Wissenschaft – neue Modelle, Studien und Durchbrüche aus Laboren und Universitäten, verständlich eingeordnet.
- Forschung
Vier KI-Paper: 6,5 % Tool-Resistenz, Mentalisierung, Labor-KI
Aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden in cs.AI, cs.LG und cs.CL wählt dieser Digest vier Arbeiten, die zusammen zeigen, wie brüchig Verlässlichkeit heutiger KI-Agenten…
- Forschung
Vier KI-Paper: 70 % Fähigkeitsverlust, Bias, Freigabe-Verfall
Aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden in cs.AI, cs.LG und cs.CL wählt dieser Digest vier Arbeiten, die zusammen zeigen, wie brüchig Verlässlichkeit, Aktualität und Fairness…
- Forschung
Fünf KI-Paper: 6,5 % Reproduzierbarkeit, Jailbreak-Fuzzing
Aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden in cs.AI, cs.LG und cs.CL wählt dieser Digest fünf Arbeiten, die zusammen zeigen, wie unterschiedlich robust, nachvollziehbar und…
- Forschung
Fünf KI-Paper: Bit-Flip-Attacke, Auditoren, Agentenkosten
Aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden in cs.AI, cs.LG und cs.CL wählt dieser Digest fünf Arbeiten, die zusammen zeigen, wie verwundbar, schwer prüfbar und unberechenbar…
- Forschung
Fünf neue KI-Paper: Mathe-Entdeckung, Täuschungs-Spuren, Aufsicht
Aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden in cs.AI, cs.LG und cs.CL wählt dieser Digest fünf Arbeiten, die zusammen ein Spektrum von reiner KI-Fähigkeit bis zu offenen…
- Forschung
Fünf neue KI-Paper: Testerkennung, Schmeichel-Effekt, RAG-Kollaps
Aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden in cs.AI, cs.LG und cs.CL wählt dieser Digest fünf Arbeiten, die eine gemeinsame Frage verbindet: Wie verlässlich sind eigentlich die…
- Forschung
Vier neue KI-Paper: Wer delegiert, Sprachbias, Introspektion
Aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden in cs.AI, cs.LG und cs.CL wählt dieser Digest vier Arbeiten, die jeweils eine eigene Frage zur Vertrauenswürdigkeit heutiger…
- Forschung
Fünf neue KI-Paper: 47-fache Attention, Agenten-RL, Fairness
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden verbindet fünf Fragen, die selten gemeinsam auftauchen: wie sich lange Kontextfenster drastisch beschleunigen…
- Forschung
Fünf neue KI-Paper: Geheimnis-Leck, Tool-Fehler, Kreativitätsschwund
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden verbindet fünf Fragen, die selten gemeinsam auftauchen: wie leicht sich sensible Daten allein über harmlose…
- Forschung
Vier neue KI-Paper: Gedächtnis, Sicherheits-Training, Kompression
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden verbindet vier Fragen, die selten gemeinsam auftauchen: wie zuverlässig Gedächtnissysteme von KI-Agenten sich…
- Forschung
Vier neue KI-Paper: UI-Agenten wanken, Richter-Bias, Code-Robustheit
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden verbindet vier Fragen, die selten gemeinsam auftauchen: wie verlässlich KI-Agenten grafische Bedienoberflächen…
- Forschung
Vier neue KI-Paper: Ködertrick, Claude gewinnt Gold, Agenten-RL
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen Tage verbindet vier Fragen, die selten gemeinsam auftauchen: wie sich entfernte Sicherheitssperren offener Modelle nachträglich noch…
- Forschung
Vier neue KI-Paper: Geheimcode, Metrikfehler, 80.000 Fälle
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen Tage verbindet vier Fragen, die selten gemeinsam auftauchen: ob eine der meistgenutzten Erfolgsmetriken für Coding-Agenten überhaupt…
- Forschung
Bremen empfängt IJCAI-ECAI: erstmals seit 43 Jahren in Deutschland
Bremen ist von 15. bis 21. August 2026 Gastgeber der IJCAI-ECAI, einer der ältesten und bedeutendsten KI-Fachkonferenzen. Nach der letzten deutschen Ausrichtung 1983 in Karlsruhe kommen rund 4.000…
- Forschung
Vier neue KI-Paper: Erklärbarkeits-Zweifel, Verhandlung, Vergessen
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen Tage verbindet vier Fragen, die selten gemeinsam auftauchen: wie verlässlich angebliche Erklärungen für KI-Entscheidungen wirklich…
- Forschung
Vier neue KI-Paper: 90-Prozent-Ausfall, Fusion, Wissenschafts-KI
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen Tage verbindet vier Fragen, die selten gemeinsam auftauchen: wie verlässlich Agenten-Verbünde rechnerisch wirklich sind, wie stark…
- Forschung
Vier neue KI-Paper: Agenten-Risiko, Kosten-Falle, Aufsicht
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden verbindet vier Fragen, die selten gemeinsam auftauchen: wie sicher sich selbstlernende Agenten tatsächlich…
- Forschung
Vier neue KI-Paper: Richter-Wanken, Sprachrisiko, Tempo
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden verbindet vier Fragen, die selten gemeinsam auftauchen: wie stabil automatisierte KI-Bewertung wirklich ist, wie…
- Forschung
Vier neue KI-Paper: Rechenzentrum-Energie, Sicherheit, Überredung
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden verbindet vier unterschiedliche Ebenen des KI-Betriebs: den Stromverbrauch großer Trainingscluster, die interne…
- Forschung
Vier neue KI-Paper: Ideenviren, Daten-Agenten, Roboter-Attacken
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden verbindet vier Ebenen des KI-Betriebs, die selten gemeinsam betrachtet werden: die soziale Dynamik zwischen…
- Forschung
Vier neue KI-Paper: Raumverständnis, Denkbudget und Sprachlücke
Die heutige Auswahl aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden ist bewusst breit gestreut: Statt eines gemeinsamen Nenners stehen vier Arbeiten nebeneinander, die jeweils eine…
- Forschung
Vier neue KI-Paper: Aufsicht, Skalierung, Agenten-Ausdauer
Die Auswahl der vergangenen 24 bis 48 Stunden auf arXiv fällt heute bewusst breit aus: Statt eines einzelnen dominanten Themas stehen vier Arbeiten nebeneinander, die jeweils eine andere Ebene des…
- Forschung
Vier neue KI-Paper: Skill-Verfall, Verlaufs-Angriffe, Bild-Illusion
Die Redaktion wählt vier Paper aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden, die zeigen, wie brüchig Selbstverbesserung, Werkzeugnutzung und interne Nachvollziehbarkeit heutiger…
- Forschung
Google DeepMind: WeatherNext warnt einen Tag früher vor Wirbelstürmen
Google DeepMind hat mit WeatherNext ein KI-Modell vorgestellt, das Wirbelstürme einen Tag früher mit der bisherigen Genauigkeit vorhersagt. Laut einer in der Fachzeitschrift Nature veröffentlichten…
- Forschung
Vier neue KI-Paper: Benchmark-Lücken, Tools, Verschwörung
Die Redaktion wählt vier Paper aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden, die zeigen, wie brüchig die Grundlagen aktueller KI-Systeme in Messung, Werkzeugnutzung, Sicherheit…
- Forschung
Vier neue KI-Paper: Jailbreak-Grammatik, Schmeichelei und Anonymität
Die Redaktion wählt vier Paper aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden, die zeigen, wie unterschiedlich weit Kontrolle und Verlässlichkeit heutiger KI-Systeme derzeit reichen…
- Forschung
Vier neue KI-Paper: Großmodell, Fake-Profile, Panel-Fehlalarme
Die Redaktion wählt vier Paper aus den arXiv-Einreichungen der vergangenen 24 bis 48 Stunden, die zeigen, wie unterschiedlich weit Fähigkeit, Vertrauenswürdigkeit und Effizienz heutiger KI-Systeme…
- Forschung
Vier neue KI-Paper: Denksicherheit, Kooperation, Tempo
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden vier Arbeiten, die zeigen, wie unterschiedlich weit KI-Forschung derzeit vorankommt – von einer Sicherheitslücke…
- Forschung
Vier neue KI-Paper: Red-Teaming, Werkzeug-Fehler, Gedächtnis
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden vier Arbeiten, die zeigen, wie weit gestiegene Agenten-Fähigkeiten und die Werkzeuge zu ihrer Kontrolle derzeit…
- Forschung
GPT-5.6 löst sechs Jahre altes Quantenkryptografie-Rätsel doppelt
Zwei Forschungsteams haben unabhängig voneinander mit OpenAIs Sprachmodell GPT-5.6 Sol Ultra ein sechs Jahre altes Problem der Quantenkryptografie gelöst: die effiziente unklonierbare…
- Forschung
Vier neue KI-Paper: Agenten-Sicherheit, Schmeichelei, Effizienz
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden vier Arbeiten, die zeigen, wie sehr sich Fähigkeit, Sicherheit und Mess-Zuverlässigkeit heutiger KI-Systeme…
- Forschung
Vier neue KI-Paper: Agentenschutz, Quantisierung, HLE-Kritik
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen Tage vier Arbeiten, die zeigen, wie sich Sicherheits- und Bewertungslücken heutiger KI-Systeme oft erst bei genauerem Hinsehen…
- Forschung
Vier neue KI-Paper: Rechercheagent, Merging, Tutor-Urteil
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden vier Arbeiten, die zeigen, wie weit Fähigkeit und Verlässlichkeit heutiger KI-Systeme derzeit auseinanderfallen …
- Forschung
Vier neue KI-Paper: Kompression, Täuschung, Gedächtnis
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden vier Arbeiten, die zeigen, wie weit Fähigkeit und Verlässlichkeit heutiger KI-Systeme auseinanderfallen können …
- Forschung
Vier neue KI-Paper: Forschungsagenten, Prompt-Schutz, Kosten
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden vier Arbeiten aus, die zeigen, wie unterschiedlich weit KI-Systeme heute tatsächlich tragen – von eigenständiger…
- Forschung
Vier neue KI-Paper: Sprachbias, Kernel-Turbo, Quantisierungs-Lücke
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden vier Arbeiten aus, die zeigen, wie stark Faktoren wirken, die auf den ersten Blick nebensächlich erscheinen …
- Forschung
Vier neue KI-Paper: Verborgenes Denken, Harness-Bias, Schutz
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen 24 bis 48 Stunden vier Arbeiten, die zeigen, wie viel an heutigen KI-Systemen unsichtbar bleibt oder sich einfacher Messung entzieht…
- Forschung
Vier neue KI-Paper: Agenten schummeln, Copyright, Red-Team-Limits
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen Tage vier Arbeiten, die zeigen, wie brüchig die Messgrundlagen von KI-Systemen selbst noch sind – von Agenten-Benchmarks über…
- Forschung
Vier neue KI-Paper: Multi-Turn-Abwehr, RL-Falle, Sierra Leone
Die Redaktion wählt aus den arXiv-Neueinreichungen der vergangenen Tage vier Arbeiten, die zeigen, wie brüchig Kontrolle, Trainingsmethodik und Messbarkeit heutiger KI-Systeme bleiben – und wo KI im…
- Forschung
Vier neue KI-Paper: Manipulation, Sycophancy, Effizienz
Die heutige Auswahl kuratiert vier arXiv-Preprints der vergangenen ein bis zwei Tage nach Substanz und thematischer Streuung: Sie reichen von einer Sicherheitslücke bei mehrstufigen Agenten-Workflows…
- Forschung
Vier neue KI-Paper: Persona-Unterraum, Forschungsagenten, Übereifer
Die heutige Auswahl kuratiert vier arXiv-Preprints der vergangenen ein bis zwei Tage nach Substanz und thematischer Streuung: Sie reichen von einem mechanistischen Blick auf die Ursachen von…
- Forschung
Vier neue KI-Paper: Solar Open 2, Agenten-Risiken, Guardrails
Die heutige Auswahl kuratiert vier arXiv-Preprints der vergangenen ein bis zwei Tage nach Substanz und thematischer Streuung: Sie reichen von einem neuen offenen Sprachmodell über zwei Arbeiten zu…
- Forschung
Vier neue KI-Paper: Jailbreak, Agenten-Autonomie, Fußball
Die heutige Auswahl kuratiert vier arXiv-Preprints der letzten ein bis zwei Tage nach Substanz und thematischer Streuung: Alle vier liefern eine nachvollziehbare Methode und belastbare Zahlen im…
- Forschung
Vier neue KI-Paper: Biorisiko, Sycophancy, Suchparadox
Die heutige Auswahl kuratiert vier arXiv-Preprints der vergangenen Tage nach Substanz und Themenbreite: Alle vier liefern eine nachvollziehbare Methode und belastbare Zahlen im Abstract, decken aber…
- Forschung
Vier neue KI-Paper: Wasserzeichen scheitern vor Gericht
Die heutige Auswahl kuratiert vier arXiv-Preprints der vergangenen Tage nach Substanz und Themenbreite: Alle vier liefern eine nachvollziehbare Methode und belastbare Zahlen im Abstract, decken aber…
- Forschung
Vier neue KI-Paper: Datenvergiftung, Täuschung, Agenten
Die Auswahl von heute folgt einem roten Faden: Alle vier Preprints kreisen um blinde Flecken heutiger KI-Systeme – vergiftbare Trainingsdaten, unsichtbare Täuschungsmechanismen und Agenten, die sich…
- Forschung
GPT-5.6 widerlegt zwanzig Jahre alte Statistikannahme in 90 Minuten
Der Statistiker Edgar Dobriban von der University of Pennsylvania hat mit dem Sprachmodell GPT-5.6 Sol Pro eine seit zwanzig Jahren als gesichert geltende Annahme über das…
- Forschung
Anthropic-Studie: Claude antwortet auf Hindi wärmer als auf Russisch
Anthropic hat eine Studie zu den Werten seines KI-Modells Claude veröffentlicht, die je nach Sprache und Modellversion deutliche Unterschiede findet. Auf Hindi und Arabisch antwortet das Modell…
- Forschung
Soofi S: Deutsches Konsortium veröffentlicht offenes KI-Modell
Ein deutsches Forschungskonsortium hat mit Soofi S ein offenes Sprachmodell veröffentlicht, das gezielt für Deutsch und Englisch trainiert wurde. Das Modell mit 31,6 Milliarden Parametern soll nach…
- Forschung
Google trainiert SensorFM an 1 Billion Minuten Wearable-Daten
Google Research hat mit SensorFM ein KI-Modell vorgestellt, das allgemeine Muster menschlicher Gesundheit aus Wearable-Daten lernt. Grundlage sind mehr als eine Billion Minuten Sensormesswerte von…
- Forschung
Oak Lab: Sutton baut KI-Agenten, die im Einsatz lernen
Reinforcement-Learning-Pionier Richard Sutton hat mit seinem früheren Doktoranden Khurram Javed das Start-up Oak Lab gegründet. Das in Kanada ansässige Unternehmen will KI-Agenten entwickeln, die…
- Forschung
AgenticSTS: Neues KI-Gedächtnis verdoppelt Gewinnquote im Kartenspiel
Ein internationales Forschungsteam hat mit AgenticSTS ein neues Gedächtnissystem für KI-Agenten vorgestellt, getestet im Kartenspiel Slay the Spire 2. Fünf getrennte Speicherschichten ersetzen dabei…
- Forschung
GPT-5.6 Sol Ultra beweist Mathe-Vermutung – Fachwelt prüft noch
OpenAI hat am Freitag einen Beweis für die Cycle-Double-Cover-Vermutung veröffentlicht, ein seit fünfzig Jahren ungelöstes Problem der Graphentheorie. Das Sprachmodell GPT-5.6 Sol Ultra erstellte den…
- Forschung
Orca: BAAI-Weltmodell erreicht Robotik-Leistung ohne Aktionsdaten
Das Pekinger Forschungsinstitut Beijing Academy of Artificial Intelligence (BAAI) hat mit Orca ein neuartiges Weltmodell vorgestellt, das Text, Bilder und Roboterbefehle aus einer einzigen internen…
- Forschung
OpenAI: SWE-Bench Pro zu rund 30 Prozent fehlerhaft
Zwei Tage nach dem breiten Rollout von GPT-5.6 hat OpenAI eine eigene Empfehlung zurückgezogen: Der Coding-Benchmark SWE-Bench Pro, den das Unternehmen erst im Februar 2026 als Messlatte für die…
- Forschung
arXiv:2607.08716 – Proaktiver Memory-Agent für Langzeit-Agenten
Hinweis: Dies ist die Zusammenfassung eines aktuellen, (noch) nicht peer-begutachteten arXiv-Preprints. Die beschriebenen Ergebnisse stammen aus einer einzelnen Studie und sind bislang nicht…
- Forschung
arXiv:2607.08734 – Die Illusion der Äquivalenz bei Quantisierung
Hinweis: Bei der hier besprochenen Arbeit handelt es sich um einen arXiv-Preprint. Sie hat noch kein reguläres Peer-Review-Verfahren durchlaufen; die Ergebnisse sind unabhängig noch nicht bestätigt.
- Forschung
arXiv:2607.08740 – Semantisches Gedächtnis für LLM-Workflows
Hinweis: Bei der hier besprochenen Arbeit handelt es sich um einen arXiv-Preprint. Sie hat noch kein reguläres Peer-Review-Verfahren durchlaufen; die vorgestellten Konzepte sind unabhängig noch nicht…
- Forschung
arXiv:2607.08745 – VQA-Benchmark für Unfallszenen per Dashcam
Ein Forschungsteam um Siddharth Damodharan, Radhika Gupta, Ali Alshami, Ryan Rabinowitz und Jugal Kalita hat mit AUTOPILOT VQA einen neuen Benchmark vorgestellt, der prüft, wie gut multimodale…
- Forschung
arXiv:2607.08758 – Ideas Have Genomes: Ideen-Stammbäume für KI
Hinweis: Bei der hier besprochenen Arbeit handelt es sich um einen arXiv-Preprint. Sie hat noch kein reguläres Peer-Review-Verfahren durchlaufen; die berichteten Ergebnisse sind unabhängig noch nicht…
- Forschung
arXiv:2607.08748 – KI-Lernassistenten im Hochschulstudium
Hinweis: Dieser Beitrag beschreibt einen (noch) nicht peer-begutachteten arXiv-Preprint. Die berichteten Ergebnisse stammen von den Autorinnen selbst und sind bislang unabhängig ungeprüft.
- Forschung
arXiv:2607.07321 – EvoSOP: SOPs für selbstlernende LLM-Agenten
Hinweis: Dieser Beitrag beschreibt einen (noch) nicht peer-begutachteten arXiv-Preprint. Die berichteten Ergebnisse stammen von den Autoren selbst und sind bislang unabhängig ungeprüft.
- Forschung
arXiv:2607.08573 – SHAP-gewichtete Fusion für Emotionserkennung
Hinweis: Dieser Beitrag beschreibt einen aktuellen, noch nicht durch unabhängige Gutachter geprüften arXiv-Preprint (Stand: 9. Juli 2026). Die berichteten Ergebnisse stammen aus der Publikation der…
- Forschung
arXiv:2607.08602 – Klinisches KI-Modell für Leberkrebs-Therapie
Hinweis: Dieser Beitrag fasst einen aktuellen, noch nicht peer-begutachteten arXiv-Preprint zusammen. Die Ergebnisse sind vorläufig und stammen aus einer einzelnen, von den Autoren durchgeführten…
- Forschung
arXiv:2607.08625 – Wie Kommunikationsstil die KI-Triage beeinflusst
Hinweis: Dieser Beitrag fasst einen aktuellen, noch nicht peer-begutachteten arXiv-Preprint zusammen. Die Ergebnisse sind vorläufig.
- Forschung
arXiv:2607.08652 – Formale Mechanismen für stabile KI-Agentenmärkte
Hinweis: Dieser Beitrag fasst einen aktuellen, noch nicht peer-begutachteten arXiv-Preprint zusammen. Die Ergebnisse sind vorläufig und stammen aus einer einzelnen Simulationsstudie.
- Forschung
arXiv:2607.08681 – SolarChain-Eval: KI-Agenten im Energiemarkt
Dies ist die Zusammenfassung eines aktuellen arXiv-Preprints (Stand: 9. Juli 2026). Der Beitrag ist noch nicht von unabhängigen Gutachtern (Peer Review) geprüft worden; die Ergebnisse sind vorläufig.
- Forschung
arXiv:2606.15954 – Green SARC: Budget-Governance für KI-Agenten
Hinweis: Dieser Beitrag beschreibt einen (noch) nicht peer-begutachteten Preprint auf arXiv. Die genannten Ergebnisse sind vom Fachpublikum bislang nicht unabhängig geprüft.
- Forschung
arXiv:2606.15956 – TDV: Selbstüberwachtes Sehen ohne feste Annahmen
Hinweis: Dieser Beitrag beschreibt einen (noch) nicht peer-begutachteten Preprint auf arXiv. Die genannten Ergebnisse sind vom Fachpublikum bislang nicht unabhängig geprüft.
- Forschung
arXiv:2606.15963 – PreLort: LoRA für Federated Fine-Tuning
Hinweis: Dieser Beitrag beschreibt einen (noch) nicht peer-begutachteten Preprint auf arXiv. Die genannten Ergebnisse sind vom Fachpublikum bislang nicht unabhängig geprüft.
- Forschung
arXiv:2606.15943 – Graphmodelle für generative KI-Software-Systeme
Hinweis: Dieser Beitrag beschreibt einen (noch) nicht peer-begutachteten Preprint auf arXiv. Die genannten Inhalte sind vom Fachpublikum bislang nicht unabhängig geprüft.
- Forschung
arXiv:2606.15959 – Verlustbehaftete Kompression für KI-Surrogate
Hinweis: Dieser Beitrag beschreibt einen aktuellen arXiv-Preprint (arXiv:2606.15959, eingereicht am 14. Juni 2026). Ein Preprint ist noch nicht von unabhängigen Fachgutachtern geprüft worden; die…