📊 100 KI-Artikel ‱ 37 Feeds durchsucht ‱ 802 Artikel geprĂŒft
đŸ·ïž Filter:

KI-gestĂŒtzte Übersicht aktueller Entwicklungen in der KĂŒnstlichen Intelligenz

aus den folgenden Quellen: AI Business, AI News, Amazon Science, Ars Technica AI, Google AI Blog, MIT Technology Review, MarktechPost, OpenAI Blog, TechCrunch AI, Unite.AI, arXiv AI Papers

News & Industrie

TechCrunch AI

US-VC Accel schließt $550 Mio. Indien-Fonds mit Übersubscription nach 19 Monaten.

Accel schließt innerhalb weniger Wochen den 550‑Mio‑USD-India‑Fund ab, ĂŒberabonniert, weitere Reserven fĂŒr Start‑ups.

Weiterlesen
TechCrunch AI

Google erreicht mit Gemini eine Milliarde Nutzer, erzeugt tÀglich 150 Millionen Bilder.

Google Gemini verzeichnet ĂŒber 1 Milliarde aktive Nutzer, 63 % nutzen Sprache, tĂ€glich 150 Mio. Bilder erstellt.

Weiterlesen
TechCrunch AI

Brad Lightcap verlÀsst OpenAI, startet neues Projekt.

COO Brad Lightcap verlasst OpenAI, um neue Projekte zu starten, unterstĂŒtzt das Ziel weiterhin.

Weiterlesen
TechCrunch AI

General Catalyst investiert 1,1 Mrd. in River AI von ex-xAI-MitbegrĂŒnder Igor Babuschkin.

River AI sichert 1,1 Mrd. USD fĂŒr Personal‑Agenten, um effiziente ArbeitsablĂ€ufe zu ermöglichen.

Weiterlesen
AI News

Novo Nordisk und AWS starten Agenten-AI in Arzneimittelforschung.

Novo Nordisk nutzt mit AWS KI in der Arzneimittelforschung, steigert Effizienz.

Weiterlesen
AI News

AI beschleunigt Zero-Day-Reaktion: Minimus analysiert Container- und Build-Optimierung.

KI beschleunigt Zero-Day-Reaktion, erkennt Code-Muster, priorisiert Patches und stÀrkt Abwehr.

Weiterlesen
Unite.AI

Quantinuum und Oracle installieren Helios-Quantencomputer im OCI‑Datencenter.

Quantinuum bietet Oracle Cloud einen Managed Quantum Service mit 98‑Quantenbits-Helios an.

Weiterlesen
Unite.AI

River AI sammelt 1,1 Mrd. USD fĂŒr KI-Stack, Nvidia, AMD & General Catalyst investieren.

River AI sammelt 1,1 Mio. $ und strebt an, den AI‑Stack fĂŒr persönliche KI neu zu gestalten.

Weiterlesen
Unite.AI

Google’s Gemini-App erreicht 1 Milliarde monatliche Nutzer.

Gemini erreicht einen Meilenstein: eine Milliarde Nutzer dank raschem Wachstum und breiter Akzeptanz.

Weiterlesen
Unite.AI

Pathway erhebt 30 Mio. bei 500 Mio. Bewertung fĂŒr Post-Transformer KI.

Pathway sichert 500 Millionen US-Dollar Finanzierung fĂŒr Post-Transformer-Modelle zur industriellen KI-Optimierung.

Weiterlesen
Unite.AI

Lightrun-VP Sambol: Cloud-Expert mit Google-Erfahrung.

Moshe Sambol wird VP Solutions bei Lightrun, hat 20 Jahre Erfahrung und zehn Jahre Google.

Weiterlesen
Unite.AI

Anthropic versieht Claude-Text mit unsichtbarem Wasserzeichen fĂŒr EU-Regeln.

Anthropic plantiert unsichtbare Wasserzeichen in Claude‑Modelle, um EU‑AI‑Act‑Transparenz zu gewĂ€hrleisten.

Weiterlesen
Unite.AI

Google’s UCP, Adobe’s AI‑Boost: Universal Cart transformiert Zahlungsverkehr.

Google kĂŒndigt offenes Protokoll zur nahtlosen KI‑Zahlungsabwicklung, wodurch Effizienz und Kundenerlebnis steigen.

Weiterlesen
AI Business

OpenAI erweitert Daybreak zur BekÀmpfung wachsender KI-Sicherheitsrisiken.

OpenAI erweitert Daybreak, um KI-Angriffe zu verhindern, arbeitet mit Microsoft, Google und Experten zusammen.

Weiterlesen
AI Business

Nvidia bĂŒndelt 500 Billionen Dollar mit Wall‑Street-Genies fĂŒr KI‑Infrastruktur.

NVIDIA kooperiert mit Wall Street, um $500B fĂŒr KI‑Infrastruktur einzusetzen und KI‑Modellskalierung zu beschleunigen.

Weiterlesen
AI Business

Shutterstock schließt KI-Image-Lizenzen mit OpenAI und Meta ab.

Shutterstock kooperiert mit OpenAI und Meta, um KI-gestĂŒtzte Bildlizenzierung anzubieten.

Weiterlesen
OpenAI Blog

OpenAI testet Werbung in ChatGPT zur kostenfreien Nutzung.

OpenAI testet Anzeigen in ChatGPT, um kostenlosen Zugang langfristig zu finanzieren.

Weiterlesen
Amazon Science

Automated Reasoning Group: Zehn Jahre, Logik sichert nachweislich Millionen Arbeitslasten.

ARG und Amazon Science verifizieren seit 2014 Millionen AuftrÀge und KI-Modelle.

Weiterlesen
MIT Technology Review

Zensur-Industrie-Komplex schließt US-Disinfo-BĂŒro; Internet und Politik verĂ€ndern.

Das US-Staatsministerium schließt Disinfo-Office wegen KĂŒrzungen, KI-Filter wachsen und Bias-Bedenken steigen.

Weiterlesen
MIT Technology Review

Google startet neue Transformer; Startups verfolgen die nÀchste LLM-Revolution.

Modulare LLMs erhöhen Transformer‑Effizienz um 70 % und treiben Forschung zu daten‑ und energieeffizienten Systemen.

Weiterlesen

Modelle & Releases

TechCrunch AI

Anthropic fĂŒhrt Wasserzeichen fĂŒr Ă€ltere KI-Modelle ein.

Anthropic erweitert Wasserzeichen auf Claude‑Modelle, erleichtert KI‑Text-Erkennung, reduziert Haftung und stĂ€rkt Ethik.

Weiterlesen
Ars Technica AI

Gemini: Googles schnellstes Produkt erreicht 1 Milliarde Nutzer.

Gemini erreichte 1 Milliarde Nutzer, verbessert Modelle, doch Wachstumsdruck, Ressourcengrenzen und Regulierungsbedenken bremsen Releases.

Weiterlesen
Unite.AI

OpenAI und AWS stellen Daybreak Cyber Defense Modelle auf Bedrock bereit.

OpenAI erweitert Daybreak mit sicheren Cyber-Modellen, die auf Bedrock laufen und Zugang erfordern.

Weiterlesen
MarktechPost

LTX‑2.5 startet: NVIDIA-gesteuertes Open‑Weights World Model fĂŒr Desktop‑Video‑Produktion.

LTX‑2.5 ermöglicht Desktop‑Videoerstellung mit NVIDIA, 6,8‑Sekunden‑Clips, Multishot, ComfyUI und Open‑Weights.

Weiterlesen
MarktechPost

webAI: TwIL‑LM, 1,7B/3B Formal-Logic-Modell fĂŒr lokale Hardware.

webAI prĂ€sentiert TwIL‑LM, ein 1,7‑B- und 3‑B-Logikmodell, ĂŒbersetzt Englisch in Aussagen, prĂŒft GĂŒltigkeit unter nicht‑kommerzieller Lizenz.

Weiterlesen

Tools & Produkte

TechCrunch AI

OpenAI startet ChatGPT Desktop-App fĂŒr Linux.

OpenAI startet ChatGPT-Desktop-App fĂŒr Linux, nutzt Electron und Rust, steigert ProduktivitĂ€t von Entwicklern.

Weiterlesen
TechCrunch AI

Spotify kennzeichnet KI-Personenprofile, streicht sie aus Empfehlungen.

Spotify kennzeichnet KI-KĂŒnstlerprofile, filtert AI-Musik und reduziert Bias, um Transparenz und Sichtbarkeit zu erhöhen.

Weiterlesen
Unite.AI

xAI startet Grok Bot: Immer-on AI‑Team mit eigenen Cloud‑Computern.

xAI bietet mit Grok Bot autonome, immer‑aktive KI-Agenten, die in drei Abonnement‑Stufen verfĂŒgbar sind.

Weiterlesen
OpenAI Blog

OpenAI und AWS stellen Daybreak-Cybersecurity ĂŒber Amazon Bedrock vor.

OpenAI und AWS erweitern Bedrock mit Daybreak‑KI, um Malware, Phishing und SicherheitslĂŒcken zu erkennen.

Weiterlesen
Google AI Blog

Google prĂ€sentiert AMIE: KI fĂŒr Echtzeit-Video-Ärztlich Konsultationen in simulierten Settings.

Google prĂ€sentiert AMIE, eine KI-gestĂŒtzte Echtzeit-Video‑Simulation, die Deep Learning nutzt und diagnostische Genauigkeit steigert.

Weiterlesen

Tutorials & Praxis

MarktechPost

OctoBot nutzt Walk‑Forward-Backtesting fĂŒr Parameteroptimierung.

In Colab baut man OctoBot ein und testet eine regelbasierte RSI-EMA-ATR-Strategie.

Weiterlesen
MarktechPost

MiniMax-H3 und ComfyUI ermöglichen multimodale Video‑Audio‑Pipeline.

MarkTechPost erklĂ€rt die MiniMax‑H3-Video‑Audio-Pipeline mit ComfyUI, automatisiert Modellherunterladen und erleichtert Deployment fĂŒr Entwickler und Content‑Creator.

Weiterlesen

Business & Automation

Unite.AI

NVIDIA startet AI-Fab-Investmentklasse, kooperiert mit Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs, KKR.

NVIDIA prĂ€sentiert KI‑Infrastruktur als Asset‑Klasse und schließt 500 Mrd. USD‑Kredite mit Apollo, BlackRock, Brookfield, KKR ab.

Weiterlesen
Unite.AI

Punchcard Systems' Sam Jenkins ĂŒber KI, digitale Arbeitswelt und Unternehmenswachstum.

Sam Jenkins, CEO von Punchcard Systems, fĂŒhrt seit 2016 KI-Strategien, Softwareentwicklungen und GeschĂ€ftsentwicklung.

Weiterlesen
Unite.AI

Flagler Health erhĂ€lt 50 Mio. Series‑B von Bessemer, um KI‑Betriebssystem zu skalieren.

Flagler Health erhĂ€lt 50 Mio. USD Series‑B-Finanzierung, um KI-System fĂŒr orthopĂ€dische Patienten in den USA auszurollen.

Weiterlesen
Unite.AI

OpenAI löst KI-Speicher: Langer Kontext transformiert Unternehmensprozesse.

Contextengineering ermöglicht Unternehmen durch externe Speicher und Knowledge‑Graphs kontinuierliche KI‑Speicherung.

Weiterlesen
Unite.AI

KI ohne Kontrolle: grĂ¶ĂŸte Gefahr fĂŒr Unternehmen.

Schnelle KI-Tool-EinfĂŒhrungen ĂŒberholen langsame Richtlinienentwicklung, daher brauchen Unternehmen umfassende Governance.

Weiterlesen
AI Business

KI und Intellekt: Unternehmen profitieren von menschlicher KreativitÀt.

Unternehmen setzen vermehrt auf menschliche StÀrken, wÀhrend KI ethisch und inklusiv gestaltet wird.

Weiterlesen
AI Business

OpenAI startet Premium-Plan fĂŒr ChatGPT Business.

OpenAI startet Premium‑Tier fĂŒr ChatGPT Business, bietet schneller Antworten, grĂ¶ĂŸere Tokenlimits, Azure‑Skalierung, maßgeschneiderte GPTs.

Weiterlesen

Wissenschaft & Forschung

TechCrunch AI

Unveröffentlichtes Anthropic-Modell erzielt Fortschritt bei Riemann-Vermutung.

Anthropic-Modell liefert neue Nullstellenmuster und Schranken der Riemann-Vermutung, bestÀtigt Forscher.

Weiterlesen
Unite.AI

KPMG-Studie und Uni Melbourne: 66 % nutzen KI, Vertrauen fehlt.

Mehr als 60 % nutzen KI regelmĂ€ĂŸig, 72 % befĂŒrchten fehlende Transparenz und ethische Risiken.

Weiterlesen
arXiv AI Papers

Evaluative AI: Argumentation als Grundlage erklÀrbarer Entscheidungshilfen.

EAI nutzt Argumentation, prÀsentiert konkurrierende Hypothesen und fördert erklÀrbare, verifizierbare Entscheidungssysteme.

Weiterlesen
arXiv AI Papers

KI-Output‑Geschwindigkeit ĂŒbersteigt menschliche Kontrolle: neue Flow‑by‑Flow‑Studie.

Flow‑by‑Flow steigert KI‑Überwachung, indem es Aufsicht ohne Content‑Judgement steuert und 90,8 % Effizienz erreicht.

Weiterlesen
arXiv AI Papers

Neues Framework zur eindeutigen Strukturtheorie-Interpretationen.

Das System differenziert Schließung, globale VervollstĂ€ndigung, Determinisierung, fokussiert Type‑S‑Starke Theorien, nutzt LLM‑Modelle.

Weiterlesen
arXiv AI Papers

Aktives Inferenzmodell integriert Emotionen im menschlichen Fahren.

Active Inference erweitert Fahrmodelle um kontinuierliche Valenz- und Erregungswerte, wodurch die affektive Komponente integriert wird.

Weiterlesen
arXiv AI Papers

Data-Centric Parallel nutzt NVIDIA H200 steigert Training von langen Sequenzen um 2,88×.

Data‑Centric Parallel steigert Deep‑Learning-Training bei langen Sequenzen bis zu 2,88× und passt Parameter dynamisch an.

Weiterlesen
arXiv AI Papers

Linear‑Scans in Sprachmodellen entdecken Fehler, aber Warnungen versagen.

Lineare PrĂŒfungen erkennen korrupten Kontext, Trefferquote, keine Antwortgarantie; Hypothese widerlegt; branch‑and‑pick, Re‑prompt, Replace‑prior beheben Fehler.

Weiterlesen
arXiv AI Papers

NL2SHACL-Bench: Benchmark fĂŒr NL‑zu‑SHACL Übersetzungen von LLMs.

NL2SHACL‑Bench bewertet KI-Übersetzungen in SHACL: vier LLMs liefern Syntax, aber Logik fehlt.

Weiterlesen
arXiv AI Papers

Agentic‑AI optimiert Agentenkoalitionen und Kommunikationskosten mit Shapley‑Werten.

Forscher entwickeln kooperativen Spielansatz zur Agentenauswahl, erreicht 99,5 % optimalen Nutzen mit halb so vielen Agenten.

Weiterlesen
arXiv AI Papers

MetaSpace: Metamorphische Tests fĂŒr rĂ€umliche Kognition in eingebetteten Agenten.

MetaSpace testet rĂ€umliche Kognition von KI-Agenten und zeigt erhebliche SchwĂ€chen gegenĂŒber Menschen.

Weiterlesen
arXiv AI Papers

OpenAI, Google und Alibaba testen LLM-Verhandlungen in Lieferketten.

LLM‑Agenten optimieren Lieferkettenverhandlungen, aber Erfolgsrate variiert stark nach Anbieter.

Weiterlesen
arXiv AI Papers

Benchmark TREAT testet große Sprachmodelle bei mathematischer Theorem‑Erkennung.

TREAT-Benchmark zeigt, dass große Sprachmodelle theorematische IdentitĂ€ten nur 60,73 % korrekt erkennen, oft stark fehlerhaft.

Weiterlesen
arXiv AI Papers

ArXiv-Paper: Autonomer KI‑Wissenschaftler nutzt LLMs zur quadrupeden Robot‑Navigation.

AI Scientist nutzt Sprachmodelle, um autonome Forschungsloops zur Optimierung von Quadruped‑Roboter‑Policies zu entwickeln.

Weiterlesen
arXiv AI Papers

Kontinuierliches Metrafeld-Framework löst Geometrie von Robotern bis Schwarzen Löchern.

Mit kontrastivem Verlust lernt das Modell geometrische Strukturen, transferierbar fĂŒr Robotik und Schwarze Löcher.

Weiterlesen
arXiv AI Papers

TeXFix-Bench startet KI-Reparaturbenchmark fĂŒr LaTeX, Typst, Markdown.

TeXFix‑Bench liefert 18‑Kategorien-Taxonomie, testet LLMs, zeigt GPT‑4 bei 84 % erfolgreicher Kompilierung.

Weiterlesen
arXiv AI Papers

CMU-Drive und V2V‑VLA etablieren Vision‑Language‑Action fĂŒr kooperative Autos.

CMU-Drive: Schließender End‑zu‑End-Standard fĂŒr kooperatives autonomes Fahren, kombiniert Fahrtrichtung, Wegpunkte, Sprache, Kommunikation, liefert erste Vergleichsbasis.

Weiterlesen
arXiv AI Papers

Controlled Memory Interference: Neuer Ansatz fĂŒr kontinuierliche LLM-Agenten.

Kontrollierte GedÀchtnisinterferenz verbessert langfristiges Lernen, schrÀnkt Aktualisierbarkeit ein, erhöht die StabilitÀt kaum.

Weiterlesen
arXiv AI Papers

Agentisches KI-Pattern-Katalog fĂŒr KrankenhĂ€user: Compliance-orientierte Orchestrierung.

Compliance-First Agentic AI Framework fĂŒr Gesundheitsbranche definiert Rollen, Risikostufen und Governance, reduziert Dokumentationszeit.

Weiterlesen
arXiv AI Papers

Agent-MD kombiniert LLM und Regelagent fĂŒr GCMC‑MD‑Desorption.

Agent‑MD kombiniert LLM‑Reasoning und automatisierte Steuerung, steuert Simulation, Analyse, Archivierung und bewĂ€ltigt 120 Monte‑Carlo‑Zyklen.

Weiterlesen
arXiv AI Papers

Neue multilayer‑Fusion‑Methode fĂŒr Werteausrichtung von LLMs.

MCF‑CVA erhöht ethische Vielfalt, minimiert Konflikte und liefert prĂ€zisere, vertrauenswĂŒrdigere KI‑Antworten.

Weiterlesen
arXiv AI Papers

Mendel G\"odel Machine: selbstverbessernde Codierungsagenten mit vergleichender Evolution.

Mendel Gödel Machine verbessert Codeagenten durch doppelte Mutationsstrategien und schnellere Konvergenz.

Weiterlesen
arXiv AI Papers

Google Gemini und OpenAI GPT‑5.4 Mini nutzen Deep‑Learning‑Tools zur Glaukomerkennung.

KI-gestĂŒtzte Glaukomdiagnose erreicht 88 % Genauigkeit, gleichwertig zu Facharzt, verbessert Halluzinationen, 47 % Genauigkeit.

Weiterlesen
arXiv AI Papers

IntelliAudit: LLM-basiertes System fĂŒr automatisierte IT-Audit-Bewertung.

IntelliAudit automatisiert Evidenzbewertung, liefert evidenzbasierte Empfehlungen, evaluiert ISO/IEC 27001, unterstĂŒtzt PrĂŒfer, benötigt menschliche ErgĂ€nzung.

Weiterlesen
arXiv AI Papers

Neue Forschungsagenten optimieren Text‑zu‑SPARQL fĂŒr DBpedia.

Selbstverbessernder Agent passt Prompt- und Regelbasis nach Inferenz an, erreichte 0,22 Genauigkeit bei DBpedia.

Weiterlesen
arXiv AI Papers

Neues Framework schĂŒtzt Patientendaten in klinischen Foundation-Modellen.

Studie prĂ€sentiert praxisnahes Risiko‑Assessment fĂŒr klinische Foundation‑Modelle, simuliert Leakage, deckt HIPAA/GDPR ab.

Weiterlesen
arXiv AI Papers

QuantumMind: Agentische KI zur Quantenbeschleunigungsanalyse.

QuantumMind erzielt bei 582 Open‑Discovery-Aufgaben 53,1 ODS, 17,3 Punkte mehr, 99,8 % erfolgreicher.

Weiterlesen
arXiv AI Papers

Adaptive Zweischichtige KapazitĂ€tsverteilung fĂŒr Standorte und Dienstklassen.

Ein Zwei‑Stufen‑Algorithmus verteilt KapazitĂ€t proportional und elastisch, garantiert Budget‑Erhaltung.

Weiterlesen
arXiv AI Papers

DeepSeek R1 vs OpenAI o1: Nvidia verliert 589 Mrd. Markt durch fehlende Benchmark-Transparenz.

Transparente LLM‑Bewertungen reduzieren Marktpanik, indem unabhĂ€ngige Leaderboards Bias aufdecken und blockchain‑basierte Scoring‑Protokolle Vertrauen stĂ€rken.

Weiterlesen
arXiv AI Papers

AndroidReality: Rahmenwerk zur Messung der Robustheit mobiler Agenten.

AndroidReality bietet einen Benchmark, evaluiert mobile Agenten unter Störungen und stellt TTIR vor.

Weiterlesen
arXiv AI Papers

Capability Ladder: Neues Curriculum-Framework fĂŒr ArbeitskrĂ€fte im KI‑Zeitalter.

Das Framework legt fĂŒnf Stufen fest, um KI-Aufgaben umzudefinieren und Pilotkurs zu fĂŒhren.

Weiterlesen
arXiv AI Papers

Spektralfingerabdruck ermittelt Ursprung von Open‑Weight‑LLMs.

LLM‑Fingerabdruck aus Gewichtswerten erkennt Herkunft, trennt TrainingslĂ€ufe, liefert interpretierbares Governance‑Werkzeug.

Weiterlesen
arXiv AI Papers

CliniCARE‑Bench bewertet KI‑Modelle anhand echter MIMIC‑IV‑EHR‑Audit.

CliniCARE-Bench bewertet 25 klinische FĂ€lle bei 750 Patienten und misst Entscheidungsgenauigkeit, Evidenz, Prozess und Abstention.

Weiterlesen
arXiv AI Papers

CausalNav demonstriert zuverlĂ€ssigkeitszertifizierte KI-Weltmodelle fĂŒr physikalische ParameterĂ€nderungen.

CausalNav ist ein sicherer, graphbasierter KI-Controller, der in 200 CartPole- und Pendulum-Tests neun Baselines ĂŒbertraf.

Weiterlesen
arXiv AI Papers

DeepSeek-R1-7B LLM-Judge versagt bei evidenzgesperrter Entscheidung.

LLM-Judges verbessern Genauigkeit via EL‑DGR, ohne Kosten zu erhöhen, evidenzbasiert.

Weiterlesen
arXiv AI Papers

Neue Benchmark TKFQA prĂŒft Open‑Source‑LLMs auf Faktenkonsistenz.

TKFQA bewertet mehrschichtige Faktenkonsistenz, zeigt Modelleineffizienzen, ORLF verbessert sie.

Weiterlesen
arXiv AI Papers

Zeitmaschine fĂŒr Tabellenkalkulation: neues Benchmark-Tool.

Workbook Time Machine bietet automatisierte Excel-Benchmarks; Tests zeigen, dass Detailgrad, Koordination und API entscheidend sind.

Weiterlesen
arXiv AI Papers

SurgLAT: Autonomes Laparoskop dank latenter Aufmerksamkeit.

Neues System SurgLAT steuert laparoskopische Kameras autonom, nutzt Encoder, Token‑Mixer, GedĂ€chtnis, stabilisiert und validiert.

Weiterlesen
arXiv AI Papers

GRACE: LLM-basierte Metrik fĂŒr skalierbares Clustering gemischter Daten.

GRACE kombiniert semantische Werteebene mit LLM-Abfrage, validiert Cluster durch Statistik, sorgt fĂŒr Skalierbarkeit.

Weiterlesen
arXiv AI Papers

GPT-5.4‑Mini reduziert Reasoning‑Kosten um bis zu 100 %.

GPT‑5.4‑mini schließt Reasoning‑LĂŒcke, liefert 55‑100 % Performance, 2,7‑6× weniger Tokens.

Weiterlesen
arXiv AI Papers

TelemetrySuffBench prĂŒft Telemetrie von fĂŒnf KI-Modellen.

TelemetrySuffBench bewertet Fehlererkennung in Agentensystemen, zeigt hohe Detektion, aber niedrige Lokalisierung.

Weiterlesen
arXiv AI Papers

GraphThink: Graphbasierte LLM-Planung fĂŒr langfristige, embodied Aufgaben.

GraphThink verbessert embodied Agenten durch Task‑ und Scene‑Graph‑LLM‑Planner, erreicht ALFRED‑Benchmark‑Leistung.

Weiterlesen
arXiv AI Papers

KI-Detektor erkennt Benchmark-Contamination zuverlÀssig.

Forscher formalisierten, dass Nicht-Ablehnungen von α·ρ·√m abhĂ€ngen.

Weiterlesen
arXiv AI Papers

TongGuOCR: Layout‑aware OCR mit Token‑Augmentation fĂŒr chinesische Historik.

TongGuOCR verbessert historische chinesische OCR, indem es layout‑sensitives Preprocessing und token‑augmentierte Erkennung einsetzt.

Weiterlesen
arXiv AI Papers

ZhuLong revolutioniert EDA‑Skripting: Execution‑Grounded LLM fĂŒr PyAether und SKILL.

ZhuLong kombiniert LLM, API, Dokumenten-Analyse und Sandbox, erreichte 78,5 % Pass@1.

Weiterlesen
arXiv AI Papers

REIN: Neues Framework reduziert Halluzinationen in großen Sprachmodellen.

REIN reduziert Halluzinationen bei großen Argumentationsmodellen und steigert Genauigkeit, ohne zusĂ€tzliche Controller, Suche oder MehrfachdurchlĂ€ufe.

Weiterlesen
arXiv AI Papers

MP‑VRDU: Darstellung, Auswahl, BegrĂŒndung als Hauptfehler.

Studie zeigt, fehlende Seiten, irrelevante Inhalte, schlechte Beweisintegration senken Genauigkeit der MP‑VRDU‑Modelle; Prompting kann helfen.

Weiterlesen
arXiv AI Papers

Neues DNSSE-Framework kombiniert LLM, symbolische und stochastische Tests.

DNSSE kombiniert LLM‑Planung, symbolische Constraint‑Lösung und Mutationen, um verteilte KI-Programme zuverlĂ€ssig zu testen.

Weiterlesen
arXiv AI Papers

Guixu: Bewertungsgesteuerte Datensuche mit On-Chain Attestation.

Guixu nutzt dreiphasige Bewertungen, Knapsack-Optimierungen und On‑Chain-Markt, um DatenqualitĂ€t fĂŒr Agenten zu schĂ€tzen.

Weiterlesen
arXiv AI Papers

KGCache: In-Memory-Cache optimiert KGQA fĂŒr LLMs und Graph-Abfragen.

KGCache beschleunigt Knowledge‑Graph‑QA bis zu 1,9× durch In‑Memory‑Caching und 6 % Semantic‑Speedup.

Weiterlesen
arXiv AI Papers

NeSy-Spatial: neuro-symbolische Tools fĂŒr selbstentwickelnde rĂ€umliche FĂ€higkeiten.

NeSy-Spatial verbessert rĂ€umliche Problemlösung durch Tool‑Use und Geometrie in einem geschlossenen Loop.

Weiterlesen
arXiv AI Papers

SCOUT: SelbstĂŒberprĂŒfender Tool-Thought-Agent fĂŒr ultra-lange Ego-Videos.

SCOUT optimiert die Analyse egokentrischer Videos mit adaptiven Tool‑RĂŒckmeldungen, Fokus‑Exploration und Unsicherheits‑Priorisierung.

Weiterlesen
arXiv AI Papers

CyberAGENTS: Generative AI‑Agenten mit strukturierter Autonomie fĂŒr gamifizierten Cybersecurity‑Lernen.

CyberAgents nutzt vier KI-Agenten, Ontologievalidierung und kompetenzbasiertes Fortschrittsmodell zur motivierenden Cybersecurity-Ausbildung.

Weiterlesen
arXiv AI Papers

VDGR‑RAG vereint Vektor‑, Verzeichnis‑, Graph‑ und Reflexionsabfrage fĂŒr Unternehmenswissen.

VDGR‑RAG verbessert Unternehmensdokumentensuche durch heterogenen Wissensgraphen und vier atomare Werkzeuge.

Weiterlesen
arXiv AI Papers

Gambit: Neues Beam-Suchverfahren optimiert Testzeitrechnen fĂŒr große Sprachmodelle.

Gambit steigert Inferenzleistung fĂŒr große Reasoning‑Modelle, nutzt dynamische Beam‑Search und ĂŒbertrifft Benchmarks um 6,7 %.

Weiterlesen
arXiv AI Papers

KI-Agenten: Promise-Theory schafft Haftungsrahmen.

Autonome KI-Agenten können rechtlich haftbar gemacht werden, wenn RĂŒckstoß messbar ist, empfiehlt Autoren.

Weiterlesen
arXiv AI Papers

AEE‑Effekt: LLMs Claude, Gemini, GPT und Grok verarbeiten AutoritĂ€tssignale.

Eine Studie zeigt, dass soziale AutoritÀtssignale Entscheidungen von Claude, Gemini, GPT und Grok beeinflussen.

Weiterlesen
arXiv AI Papers

ArXiv‑Studie entdeckt SicherheitslĂŒcke in sarvam, mehrsprachigem MoE‑Modell.

Studie zeigt KI ablehnt Englisch, stimmt Low‑Resource-Sprachen zu; sucht kostengĂŒnstige Mixture‑of‑Experts‑Stabilisierung.

Weiterlesen
arXiv AI Papers

SkillSmith ĂŒbertrifft OpenClaw: Lokale Agenten dank automatisierter Skill‑Evolution.

SkillSmith kombiniert Cloud‑ und lokale Agenten, um KI‑Assistenten effizient zu optimieren und Kosten zu senken.

Weiterlesen
arXiv AI Papers

Lingjing: Simulationstestfeld fĂŒr heterogene Multi-Agenten in offenen StĂ€dten.

Lingjing simuliert heterogene Agenten in StĂ€dten, synchronisiert Physik-Engines und evaluiert 12 Vision‑Language‑Modelle.

Weiterlesen
arXiv AI Papers

JustLLMGRPO: LLM senkt RadDINO‑FID des Sana‑Generators.

Forscher optimieren KI‑generierte Röntgenaufnahmen, reduzieren FID um 50,6 %, verbessern Klassifikation.

Weiterlesen
⚠ Hinweis zu KI-generierten Inhalten

Diese Seite enthĂ€lt ausschließlich automatisiert erstellte, KI-generierte Inhalte.

Die Zusammenfassungen wurden vollstĂ€ndig durch KĂŒnstliche Intelligenz erstellt. Es handelt sich nicht um redaktionell geprĂŒfte Inhalte.

Haftungsausschluss: FĂŒr die Richtigkeit, VollstĂ€ndigkeit und AktualitĂ€t der KI-generierten Zusammenfassungen wird keine GewĂ€hr ĂŒbernommen. Die Originalquellen sind jeweils verlinkt. Der Betreiber ĂŒbernimmt keine Haftung fĂŒr Fehler durch die eingesetzten KI-Systeme.

Technische Umsetzung: Python, Ollama, FLUX/Z-Image | Letzte Aktualisierung: Mittwoch, 12. August 2026, 06:36 Uhr