AI Failure Observatory
Systematisches Bewertungs- und Klassifizierungs-Framework für KI- und LLM-Fehlermodi wie Halluzinationen und Kontextverlust.
Version
v1.1.0 (PyPI)
Fehlertaxonomie
6 Kritische Kategorien
Abhängigkeiten
Keine Abhängigkeiten (Stdlib)
Protokoll
MCP & Web UI
Testabdeckung
22 Tests (100% Erfolg)
Lizenz
Apache-2.0
AI Failure Observatory ist eine Open-Source-Sicherheitsplattform und ein Model Context Protocol (MCP)-Server, der von ADA Creative Co. entwickelt wurde, um sechs kritische Verhaltensfehler und Schwachstellen zu erkennen, einem Stresstest zu unterziehen und zu prüfen, bevor Large Language Models (LLM) und autonome KI-Agenten in Live-Produktumgebungen bereitgestellt werden.
Die Plattform geht über traditionelle Softwaretests hinaus; Es isoliert die Erfindung unwirklicher Tatsachen durch künstliche Intelligenz (Halluzination), das Vergessen von Systembeschränkungen in mehrstufigen Anweisungen (Anweisungsabweichung), den Verlust kritischer Historie in langen Dialogen (Kontextverlust), das Erliegen von prompten Injektions- und Gegenangriffen (Jailbreak/Manipulation), die Billigung fehlerhafter Annahmen des Benutzers ohne Hinterfragen (Schmeichelei/Speichelei) und Inkompatibilitäten des Tool-Calling-Schemas (Tool Calling) mit mathematischen Regeln.
Architektur, die ausschließlich mit Python 3.10+-Standardbibliotheken (http.server, urllib.request, json) und dem Zero Core Dependencies-Prinzip erstellt wurde; Es funktioniert integriert mit Google Gemini (2.0 Flash / 1.5 Pro), OpenAI (GPT-4o / o3-mini), Anthropic Claude (3.5 Sonnet) und dem integrierten intuitiven Offline-Simulator.
System; Das One-Click-Red-Teaming Open Search Studio bietet wiederholbare Bewertungsbenchmarks, eine dynamische Engine zur Berechnung des Composite Risk Index, den Export von Markdown/JSON-Prüfungsberichten und einen vollwertigen MCP-Server, der eine Verbindung zu Claude Desktop, Cursor IDE und KI-Clients wie Antigravity herstellt.
Die Plattform geht über traditionelle Softwaretests hinaus; Es isoliert die Erfindung unwirklicher Tatsachen durch künstliche Intelligenz (Halluzination), das Vergessen von Systembeschränkungen in mehrstufigen Anweisungen (Anweisungsabweichung), den Verlust kritischer Historie in langen Dialogen (Kontextverlust), das Erliegen von prompten Injektions- und Gegenangriffen (Jailbreak/Manipulation), die Billigung fehlerhafter Annahmen des Benutzers ohne Hinterfragen (Schmeichelei/Speichelei) und Inkompatibilitäten des Tool-Calling-Schemas (Tool Calling) mit mathematischen Regeln.
Architektur, die ausschließlich mit Python 3.10+-Standardbibliotheken (http.server, urllib.request, json) und dem Zero Core Dependencies-Prinzip erstellt wurde; Es funktioniert integriert mit Google Gemini (2.0 Flash / 1.5 Pro), OpenAI (GPT-4o / o3-mini), Anthropic Claude (3.5 Sonnet) und dem integrierten intuitiven Offline-Simulator.
System; Das One-Click-Red-Teaming Open Search Studio bietet wiederholbare Bewertungsbenchmarks, eine dynamische Engine zur Berechnung des Composite Risk Index, den Export von Markdown/JSON-Prüfungsberichten und einen vollwertigen MCP-Server, der eine Verbindung zu Claude Desktop, Cursor IDE und KI-Clients wie Antigravity herstellt.