Die Bilder in diesem Artikel wurden mit künstlicher Intelligenz erstellt. So veröffentlichen wir
Microsoft hat zwei Open Source-Tools, RAMPART und Clarity vorgestellt, die darauf abzielen, die Sicherheit der IA-Agenten zu ändern: eine, die technische Tests automatisiert und standardisiert, und die andere, die Dokumentation und Diskussion von Design-Entscheidungen von der frühesten Phase erfordert. Im Bereich Agenten, die Entscheidungen treffen und externe Werkzeuge verwenden, jeder Zugriff auf Daten, APIs oder Dokumente erweitert die Angriffsfläche; daher genügt es nicht, am Ende des Projekts zu prüfen: Es ist notwendig, negative Szenarien zu testen, während das System noch neu gestaltet werden kann.
RAMPART wird als integrierter Testrahmen mit Pytest vorgestellt, der seine Einführung in kontinuierliche Integrationspipelines erleichtert. Seine zentrale Idee ist es, Ingenieuren und Sicherheitsausrüstungen zu ermöglichen, Fälle zu schreiben, die von verdeckten Injektionen von Anweisungen simulieren (Quer-Prompt-Injektion) zu Datenlecks und Verhaltenswiedergaben, und dass diese Fälle innerhalb des Entwicklungszyklus durchsetzbar und wiederholbar sind. Um realen Wert aus RAMPART zu erhalten, ist es wichtig, Adapter zu bauen, die den spezifischen Agenten mit der Batterie der Tests verbinden, und die Ergebnisse in überprüfbare Minderungen zu konvertieren, die Teil des Codes und die automatischen Tests sind.

Clarity funktioniert auf einer anderen Ebene: Es führt keine Angriffe, sondern wirkt als ein strukturierter Denkpartner das erfordert, dass Sie Annahmen aufzeichnen, Alternativen erkunden und Entscheidungen treffen, bevor Sie eine einzelne Zeile schreiben. Diese konzeptionelle "Drucktesting"-Übung reduziert das Risiko, gefährliche Architekturen einzuführen - zum Beispiel einen uneingeschränkten Zugang zu externen Werkzeugen oder Quellen ohne Bedienelemente - und produziert Live-Geräte, die Geräte während des gesamten Produktlebenszyklus überprüfen und aktualisieren können.
Die Kombination beider Werkzeuge spiegelt einen höheren Sicherheitstrend bei IA wider: Sicherheit nach links bewegen, wandeln Teamergebnisse in reproduzierbare Tests um und verfolgen Sie, warum bestimmte Entscheidungen getroffen wurden. Langfristig erleichtert dies die Rückverfolgbarkeit und Rechenschaftspflicht, aber auch Herausforderungen: Effektivität hängt von der Qualität der Tests, der Erfassung von modellierten Bedrohungen und der Disziplin ab, um diese Geräte mit neuen Vektoren und Modellen auf dem neuesten Stand zu halten.

Für Teams, die diese Ideen in die Praxis umwandeln wollen, empfehle ich, mit frühen Tests in die Pipeline zu beginnen: Verwenden Sie Frames, die mit Ihrer CI / CD-Infrastruktur kompatibel sind, Adapter zu Ihren Agenten hinzufügen und Sicherheitstests in automatisierte Akzeptanzbedingungen umwandeln. Parallel dazu nutzen Sie die Anforderungen und Annahmen, um Klärungsübungen zu Beginn jedes Projekts zu nutzen und diese Entscheidungen als Live-Dokumentation im Rahmen des Codes zu bewahren. Diese Praktiken sollten durch Governance auf Datenzugriff, umfassende Aufzeichnungen über Agentenaktivitäten und Echtzeitüberwachung ungewöhnlicher Aktivitäten ergänzt werden.
Diese Werkzeuge sind jedoch keine Silberkugel. Es besteht das Risiko von falschem Komfort, wenn Teams sich nur auf automatisierte Testsuiten ohne qualifizierte menschliche Validierung verlassen oder wenn Testfälle keine echten Bedrohungen oder aufstrebende Modellfähigkeiten widerspiegeln. Es ist wichtig, technische Beweise mit externen adversarialen Überprüfungen, Bedrohungsanalysen und organisatorischen Kontrollen zu kombinieren, die Privilegien Minimierung und Notfall-Reaktions-Politik beinhalten. Das NIST AI Risk Management Framework ( https: / / www.nist.gov / künstlich -intelligence / ai-risk-management-framework) und aufstrebende Sicherheitsstandards für Modelle und Agenten, zum Beispiel die Bemühungen der OWASP-Gemeinschaft auf LLM ( https: / / owasp.org / www-project-top-ten-for-large-language-models /)
Wenn Sie sich entscheiden, diese Fähigkeiten zu bewerten, beachten Sie auch die zugrunde liegende Testinfrastruktur: Die Nutzung von Standardtest-Tools wie Pytest erleichtert die Integration ( https: / / docs.pytest.org / en / stabil /), während die Einhaltung von KI- und kontinuierliche Prüfungspraktiken hilft, Punktbefunde in systematische Minderung umzuwandeln ( https: / / www.microsoft.com / en-us / ai / verantwortlich-ai) Kurz gesagt, RAMPART und Clarity sind nützliche Schritte zu einer verantwortungsvolleren Entwicklung von IA-Agenten, aber ihre Auswirkungen werden von der Qualität der Bedrohungsmodellierung, der Disziplin, sie in die tägliche Entwicklung und ihre Kombination mit Governance und unabhängigen Bewertungen zu integrieren.
Verwandte Artikel
Weitere Neuigkeiten zum selben Thema.

Anonymous MousKIT Phishing-Plattform identifiziert, um Activation Lock auf iPhone und iPad zu entfernen
Cybersecurity-Forscher haben eine Phishing-Plattform als Service dokumentiert, um den Schutz des Schutzes zu beseitigen Aktivierungssperre von gestohlenen iPhones und iPads, kom...

Vereinigte Staaten US verhängt Sanktionen gegen iranische Netzwerke, die mit MOIS und Mabna in der wirtschaftlichen Outcast-Operation verbunden sind
Die US-amerikanische Schatzkammer hat eine neue Runde von Finanzsanktionen gegen Netzwerke im Zusammenhang mit dem Iran in einer Kampagne gestartet, die die US-Behörden als koor...

NemoClaw-Betriebskette zeigt Olama unauthenticated Zugriff und ändert Chat-Vorlagen
Was passiert ist (bestätigte Fakten): Oasis Security-Forscher haben einen Bericht veröffentlicht, in dem eine Kette von Ausbeutung gegen die NemoClaw-Konfiguration beschrieben w...

CISA fügt CVE-2026-21962 zu KEV durch Remote-Betrieb in Oracle HTTP Server und WebLogic hinzu
Die United States Agency for Cybersecurity and Infrastructure (CISA) hat in ihrem Katalog Known Exploited Vulnerabilities (KEV) den kritischen Ausfall als CVE-2026-21962, qualif...

IA in der Codegenerierung beschleunigt OSS-Abhängigkeiten und erzeugt Sicherheitsvermittlerschulden
Ein kürzlich von ActiveState organisiertes Seminar und eine Umfrage von 300 Sicherheits- und Entwicklungsleitern in Unternehmen in verschiedenen Sektoren bestätigt etwas, das vi...

Sie identifizieren WordlistLoader und SynkLoader, Zwischenlader, die mit Zugriff Broker für
Cybersecurity-Forscher haben zwei neue Malware-Familien identifiziert - genannt WordlistLoader und SynkLoader - als Zwischenstufen verwendet, um spätere Belastungen zu implement...

TikTok wird 400 Millionen für COPPA zahlen; 100 M wird wegen Nichtigerklärung des Dekrets Musical. ly
Das US-Justizministerium. Vereinigte Staaten angekündigt Zahlung $400 Millionen von TikTok eine 2024 Klage zu lösen, die die Plattform - im Besitz von ByteDance - beschuldigt, d...