Een open specificatie voor het beoordelen van de veiligheid van agenten
In het tijdperk van kunstmatige intelligentie is de echte gamechanger meer dan de nieuwste LLM: het gaat erom hoe je hem in de praktijk brengt. Daarom hebben we Foundry Security Spec open source, een in de praktijk getest project voor het creëren van een op agenten gebaseerd beveiligingsbeoordelingssysteem. Omdat het raamwerk model- en stack-agnostisch is, kunnen organisaties een hardware creëren die geschikt is voor hun specifieke omgeving. Door te delen wat we hebben geleerd, is het ons doel om de defensiegemeenschap te helpen sneller en slimmer te handelen. Het stelt organisaties in staat om van luide waarschuwingen over te stappen naar verifieerbare beveiligingsresultaten die impact hebben.
Het cybersecurity-operationele model is dramatisch veranderd. Terwijl grensverlegende AI-modellen een nieuwe, tweeledige uitdaging creëren, identificeren aanvallers nu kwetsbaarheden met machinesnelheid, waardoor beveiligingsteams moeite hebben om handmatige en verouderde processen bij te houden. Bij Cisco erkennen we dat de oude ‘onderzoeks- en patchcyclus’ niet langer voldoende is om deze nieuwe risicosnelheid aan te pakken. Het ware potentieel van deze modellen wordt echter pas gerealiseerd als we de juiste bedrading – de agenten en de orkestratie – combineren met de bekwame professionals die ze beheren. Door verder te gaan dan incrementele productiviteitswinsten en opnieuw na te denken over de manier waarop we kwetsbaarheden op grote schaal kunnen vinden en oplossen, introduceren we Foundry Security Specs als een cruciale kans om onze teams te versterken en de balans te laten doorslaan in het voordeel van verdedigers. Dit werk van Cisco bouwt voort op de geleerde lessen en de mogelijkheden die zijn ontwikkeld via geavanceerde beveiligingsengineering binnen ons interne beveiligingsteam.
Foundry Security Spec is bedoeld voor gebruik met de spec-kit van GitHub, een reeks op specificaties gebaseerde ontwikkelingsworkflows die met verschillende AI-agents kunnen worden gebruikt.
Foundry wordt gepubliceerd als twee belangrijke artefacten en een reeks ondersteunende documenten:
- Het ‘specifieke’ artefact: acht hoofdagentrollen, vijf extensierollen, de zoeklevenscyclus, het coördinatiesubstraat en ongeveer 130 functionele vereisten, elk met in-line logica die uitleg geeft Waarom bestaat.
- Het artefact van de ‘grondwet’: elf onschendbare principes. Elk van hen codeert voor een echte productiefout die we hebben verzonden, gediagnosticeerd en gerepareerd.
Het probleem opgelost door de gieterij
Elk beveiligingsteam met toegang tot een frontier LLM heeft minstens één keer hetzelfde geprobeerd: een repository naar het model gooien en het vragen “bugs te vinden”. Het resultaat is meestal een muur van grenzeloze, niet-verifieerbare resultaten die scherpe inzichten vermengen met hallucinante ontdekkingen, zonder dat je weet wat je hebt gemist of wanneer je daadwerkelijk klaar bent. Een alomvattend agentsysteem zoals Foundry Security Spec is het tegengif voor deze chaos: het omhult het model in orkestratie, rollen en vangrails, zodat detectie, validatie en dekking van tevoren worden ontworpen in plaats van geïmproviseerd in een chatvenster. Het verschil is duidelijk: de ene is een interessante demo; de andere is een beveiligingsbeoordelingssysteem dat u kunt verdedigen tegenover uw CISO en uw auditors.

Organisaties investeren in AI-ondersteunde beveiliging en krijgen schokkende resultaten, valse positieven op grote schaal en geen dekkingssignalen. Foundry Security Spec is de steiger die een frontier LLM transformeert van “een interessante demo tegen uw codebasis” in een beveiligingsbeoordelingssysteem dat produceert:
- Een afgebakend, prioriteit, verifieerbaar reeks resultaten.
- Een duidelijk ‘klaar’-signaal. en de combinatie van een door de exploitant gedefinieerd dekkingsniveau en een economische prestatiedrempel.
- Een verifieerbare herkomstketen van detectie tot triage, validatie en publicatie.
- Bewakers die ervan uitgaan dat het model op een gegeven moment zal proberen het verkeerde te doen; en bind het aan het substraat, niet aan de prompt.
Als u een grensverleggende LLM en software hebt die u mag evalueren, vormt Foundry het systeem dat u daarvoor nodig heeft.
Hoe verdedigers de beveiligingsspecificaties van Foundry kunnen gebruiken om hun software te testen
Foundry is ontworpen om te worden verzameld en aangepast, niet om te worden geconsumeerd zoals het is. Het is het startpunt van uw reis naar de veiligheidsbeoordeling van agenten. De stroom ziet er als volgt uit:


- De Constitution.md wordt gelezen door de AI-agent (zoals Claude Code, Codex of anderen) om te gebruiken om de infrastructuur te bouwen. Het is echter ook met opzet geschreven als proza, gericht op de menselijke bouwer en onderhouder, waarbij in de paragraaf ‘Waarom dit onschendbaar is’ van elk principe de specifieke fabricagefouten worden uitgelegd die de regel verhindert, zodat wanneer een ingenieur in de verleiding komt om een principe voor het gemak te verzwakken, hij de kosten van die beslissing ondervindt voordat hij deze neemt.
- Voer het zaad door de specifieke kit. De specificatie is geschreven voor gebruik door spec-kits. Het ‘zaad’ verwijst naar de initiële minimale configuratie die uw op specificaties gebaseerde project in een bekende, werkklare staat brengt, zodat AI-agenten (of ontwikkelaars) consistent nuttig werk kunnen gaan doen.
- De AI-agent bouwt de architectuur. De acht hoofdrollen (regisseur, indexeerder, cartograaf, detector, triager, validator, dekkingsgids, verslaggever) hebben elk een gedefinieerd doel, gedefinieerde inputs en outputs, en een lijst met functionele vereisten met onderbouwing. Je kunt ze implementeren als lussen van subprocessen, als op grafieken gebaseerde pijplijnen, als serverloze functies, als op maat gemaakte bedrading. Vorm is wat wordt overgedragen; de uitvoering is aan jou.
- Wijs de beveiligingsspecificaties van Foundry toe aan CodeGuard-project. De rol Foundry Security Spec Detector maakt gebruik van een corpus van detectieregels die zijn geëvalueerd door LLM. De regels komen van CodeGuard-project die Cisco open source maakte voordat de Foundry Security Spec bestond en deze schonk aan de Coalition for Secure AI (CoSAI). Het oorspronkelijke doel van Project CodeGuard is om standaard veilige praktijken op te nemen in de workflows van AI-codeeragenten. Het biedt uitgebreide beveiligingsregels en agentvaardigheden die AI-codeeragenten begeleiden om automatisch veiliger code te genereren. Het was echter ook erg handig voor codebeoordelingen en op zichzelf staande beveiligingsbeoordelingen en tests.


DE zelfverbetering vliegwiel van detectie naar preventie:
- CodeGuard-regels doorzoeken elke functie in uw doel: systematisch, herhaalbaar, vindt wat we al weten te zoeken.
- De verkennende agenten van Foundry Security Spec gaan samen op jacht: creatief, doelgericht, ze vinden wat nog geen regels beschrijven.
- Wanneer verkenning bevestigt iets wat de regels gemist hebben, Foundry Security Spec registreert een leemte in de regels.
- De leemte wordt gegeneraliseerd in een nieuwe (of herziene) CodeGuard-regel en komt terecht in het corpus.
- De volgende scan (op dit doel en elk toekomstig doel) legt de hele klas vast bij de eerste doorgang.
- Omdat CodeGuard-regels overdraagbaar zijn, wordt hetzelfde corpus in een LLM-coderingsassistent geladen als een set veilige coderingsregels. De klasse bugs die uw laatste evaluatie het corpus heeft laten detecteren, wordt nu vergrendeld met een druk op de knop in de editor van elke ontwikkelaar, voordat de volgende evaluatie wordt uitgevoerd.
Elke ronde van het circuit verbetert de detectie hier en de preventie overal.
Een prima uitgangspunt
Wij willen hier heel expliciet over zijn: De Foundry Security Specification is een initiële specificatie en een blauwdruk. Het is geen kant-en-klare scanner of een enkel hulpmiddel. Het is een voorbeeld van hoe een goed op AI gebaseerd veiligheidsbeoordelingssysteem eruit ziet. Uw omgeving, uw dreigingsmodel en uw doelen zullen delen ervan opnieuw vormgeven. Dit is zo ontworpen. Elke plaats waar het zaad een keuze kon dicteren of open kon laten, lieten we open en legden de afweging uit.
Foundry Security Spec is een open source-specificatie, geen beheerde service. Zoals bij elk beveiligingshulpmiddel ligt de verantwoordelijkheid voor de implementatie, het toezicht en de uiteindelijke besluitvorming bij de gebruiker. Wij verzorgen het ontwerp voor de vangrails, maar het is aan u om ervoor te zorgen dat de “man in the loop” de uiteindelijke scheidsrechter blijft bij veiligheidsbeslissingen. We moedigen gebruikers aan om het te beschouwen als een kerncomponent van hun bestaande programma voor beveiligingsbeheer.
Een veel voorkomende vraag is of deze specificatie verouderd zal raken naarmate LLM’s evolueren. Het antwoord is dat het zo is ontworpen dat het niet zo is. De beveiligingsspecificaties van gieterijen zijn gebaseerd op functionele rollen en vereisten, niet op specifieke modelparameters. Of je nu de grensmodellen van vandaag gebruikt of de complexere redeneermiddelen van morgen, de behoefte aan een orkestrator, detector en validator zal constant blijven. De specificatie is ontworpen als een stabiel harnas dat de veiligheidsclassificatie consistent houdt, ongeacht de “motor” onder de motorkap.
Waarom een specificatie en niet de bron?
Onze interne implementaties zijn nauw verbonden met de Cisco-infrastructuur: onze LLM-gateway, onze issue tracker, onze private cloud, enz. Door die code open te sourcen, krijgen verdedigers iets dat in precies één omgeving werkt. Hij zou niet worden overgeplaatst.
Welke overdrachten zijn de project: welke rollen nodig zijn en waarom, waar elke rol voor moet zorgen, hoe de resultaten van ontdekking naar publicatie gaan, wat ‘gedaan’ betekent voor een beoordeling, waar de kwaliteitspoorten naartoe gaan, en welke sluiproutes je zes maanden later pijn zullen doen. Dit ontwerp is modelonafhankelijk en infrastructuurneutraal.
Een echte bijdrage aan de gemeenschap
We zeggen dit niet lichtvaardig: we geloven dat dit een van de meest substantiële specificaties is waarmee verdedigers hun omgeving en software kunnen testen. Dit is wat beveiligingsteams die op verantwoorde wijze een grens-LLM willen gebruiken, momenteel zelf proberen te bedenken.
In combinatie met CodeGuard vormt het een echt werkend vliegwiel ertussen detectie (Veiligheidsspecificaties voor gieterijen) e preventie (CodeBescherm tegen de codeervaardigheden van uw ontwikkelaar). Elke adoptie versterkt het corpus. Elke update van het corpus verheft zijn stem voor iedereen.
Het beveiligen van onze mondiale digitale infrastructuur is een collectieve inspanning. We nodigen je uit om de Foundry-beveiligingsspecificaties op GitHub te verkennen, deel te nemen aan het gesprek op onze communityforums en te beginnen met het bouwen van je eigen, op agenten gebaseerde beveiligingsbeoordelingssysteem. Bezoek onze repository op om vandaag nog aan de slag te gaan.
Bouw erop. Pas het aan. Draag eraan bij.








