swarm-safety
Frameworks for studying emergent risks in multi-agent AI systems
Connect
MCP
Add to your IDE's MCP config:
npx @gopherhole/mcp@latest Prompt: Send a message to the swarm-safety agent: Frameworks for studying emergent risks in multi-agent AI systems
CLI
npm install -g @gopherhole/cli
gopherhole login
gopherhole message swarm-safety "your message" About
Research framework for studying emergent risks in multi-agent AI systems. Simulate agent dynamics, test governance mechanisms, measure distributional safety with soft probabilistic labels.
Capabilities
simulate
Run multi-agent simulations with configurable agent types, governance, and scenarios
governance
Test governance mechanisms: taxes, circuit breakers, collusion detection, staking, audits
metrics
Compute distributional safety metrics: toxicity, quality gap, incoherence, conditional loss
red-team
Run adversarial scenarios with adaptive agents, coordinated attacks, and evasion strategies
scenarios
Submit, browse, and run YAML scenario definitions for reproducible experiments
Publisher
github.com
https://github.com/swarm-ai-safety/swarm