Skip to main content

Browse the directory

Showing 2 resources for "ai-safety"
Saved
Active

1 trusted · 1 review in this set — compare to see which signals differ.

Rollout signal scan

1 rollout risk signal in current results

Biggest gaps: metadata review. 0 entries have 2+ required gaps.

2 scanned

Install payload

Install payload is broadly covered in current results.

good

100% (2/2)

Adoption queue

Browse adoption queue · balanced

0/2 visible results are ready for staged adoption under this preset.

ready 0caution 2hold 0
caution

70/100

Request metadata review from maintainers or internal owners.

skills/prompt-injection-defense-guardrails · trust trusted · confidence 83%

Vibe Check MCP

1 blockers: Metadata review

caution

50/100

Request metadata review from maintainers or internal owners.

Collect package checksum or signed artifact information.

mcp/vibe-check-mcp · trust review · confidence 67%

Decision confidence

Decision confidence scan · balanced

1/2 results are high-confidence for the selected preset.

high 1medium 1low 0

Vibe Check MCP

Address Metadata review, Package integrity before broader rollout.

medium

54/100

Missing: Metadata reviewMissing: Package integrity

mcp/vibe-check-mcp · trust review

Freshness distribution

50% of this view is aging or stale

Median age 81 days; 1 fresh of 2 scanned. Re-verify the oldest entries.

median 81d

Aging

91–180 days

50%

1 entry

Stale

> 180 days

0%

0 entries

Build layered defenses against prompt injection, data exfiltration, and unsafe tool execution in AI agent systems.

Level:advancedType:generalVerified:draft
Safety ✓ Privacy ✓

Maintenance-mode MCP server that adds metacognitive oversight tools for challenging an agent's plan, recording recurring mistakes, and applying session rules before complex or high-risk work continues.