autonomous-longtask — independently scanned and version-tracked by SaferSkills.
SaferSkills independently audited autonomous-longtask (Agent Skill) and scored it 100/100 (green). The audit ran 55 deterministic rules across Security, Supply Chain, Maintenance, Transparency, and Community; it found 0 high-severity and 0 lower-severity findings. The full rule-by-rule trace and per-finding evidence are below. Free, methodology-open.
Findings & checks · 0 flagged
Every scanned point with the score it earned and what moved between them.
First recorded scan — no prior version to compare against.
The primary manifest — the file an agent reads to learn what this artifact does.
Dieses Skill optimiert Claude Code für lange, autonome Entwicklungsaufgaben - von mehrstündigen Feature-Implementierungen bis zu Multi-Session-Refactorings.
Jede Code-Änderung muss einen Feedback-Loop schließen:
1. Test schreiben (was soll passieren)
2. Code implementieren
3. Test ausführen → Loop geschlossen
4. Refactor falls nötig
5. Test erneut → SicherheitAnti-Pattern (Open Loop):
"Implementiere Feature X"
→ Code geschrieben, keine Verifikation
→ Bugs später entdecktBest Practice (Closed Loop):
"Implementiere Feature X mit E2E Test.
Führe den Test nach Implementation aus."
→ Sofortige VerifikationNiemals alles auf einmal:
❌ Versuchen das komplette Feature zu "one-shotten"
→ Context läuft aus mitten in der Implementierung
→ Nächste Session erbt Chaos
✓ Kleine, getestete Inkremente
→ Jedes Inkrement funktioniert standalone
→ Klare Übergabe zwischen SessionsCheckpoint-Pattern:
/rewind oder Esc Esc für RollbacksSTATUS.md oder claude-progress.txtClaude Opus 4 kann 200K Tokens, aber:
claude-progress.txt für Session-Handoffs nutzenLightweight Claude-Instanzen mit eigenem Context Window. Nur relevante Ergebnisse kommen zurück zum Orchestrator.
| Agent | Zweck | Tools |
|---|---|---|
general-purpose | Komplexe Multi-Step Tasks | Alle |
Explore | Codebase-Exploration, Pattern-Search | Glob, Grep, Read, Bash |
Plan | Implementation Planning | Glob, Grep, Read |
DO:
DON'T:
"Implementiere Stripe Integration parallel:
Sub-Agent 1 (Backend): API Endpoint erstellen
Sub-Agent 2 (Frontend): Payment Form Component
Sub-Agent 3 (Tests): Integration Tests schreiben
Starte alle drei parallel mit Task tool.
Warte auf Completion, dann integrieren."Git Worktrees für echte Parallelität:
# Worktree pro Task für isolierte Entwicklung
git worktree add ../feature-a feature/a
git worktree add ../feature-b feature/b
# Separate Claude Sessions in jedem WorktreeAm Ende jeder Session:
## Session 2025-12-06 14:30
### Completed
- UserService refactored to dependency injection
- All controller endpoints updated
- Unit tests passing (23/23)
### Current State
- Branch: refactor/user-service
- Last commit: abc123
- Tests: ✓ Passing
### Blockers
- None
### Next Session
1. Frontend updates for new API structure
2. Integration tests
3. DocumentationFür sehr lange Tasks (>8h):
Session 1 (Initializer):
- init.sh Script erstellen
- claude-progress.txt anlegen
- Initial Git Commit
- Grundstruktur aufsetzen
Sessions 2-N (Coding Agent):
- claude-progress.txt lesen
- Git History verstehen
- Inkrementell weitermachen
- Progress dokumentieren"Implementiere [FEATURE] mit vollständiger Loop-Closing.
Requirements:
- [Req 1]
- [Req 2]
Approach (track mit TodoWrite):
1. [Step 1] → Test schreiben + implementieren
2. [Step 2] → Test schreiben + implementieren
...
Constraints:
- Jedes Inkrement muss testbar sein
- Committe nach jedem funktionierenden Schritt
- Dokumentiere in STATUS.md falls komplex
Token-Budget: Nutze volle 200K, stoppe NICHT früh.
Bei Context-Grenze: STATUS.md für Handoff updaten.
Parallelisiere unabhängige Tasks mit Sub-Agents.""Refactoring Part [N] von [TOTAL].
Previous Sessions:
- Siehe claude-progress.txt
- Git log für bisherige Änderungen
This Session Goals:
- [Goal 1]
- [Goal 2]
Am Ende dieser Session:
- claude-progress.txt updaten
- Alle Tests müssen grün sein
- Klare Next Steps dokumentieren
Falls Context knapp wird:
- Sauber abschließen (keine halben Implementierungen)
- Handoff-Dokument schreiben
- Nächste Session kann nahtlos weitermachen""Untersuche und fixe Bug: [DESCRIPTION]
Beobachtetes Verhalten:
- [Was passiert]
- [Wann es passiert]
- [Error Messages]
Investigation Steps:
1. Lokal reproduzieren
2. Logs prüfen
3. Root Cause identifizieren
4. Fix implementieren
5. Regression Test hinzufügen (Loop Closing!)
6. Verifizieren
Dokumentiere Findings in STATUS.md falls komplex.""Implementiere diese 3 unabhängigen Änderungen parallel:
1. [Feature A] - Backend
2. [Feature B] - Frontend
3. [Feature C] - Tests
Nutze Task Tool mit 3 Sub-Agents.
Jeder Agent arbeitet isoliert.
Am Ende: Integration + E2E Test.""Implementiere Feature X.
Triff alle Implementierungsentscheidungen selbst basierend auf Best Practices.
Stoppe NICHT wegen Token-Budget.
Erstelle Tests und Docs während du arbeitest.""Implementiere Feature X.
Frage mich VOR Entscheidungen zu:
- Datenbankschema-Änderungen
- Externe API Auswahl
- Breaking Changes
Bei allem anderen: Mach selbstständig weiter."| Problem | Lösung |
|---|---|
| Claude stoppt zu früh | "Stoppe NICHT wegen Token-Budget" explizit sagen |
| Zu viele Rückfragen | Mehr Kontext upfront, Autonomy Level setzen |
| Code-Style passt nicht | "Folge Pattern in [FILE]" referenzieren |
| Task zu komplex | In Inkremente brechen, TodoWrite nutzen |
| Context läuft aus | claude-progress.txt + saubere Commits |
| One-shotting fails | Explizit inkrementelles Vorgehen fordern |
/\
/E2E\ ← Playwright (kritische Flows)
/-----\
/ API \ ← Integration Tests
/---------\
/ Unit \ ← Schnellstes Feedback
/--------------\// Serial Mode für abhängige Tests
test.describe.configure({ mode: 'serial' });
// Authenticated Contexts wiederverwenden
const ctx = await createAuthenticatedContext(...);
// Cleanup vor und nach Tests
await purgeTestData();
// ... test ...
await cleanupTestData();
// Traces für Debugging
use: {
trace: 'retain-on-failure',
screenshot: 'only-on-failure',
video: 'retain-on-failure'
}Empfehlung:
START:
1. TodoWrite mit Task-Breakdown erstellen
2. Autonomy Level definieren
3. Loop-Closing Pattern etablieren
WÄHREND:
- Jedes Inkrement testen
- Nach funktionierenden Steps committen
- Sub-Agents für parallele Arbeit
ENDE / HANDOFF:
- claude-progress.txt updaten
- Tests grün
- Klare Next StepsBasiert auf:
~30 seconds. Free. No account. Every finding cites a rule and a line of evidence.