Executa um revisor AI em modo shadow nao-bloqueante ao lado de revisores humanos, coleta metricas de concordancia (true positive, false positive, missed-by-human, missed-by-AI), e usa dados do periodo de shadow para graduar checks especificos de AI a status…
pavani06/long-running-agents
O SkillsMP coletou 30 skills de pavani06/long-running-agents. Abra uma skill para revisar a origem e os detalhes.
- Última atividade de origem registrada
- Catálogo do SkillsMP atualizado
- skills coletadas
- 30
- Estrelas no GitHub
- 3
- Forks no GitHub
- 2
Skills neste repositório
Mostrando 30 de 30 skills coletadas.
Heuristica para distinguir goals de specs disfarcadas: 'Duas implementacoes completamente diferentes conseguiriam satisfazer isso?' Se sim, e um goal. Se nao, e uma spec escondida no campo errado. Usar durante a escrita ou revisao de intents, como gate…
Pipeline completo: documento fonte → extração de conhecimento → padrões reutilizáveis → classificação contra repositório → melhorias priorizadas por impacto → integração. Consome uma fonte externa de conhecimento (talk, paper, transcript, knowledge base) e…
Gate rigido de orcamento de constraints: maximo 5 a 7 linhas. Revisa listas de constraints em busca de bloat, reclassifica escolhas de implementacao como Context, rejeita specs disfarcadas de constraints, e garante que cada constraint restante e direcional,…
Regra de decisao para classificar requisitos como constraints ou failure conditions: 'Saber isso mudaria a forma como o builder escreve o codigo?' Se sim, e constraint (guia o builder). Se nao -- so pode ser checado depois que o output existe -- e failure…
Calibra a profundidade e severidade da revisao agentica com base no perfil de risco do modulo alterado. Usa risk-profile.yaml para declarar nivel de risco por modulo (critical, high, medium, low) e conjunto de checks aplicaveis (style, correctness, security,…
Mantem o Deferred Ledger — classificacao de divida agentica em tres categorias (skill, dependence, carry) que acumulam silenciosamente enquanto tokens sao baratos. Consome dados do token budget ledger, burn rate, health monitor e harness evolution lifecycle…
Pipeline simplificado: documento fonte → extração de conhecimento → padrões reutilizáveis → classificação contra repositório → canonical docs. Focado em gerar docs canônicos a partir de um único documento (currículo, análise, transcript). NÃO gera skills,…
Decompoe intents multi-goal em sentencas atomicas: um goal = uma sentenca, sem 'and', sem 'then', sem 'and also'. Escaneia o Goal por conjuncoes e coordenação, split em intents atomicos independentes, e opcionalmente estabelece dependencias entre eles.…
Formaliza o intent como primitivo de cinco partes — descricao, constraints, cenarios de falha, cenarios de sucesso e conexoes — antes que qualquer agente comece a implementar. Elimina a ambiguidade que forcaria o agente a preencher lacunas com suposicoes…
Aplica o Manual Brake — tres perguntas diagnosticas de valor antes de autorizar construcao por agente. Restaura artificialmente o gate economico que tokens gratuitos removeram. Usar antes de qualquer execucao agentica nao-trivial, na fase de alinhamento, ou…
Define o papel de Owner-of-No — a pessoa cujo trabalho explicito e recusar trabalho de baixo valor e fornecer intents alternativos. Transforma 'dizer nao' de ato acidental de coragem em papel organizacional desenhado, com criterios de recusa, caminho de…
Implementa uma camada de selecao de contexto model-agnostic e vendor-independent. Define um formato padronizado de contexto que qualquer modelo pode consumir, um Context Router que resolve queries de qualquer agente contra o grafo relacional e storage em…
Torna o retrieval de contexto budget-aware: cada candidato a retrieval e ranqueado por razao valor/custo antes de ser injetado no contexto. Implementa um Information Value Predictor que estima reducao de incerteza por candidato, um Token Cost Estimator que…
Implementa armazenamento de contexto em tres tiers (hot/warm/cold) com promocao e democao baseadas em relevancia. Mantem o conjunto de trabalho ativo deliberadamente pequeno na hot tier (cache in-memory), move contexto recentemente relevante para warm tier…
Operacionaliza um curriculo de autonomia para agentes: controla a proporcao entre rollouts supervisionados (professor/humano) e rollouts auto-gerados (agente) com um parametro lambda, gates de prontidao por classe de tarefa, e uma progressao explicita…
Separa o sinal de melhoria do agente em dois componentes independentes: magnitude (o quanto o modelo acredita que uma mudanca importa, extraida de self-distillation delta, log-ratio, atencao, ou confianca interna) e direcao (para onde a mudanca deve ir,…
Executa o pipeline analyze-and-improve fase por fase via delegacao nativa task(). Suporta mode=once (uma fase) e mode=feature:phase-N (fase especifica). Dispara com: 'run harness', 'execute pipeline', 'harness --once', 'run phase-N', 'harness analyze and…
Idioma do texto original: Vários idiomas
Diretrizes comportamentais derivadas das observacoes de Andrej Karpathy sobre onde LLMs falham ao codificar. Quatro principios: pense antes de codificar, simplicidade radical, edicao cirurgica, metas verificaveis. Carregar em toda task de implementacao…
Mede a presenca humana durante a execucao agentica como metrica de governanca, nao apenas a aprovacao simbolica no gate final. Gera timeline de envolvimento, alertas de ausencia prolongada (stale-presence), e pontos de intervencao obrigatoria antes que o loop…
Apply the LLM-as-Fuzzy-Compiler mental model when designing harness components, deciding what to preserve vs. regenerate, or planning model migrations. Treat the LLM as a fuzzy compiler backend, harness controls (lint rules, review agents, skills, tests,…
Idioma do texto original: inglês
Write persona-specific Non-Functional Requirement (NFR) documents and load them via reviewer agents keyed to quality dimensions. Each team member documents their specialty (front-end architecture, reliability, security, product, performance) as a durable NFR…
Idioma do texto original: inglês
Validate HoP issue work, open a draft PR against main, run a second-agent review, and stop for user confirmation before merge.
Idioma do texto original: inglês
Apply Error Context Hygiene rules when implementing agent error handling. Summarize errors instead of dumping stack traces; clear pending errors after successful recovery; never blind-append errors to context. Use when implementing tool error handling, retry…
Idioma do texto original: inglês
Manage GitHub Issues through full lifecycle: create, track, and complete. Use when (1) creating issues from story breakdowns or planning discussions, (2) starting work on a feature branch, (3) tracking progress with commits and changes, (4) completing issues…
Idioma do texto original: inglês
Break down GitHub issues into executable sub-issues with dependencies. Deep codebase exploration, single-file-focused tasks, dependency graphs, and verification gate. Use when the user mentions "refine", "break down", "decompose", or "plan" for an issue. Also…
Idioma do texto original: inglês
Use when you have a spec or requirements for a multi-step task, before touching code. Writes comprehensive implementation plans with exact file paths, code, tests, and bite-sized tasks. Triggers on "create a plan", "implementation plan", "write a plan", "task…
Idioma do texto original: inglês
After explicit user approval, merge a reviewed HoP PR into main and clean up the issue branch, worktree, and agent labels.
Idioma do texto original: inglês
Claim a HoP GitHub issue, create an isolated worktree from main, and prepare a scoped execution brief before implementation.
Idioma do texto original: inglês
Manage parallel HoP GitHub issue agents: show work status, suggest next issues, generate prompts, and clean idle sessions.
Idioma do texto original: inglês