Files
urieljareth 450aee216d docs: documentacion completa para humanos y agentes IA
- README reescrito: ejemplos CLI corregidos (flags van en el subcomando scrape),
  webapp+doctor documentados, requisitos por OS, cookies, datos generados, migracion de maquina
- CLAUDE.md actualizado: conteo de tests, refs de linea reparadas, scripts nuevos,
  checklist de actualizacion de docs
- AGENTS.md nuevo: entrada estandar para cualquier agente de codigo (mapa de modulos,
  comandos, reglas de oro, punteros a docs)
- docs/GETTING-STARTED.md: de cero a webapp por OS con troubleshooting
- docs/CONFIG.md: referencia completa de las ~25 claves de config
- docs/COOKIES.md: adquisicion, import (web/navegador/CLI), rotacion y seguridad
- docs/backlog.md reemplaza OPPORTUNITIES.md (distilado: shipped vs pendiente)
- auditorias movidas a docs/audits/ y CLIPPER-COMPARISON-AUDIT.md versionado
2026-09-10 00:32:32 -06:00

2.8 KiB

Backlog

Destilado del histórico OPPORTUNITIES.md: qué sigue siendo candidato a construir y qué ya existe. Criterio de inclusión en "pendiente": no implementado hoy en el repo.

Ya está hecho (no re-abrir)

Feature (ítem original) Dónde vive
search — búsqueda FTS5 en transcripciones yt-scraper search "..." + webapp
export json/csv/srt/html yt-scraper export --format ... → data/exports/
audio — descarga MP3 yt-scraper audio + job de audio de la webapp (ffmpeg)
re-render + --backfill yt-scraper re-render
Multi-canal yt-scraper channels add/list/remove, --all-channels
watch — monitoreo periódico yt-scraper watch --interval 6h
Análisis (top-words, wordcloud, timeline) yt-scraper analyze → data/analysis/
Miniaturas data/thumbnails/ + herramienta Download thumbnails de la webapp
Vista grid de vídeos Webapp (grid de tarjetas con miniatura)
Cookies (vault, import, activación) Webapp + flags --cookies / --cookies-from-browser — ver COOKIES.md
Sync incremental de canales sync: en config; discovery de ventana con overlap (no estaba en el original)

Pendiente

Feature Por qué (1 línea) Esfuerzo
clip — texto entre dos timestamps (yt-scraper clip <id> --from 01:38 --to 03:20) Citar fragmentos sin abrir el .md; los segmentos ya están en la BD ~30 min
stats como subcomando La webapp tiene dashboard y el CLI imprime un resumen tras scrape, pero no existe yt-scraper stats con rango/wordcount/tags top ~1 h
Traducción de transcripciones (es→en o inversa) Bibliotecas bilingües y notas para no hispanohablantes; hoy el picker rechaza traducciones por diseño (guarda el transcript real) 3-4 h vía deep-translator; más si se quiere calidad
Alertas al terminar un job (notificación de escritorio) Jobs largos sin vigilancia; hoy solo SSE en la pestaña abierta 2-3 h
Export a formatos de note-taking (Obsidian Canvas, Anki) El contenido ya está segmentado por capítulos; solo cambia la salida 3-4 h

Fuera de alcance (por decisión de plataforma)

El spec (docs/superpowers/specs/2026-07-26-platform-design.md §14) excluye explícitamente features de IA. Reabrirlas exige cambiar el spec primero, no solo escribir código:

Feature (ítem original) Motivo de la exclusión
LLM summaries (--summarize) Requiere API key / modelo local; rompe el "100% local, sin auth"
Q&A / RAG (yt-scraper ask) Ídem; FTS5 cubre la parte recuperativa sin LLM
NER / extracción de entidades Dependencia pesada (spaCy) y caso de uso cubierto por search + top-words
Speaker diarization Complejidad alta (audio models) para ganancia marginal en canales monohablante