- README reescrito: ejemplos CLI corregidos (flags van en el subcomando scrape), webapp+doctor documentados, requisitos por OS, cookies, datos generados, migracion de maquina - CLAUDE.md actualizado: conteo de tests, refs de linea reparadas, scripts nuevos, checklist de actualizacion de docs - AGENTS.md nuevo: entrada estandar para cualquier agente de codigo (mapa de modulos, comandos, reglas de oro, punteros a docs) - docs/GETTING-STARTED.md: de cero a webapp por OS con troubleshooting - docs/CONFIG.md: referencia completa de las ~25 claves de config - docs/COOKIES.md: adquisicion, import (web/navegador/CLI), rotacion y seguridad - docs/backlog.md reemplaza OPPORTUNITIES.md (distilado: shipped vs pendiente) - auditorias movidas a docs/audits/ y CLIPPER-COMPARISON-AUDIT.md versionado
2.8 KiB
2.8 KiB
Backlog
Destilado del histórico OPPORTUNITIES.md: qué sigue siendo candidato a construir y qué ya existe. Criterio de inclusión en "pendiente": no implementado hoy en el repo.
Ya está hecho (no re-abrir)
| Feature (ítem original) | Dónde vive |
|---|---|
search — búsqueda FTS5 en transcripciones |
yt-scraper search "..." + webapp |
export json/csv/srt/html |
yt-scraper export --format ... → data/exports/ |
audio — descarga MP3 |
yt-scraper audio + job de audio de la webapp (ffmpeg) |
re-render + --backfill |
yt-scraper re-render |
| Multi-canal | yt-scraper channels add/list/remove, --all-channels |
watch — monitoreo periódico |
yt-scraper watch --interval 6h |
| Análisis (top-words, wordcloud, timeline) | yt-scraper analyze → data/analysis/ |
| Miniaturas | data/thumbnails/ + herramienta Download thumbnails de la webapp |
| Vista grid de vídeos | Webapp (grid de tarjetas con miniatura) |
| Cookies (vault, import, activación) | Webapp + flags --cookies / --cookies-from-browser — ver COOKIES.md |
| Sync incremental de canales | sync: en config; discovery de ventana con overlap (no estaba en el original) |
Pendiente
| Feature | Por qué (1 línea) | Esfuerzo |
|---|---|---|
clip — texto entre dos timestamps (yt-scraper clip <id> --from 01:38 --to 03:20) |
Citar fragmentos sin abrir el .md; los segmentos ya están en la BD |
~30 min |
stats como subcomando |
La webapp tiene dashboard y el CLI imprime un resumen tras scrape, pero no existe yt-scraper stats con rango/wordcount/tags top |
~1 h |
| Traducción de transcripciones (es→en o inversa) | Bibliotecas bilingües y notas para no hispanohablantes; hoy el picker rechaza traducciones por diseño (guarda el transcript real) | 3-4 h vía deep-translator; más si se quiere calidad |
| Alertas al terminar un job (notificación de escritorio) | Jobs largos sin vigilancia; hoy solo SSE en la pestaña abierta | 2-3 h |
| Export a formatos de note-taking (Obsidian Canvas, Anki) | El contenido ya está segmentado por capítulos; solo cambia la salida | 3-4 h |
Fuera de alcance (por decisión de plataforma)
El spec (docs/superpowers/specs/2026-07-26-platform-design.md §14) excluye explícitamente features de IA. Reabrirlas exige cambiar el spec primero, no solo escribir código:
| Feature (ítem original) | Motivo de la exclusión |
|---|---|
LLM summaries (--summarize) |
Requiere API key / modelo local; rompe el "100% local, sin auth" |
Q&A / RAG (yt-scraper ask) |
Ídem; FTS5 cubre la parte recuperativa sin LLM |
| NER / extracción de entidades | Dependencia pesada (spaCy) y caso de uso cubierto por search + top-words |
| Speaker diarization | Complejidad alta (audio models) para ganancia marginal en canales monohablante |