- README reescrito: ejemplos CLI corregidos (flags van en el subcomando scrape), webapp+doctor documentados, requisitos por OS, cookies, datos generados, migracion de maquina - CLAUDE.md actualizado: conteo de tests, refs de linea reparadas, scripts nuevos, checklist de actualizacion de docs - AGENTS.md nuevo: entrada estandar para cualquier agente de codigo (mapa de modulos, comandos, reglas de oro, punteros a docs) - docs/GETTING-STARTED.md: de cero a webapp por OS con troubleshooting - docs/CONFIG.md: referencia completa de las ~25 claves de config - docs/COOKIES.md: adquisicion, import (web/navegador/CLI), rotacion y seguridad - docs/backlog.md reemplaza OPPORTUNITIES.md (distilado: shipped vs pendiente) - auditorias movidas a docs/audits/ y CLIPPER-COMPARISON-AUDIT.md versionado
41 lines
2.8 KiB
Markdown
41 lines
2.8 KiB
Markdown
# Backlog
|
|
|
|
Destilado del histórico `OPPORTUNITIES.md`: qué sigue siendo candidato a construir y qué ya existe. Criterio de inclusión en "pendiente": no implementado hoy en el repo.
|
|
|
|
## Ya está hecho (no re-abrir)
|
|
|
|
| Feature (ítem original) | Dónde vive |
|
|
|---|---|
|
|
| `search` — búsqueda FTS5 en transcripciones | `yt-scraper search "..."` + webapp |
|
|
| `export` json/csv/srt/html | `yt-scraper export --format ...` → `data/exports/` |
|
|
| `audio` — descarga MP3 | `yt-scraper audio` + job de audio de la webapp (ffmpeg) |
|
|
| `re-render` + `--backfill` | `yt-scraper re-render` |
|
|
| Multi-canal | `yt-scraper channels add/list/remove`, `--all-channels` |
|
|
| `watch` — monitoreo periódico | `yt-scraper watch --interval 6h` |
|
|
| Análisis (top-words, wordcloud, timeline) | `yt-scraper analyze` → `data/analysis/` |
|
|
| Miniaturas | `data/thumbnails/` + herramienta *Download thumbnails* de la webapp |
|
|
| Vista grid de vídeos | Webapp (grid de tarjetas con miniatura) |
|
|
| Cookies (vault, import, activación) | Webapp + flags `--cookies` / `--cookies-from-browser` — ver [COOKIES.md](COOKIES.md) |
|
|
| Sync incremental de canales | `sync:` en config; discovery de ventana con overlap (no estaba en el original) |
|
|
|
|
## Pendiente
|
|
|
|
| Feature | Por qué (1 línea) | Esfuerzo |
|
|
|---|---|---|
|
|
| `clip` — texto entre dos timestamps (`yt-scraper clip <id> --from 01:38 --to 03:20`) | Citar fragmentos sin abrir el `.md`; los segmentos ya están en la BD | ~30 min |
|
|
| `stats` como subcomando | La webapp tiene dashboard y el CLI imprime un resumen tras scrape, pero no existe `yt-scraper stats` con rango/wordcount/tags top | ~1 h |
|
|
| Traducción de transcripciones (es→en o inversa) | Bibliotecas bilingües y notas para no hispanohablantes; hoy el picker rechaza traducciones por diseño (guarda el transcript real) | 3-4 h vía `deep-translator`; más si se quiere calidad |
|
|
| Alertas al terminar un job (notificación de escritorio) | Jobs largos sin vigilancia; hoy solo SSE en la pestaña abierta | 2-3 h |
|
|
| Export a formatos de note-taking (Obsidian Canvas, Anki) | El contenido ya está segmentado por capítulos; solo cambia la salida | 3-4 h |
|
|
|
|
## Fuera de alcance (por decisión de plataforma)
|
|
|
|
El spec (`docs/superpowers/specs/2026-07-26-platform-design.md` §14) excluye explícitamente features de IA. Reabrirlas exige cambiar el spec primero, no solo escribir código:
|
|
|
|
| Feature (ítem original) | Motivo de la exclusión |
|
|
|---|---|
|
|
| LLM summaries (`--summarize`) | Requiere API key / modelo local; rompe el "100% local, sin auth" |
|
|
| Q&A / RAG (`yt-scraper ask`) | Ídem; FTS5 cubre la parte recuperativa sin LLM |
|
|
| NER / extracción de entidades | Dependencia pesada (spaCy) y caso de uso cubierto por search + top-words |
|
|
| Speaker diarization | Complejidad alta (audio models) para ganancia marginal en canales monohablante |
|