Resumen del proyecto

Pdf Text Extractor

Objetivo, estructura, ejecución y aprendizaje del proyecto.

pdf-text-extractor

Lección **03-06 — Extrae texto de PDF**

## Objetivo
Leer páginas y guardar texto con referencias.

## Conceptos
- PdfReader
  • páginas

  • extracción

  • archivos

    Librerías

    • pypdf
  • pathlib

    Estructura

    01-start/      reconstrucción
    03-complete/   referencia funcional
    04-challenge/  práctica adicional
    05-solution/   solución de comparación
    screenshots/   evidencia para portafolio
    

    Ejecutar

    python -m venv .venv
    # Windows: .venv\Scripts\activate
    # macOS/Linux: source .venv/bin/activate
    pip install -r 03-complete/requirements.txt
    python 03-complete/main.py
    

    En FastAPI:

    fastapi dev 03-complete/main.py
    

    Práctica guiada

    1. Ejecutá la referencia.
    2. Identificá entrada, proceso y salida.
    3. Modifica un dato.
    4. Provoca el error controlado.
    5. Repara.
    6. Reconstruye en 01-start.
    7. Completá la práctica adicional.

    Error controlado

    Usá un nombre de archivo inexistente y maneja el error.

    Cursor

    Explicá este proyecto como tutor. Describí entrada, procesamiento y salida. Revisá una función por vez. No cambiés código sin mi autorización.

    GitHub

    Incluye captura, problema, solución, instalación, arquitectura, aprendizaje y mejoras futuras.