parse-cv
Installation
SKILL.md
parse-cv — text extraction da file caricato dall'utente
L'utente carica il suo CV via Telegram (o web drop-zone). L'Assistente
deve estrarre i dati strutturati (nome, ruolo, skill, esperienze) per
popolare $JHT_HOME/profile/candidate_profile.yml.
Senza pre-process: il LLM riceve il PDF binario via Read tool e fa il parsing direttamente. Funziona ma:
- Costa tanti token (un CV 2 pagine ≈ 3-5k token solo per il file)
- Risultati variabili su PDF scansionati / formati non-standard
- Errore silenzioso su .pages/.numbers (formati Apple non leggibili)
Con pre-process (questa skill): pdftotext/pandoc estraggono il testo plain in 50-200ms, il LLM riceve solo il testo (500-2000 token). Cinque-dieci volte meno token, parsing più affidabile.