Cómo presupuestar tokens para una conversación larga sobre PDF e IA
Un PDF puede caber al inicio de un chat de IA y llenar la conversación después. Planifique tokens para seguimientos, respuestas y contexto repetido.
Un PDF puede caber en un chat de IA al inicio de la conversación y volverse incómodo diez preguntas después. El documento no creció. La conversación sí.
Cada seguimiento añade instrucciones, respuestas del modelo, pasajes citados, resultados de herramientas y, a veces, una copia repetida del contexto del documento. Por eso contar tokens no sirve solo para comprobar el tamaño del archivo. Es un presupuesto para el trabajo posterior a la primera pregunta.
Deje espacio para la conversación
La ventana de contexto es un espacio compartido. Si un modelo admite 128.000 tokens, enviar un PDF de 120.000 deja poco lugar para instrucciones o una respuesta útil. Incluso un archivo menor puede apretar la conversación cuando pide citas, comparaciones o muchas preguntas seguidas.
Empiece con el Contador de Tokens de PDF y considere el resultado la primera línea de un presupuesto. Después reserve capacidad para la sesión que quiere: un resumen corto necesita mucho menos espacio que revisar un contrato en varias rondas.
Observe lo que se repite
Algunos chats guardan el hilo completo automáticamente. En ciertos flujos de API, el documento o un fragmento se vuelve a enviar en cada solicitud. En ambos casos, la repetición es donde los tokens se encarecen y el contexto se llena.
Mantenga cortas las instrucciones estables. Pida referencias de página en lugar de pegar el mismo pasaje en cada mensaje. Al cambiar de tema, inicie un hilo nuevo solo con las páginas necesarias. Son hábitos pequeños que evitan que una revisión de PDF se convierta en un contexto largo y borroso.
Elija una unidad de trabajo
No suba un manual entero para hacer cada pregunta que surja. Divida el trabajo: explique una política, compare dos cláusulas, extraiga plazos o compruebe cifras de una tabla. La pregunta determina qué páginas deben acompañarla.
Para trabajo repetido, divida la fuente por título o párrafo y recupere solo las partes relevantes. PDF Chunker prepara fragmentos locales con límite y solapamiento de tokens. Suele ser más útil que intentar que un prompt gigante sobreviva toda una tarde.
Sepa cuándo reiniciar
Si las respuestas empiezan a perder referencias de página, repetir hechos anteriores o volverse vagas sobre material ya tratado, el hilo puede llevar demasiado. Guarde la conclusión útil, abra una conversación nueva y lleve un resumen breve junto con las páginas de origen relevantes.
Reiniciar no es perder contexto. Es elegir qué contexto merece quedarse.