Saltar al contenido principal

Cómo darle contexto a la IA y gastar menos tokens

Equipo Aithor

Respuesta corta

Con los modelos actuales, la calidad de una respuesta depende menos de cómo está escrito el pedido y más de la información que tiene el modelo para responder. Ese contexto conviene pasarlo en texto plano o Markdown y no en PDF, porque el PDF suma ruido y consume más tokens. Sacar el relleno de los pedidos, usar proyectos, cortar los chats largos y evitar las horas pico también hace que los créditos rindan más.

Estos consejos salieron en nuestro canal de WhatsApp antes de mayo de 2026. Los juntamos acá, revisados el 7 de octubre de 2026, porque responden a la misma pregunta: cómo conseguir mejores respuestas sin gastar de más.

El contexto pesa más que la fórmula

Cuando ChatGPT era nuevo, había que aprender trucos de prompt engineering: estructuras rígidas, roles, palabras mágicas. Con los modelos de 2026 esa diferencia se achicó mucho, porque entienden un pedido normal a la primera.

Donde sigue estando el salto de calidad es en el contexto. Un modelo que no sabe quién es tu cliente, qué se habló en la reunión o cuál es el formato del informe va a inventar lo que le falta. Antes de pulir la redacción del pedido, conviene preguntarse si el modelo tiene la información que necesita para responder bien.

Publicado en el canal antes de febrero de 2026.

Pasale Markdown, no PDF

Un PDF llega a la IA con todo lo que tiene alrededor del texto: márgenes, columnas, encabezados repetidos, imágenes. Todo eso es ruido para el modelo, y además ocupa tokens.

El formato que mejor procesa es Markdown (.md): texto plano con una estructura mínima, un # para los títulos y un - para las listas. Lo que escribís es exactamente lo que la IA lee. No hace falta saber escribirlo: se le puede pedir a la misma IA que convierta el PDF.

En herramientas pagas o con uso limitado, el cambio se nota en los créditos.

Publicado en el canal el 13 de abril de 2026.

Seis hábitos para que los créditos rindan

Sirven en Claude, que es donde más rápido se gastan, y también en ChatGPT o Gemini.

  1. Sacá el relleno. «Por favor», «¿podrías…?» o una introducción larga no mejoran el resultado. Directo: «Explicá X» o «Corregí este error».
  2. Usá el modelo potente solo cuando hace falta. Los modelos de razonamiento más grandes consumen varias veces más que los intermedios. Para redactar o resumir, el intermedio alcanza.
  3. No subas PDFs crudos. Pegá el texto que importa o convertilo a Markdown.
  4. Usá proyectos. En un chat común el contexto se vuelve a cargar cada vez; un proyecto lo guarda y no lo recalcula desde cero en cada sesión.
  5. Cortá los chats largos. Si la conversación viene larga y cambiaste de tema, abrí una nueva. Cada mensaje nuevo arrastra todo el historial.
  6. Evitá las horas pico de Claude. Desde marzo de 2026, en días hábiles de 5 a 11 de la hora del Pacífico el límite de cada sesión se consume más rápido. En Argentina eso es de 9 a 15 hasta el 1 de noviembre y de 10 a 16 cuando Estados Unidos sale del horario de verano. Los fines de semana no hay horas pico.

Publicado en el canal el 28 de abril de 2026. El post original ubicaba las horas pico de 11 a 17; lo corregimos con el horario que publicó Anthropic.

Diagnóstico gratuito de 30 minutos

Relevamos el estado de adopción de IA de tu organización y salís con una hoja de ruta armada a medida. Sin costo y sin compromiso.

  • Gratis
  • 30 minutos
  • Sin compromiso
Agendá tu diagnóstico