Cantidad máxima de tokens que un modelo procesa a la vez (entrada + salida). Determina cuánta información puede considerar en una sola llamada.
Cantidad máxima de tokens que un modelo procesa a la vez (entrada + salida). Determina cuánta información puede considerar en una sola llamada.