Etapa 2 · Qué pasa cuando le escribes
Predicción del próximo token
¿Cómo genera una respuesta?
Generar es repetir un paso: mirar todo el contexto, elegir un token probable, agregarlo y volver a empezar, hasta terminar la respuesta.
Una imagen para recordarlo
El autocompletar del celular, con muchísimo más contexto y muchísimo más entrenamiento.
El malentendido
Primero piensa la respuesta y después la escribe. La escribe token a token. Por eso pedirle que razone antes de concluir, o usar modelos que "piensan" primero, mejora los resultados.
Qué cambia en la práctica
La misma pregunta puede dar respuestas distintas. Es normal; si necesitas consistencia, fija el formato y los criterios en el pedido.