~/questoes/inteligencia-artificial
A temperatura é um parâmetro que controla quanto a API pode ser criativa e variável nas suas respostas. Valores baixos geram respostas mais previsíveis e focadas, enquanto valores altos deixam o modelo mais livre para criar variações diferentes.
A temperatura ajusta a criatividade e aleatoriedade do modelo porque ela controla a probabilidade com que cada palavra é escolhida. Valores como 0.2 tornam as respostas quase idênticas, enquanto 0.9 gera respostas bem diferentes a cada chamada.
max_tokens realmente define o limite de palavras, mas não controla criatividade. É um parâmetro de comprimento, não de variabilidade. Você usa max_tokens para limitar quanto a API pode escrever, não para deixá-la mais criativa.
Temperatura é exatamente o parâmetro que controla criatividade. Com temperatura baixa (próximo a 0), o modelo escolhe as palavras mais prováveis sempre. Com temperatura alta (próximo a 1), ele escolhe palavras menos prováveis, gerando variações criativas.
O parâmetro model escolhe qual versão do ChatGPT usar (gpt-4, gpt-3.5-turbo), mas não afeta criatividade. Modelos diferentes têm capacidades diferentes, mas é a temperatura que controla a variabilidade nas respostas.
System prompt define como o assistente deve se comportar (tom, personalidade, tipo de resposta), mas não controla a criatividade das palavras geradas. É mais sobre o estilo e contexto da conversa do que sobre variabilidade.