Use smaller model so that we don't exhaust tokens

This commit is contained in:
Claudio Ortolina
2026-04-13 12:06:24 +01:00
parent f73be3f881
commit 9c0e11bc84
+5 -1
View File
@@ -12,7 +12,11 @@ defmodule MusicLibrary.Chats.CollectionChat do
def stream_response(messages, collection_summary, callback) do def stream_response(messages, collection_summary, callback) do
instructions = build_instructions(collection_summary) instructions = build_instructions(collection_summary)
OpenAI.chat_stream(messages, on_chunk: callback, instructions: instructions) OpenAI.chat_stream(messages,
on_chunk: callback,
instructions: instructions,
model: "gpt-4.1-mini"
)
end end
defp build_instructions(collection_summary) do defp build_instructions(collection_summary) do