From 9c0e11bc84d0d3dfb2e8bd57be0d6b9d936df6c3 Mon Sep 17 00:00:00 2001 From: Claudio Ortolina Date: Mon, 13 Apr 2026 12:06:24 +0100 Subject: [PATCH] Use smaller model so that we don't exhaust tokens --- lib/music_library/chats/collection_chat.ex | 6 +++++- 1 file changed, 5 insertions(+), 1 deletion(-) diff --git a/lib/music_library/chats/collection_chat.ex b/lib/music_library/chats/collection_chat.ex index 638765d2..181c2b7b 100644 --- a/lib/music_library/chats/collection_chat.ex +++ b/lib/music_library/chats/collection_chat.ex @@ -12,7 +12,11 @@ defmodule MusicLibrary.Chats.CollectionChat do def stream_response(messages, collection_summary, callback) do instructions = build_instructions(collection_summary) - OpenAI.chat_stream(messages, on_chunk: callback, instructions: instructions) + OpenAI.chat_stream(messages, + on_chunk: callback, + instructions: instructions, + model: "gpt-4.1-mini" + ) end defp build_instructions(collection_summary) do