summaryrefslogtreecommitdiff
path: root/assets
diff options
context:
space:
mode:
authorPaul Buetow <paul@buetow.org>2026-04-01 22:20:05 +0300
committerPaul Buetow <paul@buetow.org>2026-04-01 22:20:05 +0300
commite5623423c85b3cbe5c96943e94b07ccafa04368a (patch)
treeeb4bdad6d579c643c51e6d3db7b7677b1ad1e07f /assets
parentec8614a94b63cd58ae4aaeeac27f9c6d0612b215 (diff)
Update config example for Gemini and Nano Banana
Diffstat (limited to 'assets')
-rw-r--r--assets/config.yaml.example51
1 files changed, 20 insertions, 31 deletions
diff --git a/assets/config.yaml.example b/assets/config.yaml.example
index 84d35ce..dda16b6 100644
--- a/assets/config.yaml.example
+++ b/assets/config.yaml.example
@@ -1,27 +1,23 @@
-# TotalRecalooConfiguration Example
-# Copy this to ~/.totalrecall.yaml or ./.totalrecall.yaml
+# TotalRecall Configuration Example
+# Copy this to ~/.totalrecall.yaml or ~/.config/totalrecall/config.yaml
# Audio configuration
audio:
- # Audio is generated using OpenAI TTS
- # Provider field removed - OpenAI is now the only option
-
- # Audio output format
- format: mp3
-
- # OpenAI TTS settings
+ # Gemini is the default audio provider. Set this to openai to switch back.
+ provider: gemini
+
+ # Gemini TTS writes WAV files.
+ format: wav
+
+ # OpenAI TTS settings (used only when audio.provider is openai)
openai_key: ${OPENAI_API_KEY} # Can also use environment variable
openai_model: gpt-4o-mini-tts # Options: tts-1, tts-1-hd, gpt-4o-mini-tts
- openai_speed: 0.9 # Range: 0.25 to 4.0 (may be ignored by gpt-4o-mini models)
-
- # Voice instructions for gpt-4o-mini-tts model
- # This allows you to customize how the AI speaks
+ openai_speed: 0.9 # Range: 0.25 to 4.0 (may be ignored by gpt-4o-mini-tts)
openai_instruction: "You are speaking Bulgarian language (български език). Pronounce the Bulgarian text with authentic Bulgarian phonetics, not Russian. Speak slowly and clearly for language learners."
-
- # Alternative instruction examples:
- # openai_instruction: "Speak in Bulgarian (not Russian!). Use native Bulgarian pronunciation with clear articulation for each syllable."
- # openai_instruction: "You are a Bulgarian language teacher. Pronounce the Bulgarian words slowly with authentic Bulgarian accent and phonetics."
- # openai_instruction: "Speak Bulgarian text with proper Bulgarian pronunciation. Avoid Russian accent. Speak clearly at a pace suitable for beginners."
+
+ # Gemini TTS settings (used when audio.provider is gemini)
+ gemini_tts_model: gemini-2.5-flash-preview-tts
+ gemini_voice: "" # Leave empty to use the model default voice
# Translation configuration
translation:
@@ -35,21 +31,14 @@ phonetic:
# Supported values: openai (default) or gemini
provider: openai
-# Google API settings
-google:
- # Used by Gemini translation and Gemini phonetic fetching when enabled
- api_key: ${GOOGLE_API_KEY}
-
# Image configuration
image:
- # Provider: openai or nanobanana
- provider: openai
-
- # OpenAI DALL-E settings
- openai_model: dall-e-3 # Options: dall-e-2, dall-e-3
- openai_size: 1024x1024 # Options vary by model
- openai_quality: standard # Options: standard, hd (dall-e-3 only)
- openai_style: natural # Options: natural, vivid (dall-e-3 only)
+ # Preferred Google API key location for Gemini translation, phonetics, and Nano Banana.
+ # google.api_key is still supported for older configs.
+ google_api_key: ${GOOGLE_API_KEY}
+
+ # Nano Banana is the GUI default and the recommended image provider for config-driven runs.
+ provider: nanobanana
# Nano Banana settings
nanobanana_model: gemini-3.1-flash-image-preview