- Use voice-assistant profile (minimal chatbot, max_turns=10, nous provider)
- Remove /fast prefix and model override - handled by profile config
- Use messaging toolset for send_message tool (Telegram delivery)
- Add hardcoded TELEGRAM_BOT_TOKEN and TELEGRAM_HOME_CHANNEL to relay env
- Telegram delivery now works via gateway's send_message_tool
- Version bump to 2.1
- Health endpoint shows profile: voice-assistant
- Model override: qwen3.7-plus (4.5x meer requests/uur dan max)
- Toolsets disabled bij model override (DeepSeek compat fix)
- NoneType crash fix voor error paths
- Originele qwen3.7-max blijft actief voor andere chats
- Vervang subprocess calls naar hermes chat -q door directe Python import
- Nieuwe hermes_client.py met warme AIAgent (eenmalig init, hergebruik per query)
- Initializing agent overhead: 3-5s per query -> 0.48s eenmalig
- Queries na eerste zijn ~5s (alleen LLM API tijd)
- Auxiliary vision provider leeggezet (geen DNS lookup naar Nous)