Под Visual Studio и VS Code тут разное. В VS Code проще: агентское расширение (Kilo, Roo и т.п.) и задаёшь ему любой OpenAI-совместимый endpoint. А «без лимитов» — это про бэкенд, а не про расширение: поднял локальную модель через Ollama, указал localhost — и токены не считаются вообще.
OmniRoute сам ничего не генерит, он только роутит запросы к твоим ключам, так что безлимит он не даёт, а лишь позволяет переключаться между моделями. Я для рутинных клиентских скриптов так и держу: локальная модель для простого, облачный ключ для сложного.