AgentsRoom Ondersteunt Nu Ollama: Voer Lokale Modellen Uit Naast de Cloud
Ollama is nu een provider in AgentsRoom. Voer lokale open-source modellen zoals Llama, Qwen, Gemma en DeepSeek uit naast cloud agents, en stel een lokaal-of-cloud draaiknop in op elke agent, schakelbaar tijdens het gesprek.
Ollama is nu een ondersteunde provider in AgentsRoom. Je kunt een lokaal open-source model toewijzen aan elke agent, het op hetzelfde bord draaien als Claude, Codex, Grok Build en Mistral Vibe, en halverwege het gesprek schakelen zonder je context te verliezen. De open gewichten die je al kent, Llama, Qwen, Gemma, DeepSeek en de rest, staan nu klaar voor dienst in je kamer.
Ollama is niet helemaal zoals de andere providers die we hebben toegevoegd. Het is niet nog een agent om op te wedden. Het is een toegangspoort tot de hele open-source modelcatalogus, draaiend op je eigen hardware, zonder kosten per token en standaard privé.
Wat Ollama is
Ollama is een gratis, open-source runtime die grote taalmodellen downloadt en draait op je eigen machine. Eén commando, ollama pull qwen3-coder, haalt het model op. ollama run bedient het op een lokale endpoint op http://localhost:11434. Het biedt een OpenAI-compatibele API, wat precies de reden is waarom codeeragents ermee kunnen praten zonder aangepaste koppeling, en het is beschikbaar op macOS, Windows en Linux.
Het ondersteunt ook het aanroepen van tools, wat een codeeragent nodig heeft om bestanden te bewerken en commando's uit te voeren in plaats van alleen te chatten. De modellencatalogus leest als een wie-is-wie van open gewichten: Llama, Qwen, Gemma, DeepSeek, Mistral, Phi en meer, in maten die passen bij alles van een laptop tot een workstation GPU.
Twee feiten dragen de rest van dit artikel. Modellen draaien op je machine, dus niets wat je typt gaat over het netwerk. En lokale inferentie heeft geen kosten per token. Alles hieronder is een gevolg van die twee.
De keuze lokaal versus cloud die iedereen accepteert
Tot nu toe was de beslissing binair. Ga volledig voor de cloud en je krijgt geavanceerde redenering, maar elke prompt en elk bestand dat je aanraakt wordt naar een externe API gestuurd en per token gemeten. Ga volledig lokaal en je krijgt privacy en nul kosten, maar je geeft de sterkste modellen op voor de problemen die ze echt nodig hebben. De meeste teams kiezen één pad en blijven daarin.
Die binariteit is een valse, omdat een codebase niet één soort werk is. Het hernoemen van een symbool over veertig bestanden, het schrijven van boilerplate tests, het samenvatten van een diff, het opstellen van een commitbericht: niets daarvan heeft een geavanceerd model nodig, en veel ervan raakt code die je liever nergens heen stuurt. Eén lastige architecturale refactor kan de grote motor nodig hebben. Frontier cloudprijzen betalen voor de boilerplate, of de moeilijke taak beperken met een model dat te klein is, is de prijs die je betaalt voor het behandelen van de keuze als alles-of-niets.
In AgentsRoom is lokaal of cloud een draaiknop, geen schakelaar
AgentsRoom geeft al elke agent zijn eigen provider en model. Door Ollama toe te voegen kan elke agent nu overal op de lokaal-naar-cloud draaiknop zitten, en je stelt het in per agent, per taak.
De draaiknop is letterlijk de model-id. Typ qwen3-coder:30b en de agent draait Qwen lokaal via Ollama, op je hardware, gratis. Voeg een :cloud achtervoegsel toe, glm-4.6:cloud, en dezelfde agent draait dat model via je Ollama Cloud-abonnement. Eén achtervoegsel verplaatst een agent van je GPU naar een gehoste zonder iets anders in de setup aan te raken.
Omdat AgentsRoom je context behoudt bij een providerwisseling, beweegt de draaiknop ook halverwege het gesprek. Start een agent op een lokaal model, laat het door het mechanische deel van een taak malen, en schakel het dan naar een cloudmodel voor de ene stap die diepere redenering nodig heeft. AgentsRoom bouwt een overdrachtsamenvatting van de aangeraakte bestanden, de voortgang en de sessie-activiteit, zodat het cloudmodel precies oppikt waar het lokale model stopte. Schakel het terug als het moeilijke deel klaar is.
Hoe het te gebruiken
Als je al AgentsRoom draait, is er bijna niets nieuws te leren:
- Installeer Ollama van
ollama.comen haal een model op:ollama pull qwen3-coder:30b. Een Qwen Coder model is een sterke standaard voor code. Kleinere machines draaien de 7B comfortabel, en een 24GB GPU kan de 30B aan met een groot contextvenster. - Kies in de instellingen van AgentsRoom Ollama als provider, ofwel als je standaard of op een enkele agent.
- Maak een agent aan, geef het een rol, en typ in het modelformulier de Ollama model-id. Gebruik
qwen3-coder:30bom het lokaal te draaien, of voeg:cloudtoe om het via Ollama Cloud te draaien. - Stuur een prompt. AgentsRoom start het echte
ollama runproces in je projectmap en streamt de output live, op dezelfde manier als het elke andere provider aanstuurt.
Een tip uit het veld: Ollama stelt nieuwe modellen standaard in op een klein contextvenster. Voor agentisch werk, verhoog het zodat de agent een echt deel van je repository in beeld kan houden, niet alleen de laatste paar berichten.
De economie van een gratis, privé zwerm
AgentsRoom is gebouwd om agents parallel te laten draaien: een bord van hen, elk op zijn eigen taak, elk met een statuspunt. Bij cloudproviders komt die paralleliteit met een lopende meter, omdat zes agents die tegelijk werken zes tokenrekeningen zijn die samen oplopen. Bij lokale Ollama-modellen is de marginale kost van een token nul. Start een zwerm, laat het de hele middag draaien, en de enige rekening is elektriciteit.
Dat verandert waar paralleliteit voor is. Wanneer elke agent wordt gemeten, rantsoeneer je ze. Wanneer ze gratis zijn, kun je het je veroorloven om gul te zijn op de nuttige manier: een lokale agent die let op lint drift, een die de changelog actueel houdt, een die tests opstelt voor elke nieuwe functie, allemaal draaiend op de achtergrond zonder marginale kosten terwijl je gemeten cloudagent gereserveerd blijft voor het werk dat het echt nodig heeft. Als het draaien van veel agents tegelijk nieuw voor je is, hebben we over het patroon geschreven in running coding agents in parallel.
Privacy waar je niet voor hoeft te pleiten
Voor veel teams is de beslissende factor niet de kosten, maar waar de code naartoe gaat. Gereguleerde industrieën, klantwerk onder NDA, een interne codebase die juridisch niet in de buurt van een derde partij API mag komen: lokale inferentie beantwoordt de vraag voordat deze wordt gesteld, omdat het model op de machine draait en de prompt nooit het netwerk oversteekt. Er is niets te beoordelen, geen gegevensverwerkingsovereenkomst, geen gegevensresidentieclausule.
AgentsRoom past die houding van begin tot eind. Lokale modellen houden je code op de machine, en AgentsRoom's eigen synchronisatie tussen je desktop en je telefoon is end-to-end versleuteld, dus het toezicht houden op de vloot van de andere kant van de kamer maakt de privacy die het lokale model je net heeft gegeven nooit ongedaan. Als naleving de reden is dat je dit leest, is die combinatie het punt, en het past goed bij de praktijken in onze notitie over vibe coding en GDPR-naleving.
Het hybride patroon volgt dan vanzelf: routeer het privé en het bulk naar een lokaal model, escaleer alleen de moeilijke, niet-gevoelige redenering naar de cloud, en laat de draaiknop de overdracht afhandelen. Je krijgt geavanceerde kracht waar het zijn waarde bewijst, en lokale privacy overal elders.
Waarom het ertoe doet
AgentsRoom is nooit een cliënt geweest voor één model of één leverancier. Het is een cockpit om de juiste agent voor elke taak te draaien, zij aan zij, onder één paar ogen. Ollama verbreedt die belofte op een specifieke manier: het is niet nog een cloudagent om aan te sluiten, het is het hele open-gewichten ecosysteem, op je eigen voorwaarden, geprijsd op nul en standaard privé.
Lokaal voor de velen, cloud voor de weinigen, en een draaiknop om elke agent tussen de twee te verplaatsen. Download AgentsRoom, verbind Ollama, en zet een kamer vol open-source modellen aan het werk. Bekijk de volledige provider compatibiliteitsmatrix, of lees meer over multi-provider ondersteuning en hoe schakelen halverwege het gesprek je context intact houdt.
Blijf lezen
AgentsRoom Ondersteunt Nu Kimi Code
Kimi Code, de terminal codeeragent van Moonshot AI, is nu een eersteklas aanbieder in AgentsRoom. Gebruik het naast Claude, Codex, Antigravity CLI, OpenCode, Aider, Grok Build en Mistral Vibe, en wissel tijdens het gesprek.
Lees het artikelAgentsRoom Ondersteunt Nu Grok Build
Grok Build, xAI's terminal coderingsagent, is nu een eersteklas provider in AgentsRoom. Gebruik het naast Claude, Codex, Antigravity CLI, OpenCode en Aider, en schakel midden in het gesprek.
Lees het artikelClaude Ads: de Claude Code vaardigheid die je advertentieaccounts controleert
Claude Ads is een open source vaardigheid voor Claude Code: 250+ controles op Google, Meta, LinkedIn, TikTok of Amazon Ads, een score uit 100 en een geprioriteerd actieplan, in ongeveer tien minuten. Installeren, commando's, limieten, en hoe het te orkestreren in AgentsRoom.
Lees het artikel
Download AgentsRoom
Voer je AI-agenten (Claude, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe, Kimi Code) uit op al je projecten, vanuit één enkel venster.
Companion-app: houd je agents onderweg in de gaten
Breng je eigen: Claude, Codex, Antigravity CLI of andere AI-provider.
Stuur bugs en verzoeken direct naar je openbare backlog.
Een glimp van AgentsRoom in actie.