Je eigen AI koppelen
Twee manieren: plak een OpenAI-sleutel, of wijs Speakybara naar een model dat je al zelf draait via LM Studio, Ollama, llama.cpp of Unsloth/vLLM.
Uitleggen met AI, Samenvatten, Vertalen, Tekst verbeteren, de optionele AI-opschoning en elke actie die je zelf schrijft hebben een model nodig om mee te praten. Speakybara draait er zelf geen: dat koppel je zelf bij Modellen › AI-model, rechts op de pagina Modellen. Dat is OpenAI met je eigen sleutel, of een model dat op je eigen pc draait via LM Studio, Ollama, llama.cpp of Unsloth/vLLM.
Je hebt Speakybara nodig, en een OpenAI-account waarin je zelf een sleutel aanmaakt, of LM Studio, Ollama, llama.cpp of Unsloth/vLLM die al op je pc draait.
Een model koppelen
Stap 1
Open Modellen › AI-model
Rechts op de pagina Modellen staan de velden voor de AI: Aanbieder, Basis-URL, Model, API-sleutel en een Test-knop. De linkerkant gaat over stemmen en staat hier los van.
Stap 2
Met OpenAI: kies hem en plak je sleutel
Kies OpenAI als aanbieder, plak je sleutel in het veld API-sleutel en druk op Test. Het standaardmodel is gpt-4o-mini. De sleutel blijft in config.json op je eigen pc en gaat alleen naar OpenAI, bij elk verzoek.
Stap 3
Met een lokaal model: kies je runner
Kies LM Studio, Ollama, llama.cpp of Unsloth/vLLM als aanbieder en het juiste adres staat er meteen in: poort 1234, 11434, 8080 en 8000. Geen sleutel nodig, en er gaat niets over internet.
Stap 4
Weet je niet welk model je server geladen heeft
Klik op Find models naast het modelveld. Speakybara vraagt de lijst op bij je server en jij kiest er een; zelf een naam typen mag ook.
Stap 5
Doe één actie om zeker te weten dat het werkt
Maak een capture van een zin en probeer Uitleggen met AI of Samenvatten. Komt er een antwoord, dan staat de koppeling; komt er niets, dan laat de Test-knop bij Modellen het snelst zien waar het misgaat.
Goed om te weten
- Wat er verstuurd wordt, is de herkende tekst, nooit de schermafbeelding, als chatverzoek naar de aanbieder die je koos. Speakybara heeft daar zelf geen server tussen.
- Wat OpenAI rekent, is tussen jou en OpenAI. Speakybara verdient er niets aan en telt er niets bij op.
- Een model dat je zelf draait is aparte software met een eigen honger naar geheugen en vaak naar je videokaart, los van de ongeveer 55 MB die Speakybara zelf gebruikt.
- Eén eigen actie kan een ander model gebruiken dan de rest, bij Geavanceerde opties van die actie.
Als er iets misgaat
Hij blijft in config.json op je eigen computer en gaat alleen naar OpenAI, als toegangsbewijs bij elk verzoek. Verder gaat hij nergens heen, en wij zien hem nooit.
Je stelt één aanbieder tegelijk in bij Modellen › AI-model, maar één eigen actie kun je bij haar eigen Geavanceerde opties aan een ander model vastzetten.
Kijk of de runner — LM Studio, Ollama, llama.cpp of Unsloth/vLLM — echt draait en of de basis-URL bij de poort past. De app vult de gebruikelijke poort in, dus een server op een andere poort typ je er zelf bij.