Selvhostet LLM med OpenAI-kompatibelt API. Kjører på egne GPU-er hos sintef.energy — data forlater ikke huset.
https://api.ai.sintef.energy/v1
Alt som snakker OpenAI-protokollen fungerer. Du trenger en API-nøkkel — se nedenfor.
Navnet forteller hvilken modell det er og hvordan den er stilt inn:
modell-variant. Alle peker på samme underliggende modell —
det er innstillingen som skiller dem.
| Modell | Tenker først | Bruk til |
|---|---|---|
qwen3.6-27b-fast |
Nei | Svarer direkte. Raskest, og trygg når klienten setter lav max_tokens. |
qwen3.6-27b-thinking |
Ja | Resonnerer før svar. Best kvalitet på koding og agentarbeid. |
qwen3.6-27b |
Modellens standard | Rå tilgang uten overstyring. |
Qwen3.6-27B er en åpen modell fra Alibaba, kvantisert til 4 bit (AWQ-INT4) og kjørt over to RTX 3090. Kontekstvindu 65 536 tokens. Den forstår også bilder.
sintef-chat,
sintef-coder og sintef-coder-fast fungerer fortsatt,
men er utfaset. Bytt til navnene over ved anledning.
sintef-chat → qwen3.6-27b-fast ·
sintef-coder → qwen3.6-27b-thinking ·
sintef-coder-fast → qwen3.6-27b-fast
max_tokensqwen3.6-27b-thinking tenker før den svarer, og tenkingen bruker av
samme token-budsjett som selve svaret. Setter du max_tokens for lavt,
går hele budsjettet til tenking og du får tomt svar.
La max_tokens stå usatt, eller sett den til minst 2000.
Må du bruke en lav verdi, velg qwen3.6-27b-fast.
Legg dette under provider i ~/.config/opencode/opencode.json. Restart opencode etterpå.
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"aisintefenergy": {
"npm": "@ai-sdk/openai-compatible",
"name": "sintef.energy",
"options": {
"baseURL": "https://api.ai.sintef.energy/v1",
"apiKey": "DIN-NOKKEL"
},
"models": {
"qwen3.6-27b-thinking": { "name": "Qwen3.6 27B (tenker)" },
"qwen3.6-27b-fast": { "name": "Qwen3.6 27B (rask)" }
}
}
}
}Åpne Continue, velg tannhjulet, og legg til i config.yaml.
models:
- name: Qwen3.6 27B (tenker)
provider: openai
model: qwen3.6-27b-thinking
apiBase: https://api.ai.sintef.energy/v1
apiKey: DIN-NOKKEL
roles: [chat, edit, apply]
- name: Qwen3.6 27B (rask)
provider: openai
model: qwen3.6-27b-fast
apiBase: https://api.ai.sintef.energy/v1
apiKey: DIN-NOKKEL
roles: [chat]Åpne innstillingene i utvidelsen og velg OpenAI Compatible.
API Provider: OpenAI Compatible
Base URL: https://api.ai.sintef.energy/v1
API Key: DIN-NOKKEL
Model ID: qwen3.6-27b-thinkingKryss av for function calling / tools hvis utvidelsen spør.
Cmd+, åpner settings.json.
{
"language_models": {
"openai_compatible": {
"sintef.energy": {
"api_url": "https://api.ai.sintef.energy/v1",
"available_models": [
{ "name": "qwen3.6-27b-thinking", "max_tokens": 65536, "max_output_tokens": 8192 },
{ "name": "qwen3.6-27b-fast", "max_tokens": 65536, "max_output_tokens": 4096 }
]
}
}
}
}Nøkkelen limes inn under Assistant → Configure, ikke i fila.
Installer Continue fra Marketplace og bruk samme config.yaml som VS Code:
models:
- name: Qwen3.6 27B (tenker)
provider: openai
model: qwen3.6-27b-thinking
apiBase: https://api.ai.sintef.energy/v1
apiKey: DIN-NOKKEL
roles: [chat, edit, apply]Sett opp som OpenAI-kompatibel leverandør:
PI_BASE_URL=https://api.ai.sintef.energy/v1
PI_API_KEY=DIN-NOKKEL
PI_MODEL=qwen3.6-27b-thinkingBruker verktøyet en konfigurasjonsfil, legg inn baseURL, apiKey og model med samme verdier.
curl https://api.ai.sintef.energy/v1/chat/completions \
-H "Authorization: Bearer DIN-NOKKEL" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-27b-fast",
"messages": [{"role": "user", "content": "Hei!"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.ai.sintef.energy/v1",
api_key="DIN-NOKKEL",
)
r = client.chat.completions.create(
model="qwen3.6-27b-thinking",
messages=[{"role": "user", "content": "Hei!"}],
)
print(r.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.ai.sintef.energy/v1",
apiKey: process.env.SINTEF_API_KEY,
});
const r = await client.chat.completions.create({
model: "qwen3.6-27b-thinking",
messages: [{ role: "user", content: "Hei!" }],
});
console.log(r.choices[0].message.content);Ingen administrator involvert. Fire steg:
Bruk denne base-URL-en sammen med nøkkelen:
https://chat.ai.sintef.energy/api/v1Fungerer i alle verktøyene over — bare bytt ut base-URL-en. Verifisert med chat, streaming og verktøykall, så opencode og lignende agenter virker som normalt.
Trenger du eget forbruksbudsjett, egne rate limits, eller en nøkkel til en
tjeneste, CI-jobb eller et byggesteg, ta kontakt med
bjornar.fjelldal@sintef.no.
Da får du en nøkkel direkte mot api.ai.sintef.energy/v1.
| Selvbetjent | Dedikert | |
|---|---|---|
| Base-URL | chat.ai.sintef.energy/api/v1 | api.ai.sintef.energy/v1 |
| Utstedes av | Deg selv | Administrator |
| Eget budsjett | Nei | Ja |
| Forbrukssporing | Samlet | Per nøkkel |
| Passer til | Personlig bruk | Tjenester og CI |
Nøkler er personlige. Ikke del dem, og ikke sjekk dem inn i git —
bruk en miljøvariabel eller en .gitignore-et fil.
| Symptom | Årsak |
|---|---|
401 | Manglende, feil eller utløpt nøkkel |
429 | Budsjett brukt opp, eller for mange forespørsler |
| Tomt svar | max_tokens for lav — se boksen over |
| Treg første forespørsel | Modellen lastes etter omstart, tar noen minutter |
400 Invalid model | Sjekk modellnavnet mot tabellen over |