Språkmodeller

Selvhostet LLM med OpenAI-kompatibelt API. Kjører på egne GPU-er hos sintef.energy — data forlater ikke huset.

ChatNettgrensesnitt, og her henter du din egen API-nøkkel. AdministrasjonNøkler, budsjetter og forbruk. Koble til IDEopencode, VS Code, Zed, JetBrains …

Endepunkt

https://api.ai.sintef.energy/v1

Alt som snakker OpenAI-protokollen fungerer. Du trenger en API-nøkkel — se nedenfor.

Modeller

Navnet forteller hvilken modell det er og hvordan den er stilt inn: modell-variant. Alle peker på samme underliggende modell — det er innstillingen som skiller dem.

ModellTenker førstBruk til
qwen3.6-27b-fast Nei Svarer direkte. Raskest, og trygg når klienten setter lav max_tokens.
qwen3.6-27b-thinking Ja Resonnerer før svar. Best kvalitet på koding og agentarbeid.
qwen3.6-27b Modellens standard Rå tilgang uten overstyring.

Qwen3.6-27B er en åpen modell fra Alibaba, kvantisert til 4 bit (AWQ-INT4) og kjørt over to RTX 3090. Kontekstvindu 65 536 tokens. Den forstår også bilder.

Gamle modellnavn

sintef-chat, sintef-coder og sintef-coder-fast fungerer fortsatt, men er utfaset. Bytt til navnene over ved anledning.
sintef-chatqwen3.6-27b-fast · sintef-coderqwen3.6-27b-thinking · sintef-coder-fastqwen3.6-27b-fast

Viktig om max_tokens
qwen3.6-27b-thinking tenker før den svarer, og tenkingen bruker av samme token-budsjett som selve svaret. Setter du max_tokens for lavt, går hele budsjettet til tenking og du får tomt svar. La max_tokens stå usatt, eller sett den til minst 2000. Må du bruke en lav verdi, velg qwen3.6-27b-fast.

Kom i gang

opencode

Legg dette under provider i ~/.config/opencode/opencode.json. Restart opencode etterpå.

{
  "$schema": "https://opencode.ai/config.json",
  "provider": {
    "aisintefenergy": {
      "npm": "@ai-sdk/openai-compatible",
      "name": "sintef.energy",
      "options": {
        "baseURL": "https://api.ai.sintef.energy/v1",
        "apiKey": "DIN-NOKKEL"
      },
      "models": {
        "qwen3.6-27b-thinking": { "name": "Qwen3.6 27B (tenker)" },
        "qwen3.6-27b-fast":     { "name": "Qwen3.6 27B (rask)" }
      }
    }
  }
}

Skaffe API-nøkkel

Selvbetjening — du lager nøkkelen selv

Ingen administrator involvert. Fire steg:

  1. Gå til chat.ai.sintef.energy og logg inn med sintef.energy-kontoen din
  2. Klikk på navnet ditt nederst til venstre → Innstillinger
  3. Velg Konto i menyen, og finn API-nøkler
  4. Trykk Opprett ny nøkkel og kopier den

Bruk denne base-URL-en sammen med nøkkelen:

https://chat.ai.sintef.energy/api/v1

Fungerer i alle verktøyene over — bare bytt ut base-URL-en. Verifisert med chat, streaming og verktøykall, så opencode og lignende agenter virker som normalt.

Dedikert nøkkel

Trenger du eget forbruksbudsjett, egne rate limits, eller en nøkkel til en tjeneste, CI-jobb eller et byggesteg, ta kontakt med bjornar.fjelldal@sintef.no. Da får du en nøkkel direkte mot api.ai.sintef.energy/v1.

SelvbetjentDedikert
Base-URLchat.ai.sintef.energy/api/v1api.ai.sintef.energy/v1
Utstedes avDeg selvAdministrator
Eget budsjettNeiJa
ForbrukssporingSamletPer nøkkel
Passer tilPersonlig brukTjenester og CI

Nøkler er personlige. Ikke del dem, og ikke sjekk dem inn i git — bruk en miljøvariabel eller en .gitignore-et fil.

Feilsøking

SymptomÅrsak
401Manglende, feil eller utløpt nøkkel
429Budsjett brukt opp, eller for mange forespørsler
Tomt svarmax_tokens for lav — se boksen over
Treg første forespørselModellen lastes etter omstart, tar noen minutter
400 Invalid modelSjekk modellnavnet mot tabellen over