faire un abonnement vast.ai
installer un serveur ollama
faire tourner plusieirs modeles successivement.
faire tourner plusieurs modeles en meme temps.


ssh-ed25519 AAAAC3NzaC1lZDI1NTE5AAAAIDw6NFpHs1rqxwoi4Dmy9eQX4wJdQ1EOprD49qO8ltql nicolas b@DESKTOP-KPPH6RI

ssh -p 13777 root@ssh2.vast.ai -L 8080:localhost:8080


ssh -i "C:\Users\Nicolas B\.ssh\id_vast_demo" -p 17725 root@ssh2.vast.ai -L 8080:localhost:8080

ssh -i "C:\Users\Nicolas B\.ssh\id_vast_demo" -p 18271 root@142.170.89.112 -L 8080:localhost:8080

jsson QWEN:
{
  "models": [
    {
      "title": "Qwen 3 480B (Vast.ai)",
      "provider": "openai",
      "model": "qwen3-480b",
      "apiKey": "EMPTY",
      "baseUrl": "http://localhost:8000/v1",
      "contextLength": 32768,
      "completionOptions": {
        "temperature": 0.2,
        "maxTokens": 4096
      }
    }
  ],
  "tabAutocompleteModel": {
    "title": "Qwen 3 Autocomplete",
    "provider": "openai",
    "model": "qwen3-480b",
    "apiKey": "EMPTY",
    "baseUrl": "http://localhost:8000/v1"
  },
  "allowAnonymousTelemetry": false
}
a lancer dans l'ide
ssh -L 8000:localhost:8000 root@[IP_DE_L_INSTANCE] -p [PORT_SSH_VAST]


