45 lines
1.2 KiB
Plaintext
45 lines
1.2 KiB
Plaintext
faire un abonnement vast.ai
|
|
installer un serveur ollama
|
|
faire tourner plusieirs modeles successivement.
|
|
faire tourner plusieurs modeles en meme temps.
|
|
|
|
|
|
ssh-ed25519 AAAAC3NzaC1lZDI1NTE5AAAAIDw6NFpHs1rqxwoi4Dmy9eQX4wJdQ1EOprD49qO8ltql nicolas b@DESKTOP-KPPH6RI
|
|
|
|
ssh -p 13777 root@ssh2.vast.ai -L 8080:localhost:8080
|
|
|
|
|
|
ssh -i "C:\Users\Nicolas B\.ssh\id_vast_demo" -p 17725 root@ssh2.vast.ai -L 8080:localhost:8080
|
|
|
|
ssh -i "C:\Users\Nicolas B\.ssh\id_vast_demo" -p 18271 root@142.170.89.112 -L 8080:localhost:8080
|
|
|
|
jsson QWEN:
|
|
{
|
|
"models": [
|
|
{
|
|
"title": "Qwen 3 480B (Vast.ai)",
|
|
"provider": "openai",
|
|
"model": "qwen3-480b",
|
|
"apiKey": "EMPTY",
|
|
"baseUrl": "http://localhost:8000/v1",
|
|
"contextLength": 32768,
|
|
"completionOptions": {
|
|
"temperature": 0.2,
|
|
"maxTokens": 4096
|
|
}
|
|
}
|
|
],
|
|
"tabAutocompleteModel": {
|
|
"title": "Qwen 3 Autocomplete",
|
|
"provider": "openai",
|
|
"model": "qwen3-480b",
|
|
"apiKey": "EMPTY",
|
|
"baseUrl": "http://localhost:8000/v1"
|
|
},
|
|
"allowAnonymousTelemetry": false
|
|
}
|
|
a lancer dans l'ide
|
|
ssh -L 8000:localhost:8000 root@[IP_DE_L_INSTANCE] -p [PORT_SSH_VAST]
|
|
|
|
|