Carte grand public, le GPU NVIDIA GTX 1660 Ti repose sur l'architecture Turing et dispose de 6 GB de mémoire, avec une bande passante mémoire de 288 GB/s et un TDP de 120 W. Il offre 5,4 TFLOPS de performances FP32. Actuellement disponible chez 1 fournisseur à partir de 0,08 €/GPU/heure, avec une médiane du marché de 0,08 €/GPU/heure sur 1 configurations.
Caractéristiques matérielles
Identiques chez tous les fournisseurs
Prix médian sur l'ensemble des fournisseurs
1 offre chez 1 fournisseurs
Triées par prix croissant. Comparez les configurations côte à côte.
| Fournisseur | Nombre | vCPU | RAM | Région | Par heure de GPU | Total/h | Action |
|---|---|---|---|---|---|---|---|
| ×1 | 8 | 29 GB | 0,079 € -10,0 % 30 j | 0,08 € | Lancer |
LLM qui tiennent sur le GPU NVIDIA GTX 1660 Ti
VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 6 GB par GPU.
| Modèle | Paramètres | 16 bits | 8 bits | 4 bits |
|---|---|---|---|---|
| Granite 4.1 8B IBM | 8,8B | 21 GB Trop grand | 12 GB Trop grand | 6,8 GB Juste sur 1× · 6 % de marge |
| Qwen3 8B Alibaba | 8,2B | 20 GB Trop grand | 11 GB Trop grand | 6,3 GB Juste sur 1× · 14 % de marge |
| Llama 3.1 8B Instruct Meta | 8B | 19 GB Trop grand | 11 GB Trop grand | 6,2 GB Juste sur 1× · 16 % de marge |
| Mistral 7B Instruct v0.3 Mistral AI | 7,2B | 17 GB Trop grand | 9,6 GB Trop grand | 5,6 GB Tient tout juste sur 1× |
| Qwen3 4B Alibaba | 4B | 9,7 GB Trop grand | 5,3 GB Tient tout juste sur 1× | 3,1 GB 1× · 2,9 GB libres |
Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle
Vous en voulez plus sur cette page ?
Des données erronées ?
