Le serveur Lenovo AI réalise pour la première fois un déploiement local du modèle DeepSeek à pleine capacité avec moins de 1 To, prenant en charge 100 connexions simultanées.
Les données Jinshi du 3 mars ont récemment annoncé que le groupe Lenovo a annoncé la première mise en œuvre dans l'industrie du déploiement en solo du grand modèle DeepSeek-R1/V3 671B sur le serveur Lenovo Wentai WA7780 G3, avec une mémoire vidéo inférieure à 1 TGB reconnue par l'industrie (réellement 768 Go) pour offrir une expérience fluide à 100 utilisateurs simultanés. Selon les données de test de Lenovo, dans un environnement de test standard à 512 tokens, ce système peut prendre en charge 100 utilisateurs simultanés pour une sortie stable de 10 tokens par seconde, avec un temps de réponse token initial réduit à moins de 30 secondes.
Le contenu est fourni à titre de référence uniquement, il ne s'agit pas d'une sollicitation ou d'une offre. Aucun conseil en investissement, fiscalité ou juridique n'est fourni. Consultez l'Avertissement pour plus de détails sur les risques.
Le serveur Lenovo AI réalise pour la première fois un déploiement local du modèle DeepSeek à pleine capacité avec moins de 1 To, prenant en charge 100 connexions simultanées.
Les données Jinshi du 3 mars ont récemment annoncé que le groupe Lenovo a annoncé la première mise en œuvre dans l'industrie du déploiement en solo du grand modèle DeepSeek-R1/V3 671B sur le serveur Lenovo Wentai WA7780 G3, avec une mémoire vidéo inférieure à 1 TGB reconnue par l'industrie (réellement 768 Go) pour offrir une expérience fluide à 100 utilisateurs simultanés. Selon les données de test de Lenovo, dans un environnement de test standard à 512 tokens, ce système peut prendre en charge 100 utilisateurs simultanés pour une sortie stable de 10 tokens par seconde, avec un temps de réponse token initial réduit à moins de 30 secondes.