O servidor Lenovo AI alcançou pela primeira vez a implementação local do modelo DeepSeek de grande porte com menos de 1TB, suportando 100 operações simultâneas.

A data de 3 de março da Golden 10 News, recentemente, o Grupo Lenovo anunciou que com base no servidor Lenovo WATian WA7780 G3, pela primeira vez na indústria, foi realizado o implantação única do grande modelo DeepSeek-R1/V3 671B, com menos de 1TGB de memória de vídeo reconhecida pela indústria (na realidade, 768GB), proporcionando uma experiência fluida para 100 usuários simultâneos. Segundo os dados de teste da Lenovo, em um ambiente de teste padrão de 512 TOKEN, o sistema suporta 100 usuários simultâneos que recebem continuamente uma saída estável de 10 TOKEN por segundo, com o tempo de resposta do token principal comprimido para menos de 30 segundos.

Ver original
O conteúdo é apenas para referência, não uma solicitação ou oferta. Nenhum aconselhamento fiscal, de investimento ou jurídico é fornecido. Consulte a isenção de responsabilidade para obter mais informações sobre riscos.
  • Recompensa
  • 1
  • Compartilhar
Comentário
0/400
Andruchovip
· 03-03 05:30
autor excelente!!!
Ver originalResponder0
  • Marcar
Faça trade de criptomoedas em qualquer lugar e a qualquer hora
qrCode
Escaneie o código para baixar o app da Gate.io
Comunidade
Português (Brasil)
  • 简体中文
  • English
  • Tiếng Việt
  • 繁體中文
  • Español
  • Русский
  • Français (Afrique)
  • Português (Portugal)
  • ไทย
  • Indonesia
  • 日本語
  • بالعربية
  • Українська
  • Português (Brasil)