- 229 TOPS 算力
- 16GB GDDR6 顯存
- 可以在本地運行 14B 以上的模型,可以同時運行 4-5 個 2B 的模型。
- token 時延 0.058 秒,吞吐量美妙 88 個 token,大概 150 字。
#42how##英特爾#
via 42號車庫的微博
#42how##英特爾#
via 42號車庫的微博
本頁同步自 Tesla Share · @Tesla_share 的公開消息,保留頻道正文和提供的參考來源。媒體報道、引用與頻道整理請結合原始來源閲讀;網站歸檔可能落後於頻道編輯,最新版本請核對 Telegram 原文 ↗。
Tesla Share 是獨立中文資訊頻道,與 Tesla, Inc. 無隸屬關係。瞭解來源與整理方式 →