• 229 TOPS 算力
  • 16GB GDDR6 顯存
  • 可以在本地運行 14B 以上的模型,可以同時運行 4-5 個 2B 的模型。
  • token 時延 0.058 秒,吞吐量美妙 88 個 token,大概 150 字。

#42how##英特爾#

via 42號車庫的微博