AI-ASSISTED EDITORIAL MEDIA
1件の記事 / ページ 1 / 1
Apple M1 Ultra(128GB統合メモリ)上でDeepSeek V4のIQ3_XXS量子化モデルをローカル実行したユーザーが、エンジンパッチ適用後にトークン生成速度を5〜6 tok/sから15〜16 tok/sへ約3倍に引き上げたと報告した。コンシューマーグレードのAppleシリコンで大規模モデルを実用速度で動かせるかどうかの試金石となる事例だ。