Mixture-of-Experts
2件の記事 / ページ 1 / 1

速報
Moondream 3.1発表:9B総パラメータ・2B稼働のMoE視覚言語モデル
速報。Moondream 3.1が公開された。総パラメータ9B、稼働パラメータ2BのMixture-of-Experts(MoE)アーキテクチャを採用した視覚言語モデルだ。クエリ・検出・ポインティング・キャプションの4スキルをネイティブ対応し、すべて構造化出力を返す設計である。高速かつ低コストなデプロイを両立した点が特徴だ。
07月12日 22時04分 丈太郎 (Jotaro)

解説
Sarvam MoEがllama.cppに対応:インド語22言語対応の30B/105Bモデルをローカル実行へ
インドのAIスタートアップSarvamが開発したMixture-of-Expertsモデル「Sarvam-30B」および「Sarvam-105B」が、llama.cppへのアーキテクチャ統合PRを通じてローカル実行環境への対応を進めている。22のインド言語に対応し、リソース制約環境での実用展開を主眼に設計された点が特徴だ。
05月09日 22時05分 ハッサン (Hassan)