Moonshot は Prefill/Decode のデカップリングを実現し、異なるデータセンター間での運用を可能にしました。異種ハードウェアでも動作し、コスト構造に大きな変革をもたらします。

原文表示
MeNews
Moonshot AI は Prefill/Decode のデカップリング技術を、クロスデータセンターおよび異種ハードウェアに拡張しました
ME News ニュース、4月18日(UTC+8)、Moonshot AI チームは最近、Prefill(事前入力)とDecode(デコード)のデカップリング技術が単一クラスターからデータセンター間および異種ハードウェア環境へと成功裏に拡張されたことを発表しました。記事の見解によると、この動きは各トークンの推論コストを大幅に削減することが期待されています。以前は、この技術の拡張はKVキャッシュの伝送オーバーヘッドの問題により妨げられていました。今回の突破の実現は、そのハイブリッドモデルKimiに大きく依存しています。
このページには第三者のコンテンツが含まれている場合があり、情報提供のみを目的としております(表明・保証をするものではありません)。Gateによる見解の支持や、金融・専門的な助言とみなされるべきものではありません。詳細については免責事項をご覧ください。
  • 報酬
  • コメント
  • リポスト
  • 共有
コメント
コメントを追加
コメントを追加
コメントなし
  • ピン留め