Mixture of Experts (MoE) 解説
大規模言語モデルの効率と性能を向上させるMixture of Experts (MoE) アーキテクチャが注目されています。
AI&Tech、もう追いかけなくていい。
30秒で読めるニュースダイジェスト
大規模言語モデルの効率と性能を向上させるMixture of Experts (MoE) アーキテクチャが注目されています。
SetFitを応用し、少ないデータで特定のアスペクトに対する感情を分析する手法が開発されました。
Hugging FaceがLoRAモデルの推論速度を300%向上させる技術を開発しました。
Hugging FaceのOpen LLM LeaderboardにおけるDROPデータセットの評価方法と課題が解説されました。
OpenAIがAIトレーニング用のオープンソースおよびプライベートデータセット作成のため、企業と提携を開始…
Latent Consistency LoRA (LC-LoRA) を用いて、SDXLモデルの画像生成ステップを大幅に削減しました。
災害ツイート分析において、Roberta、Llama 2、MistralのLLM性能がLoRAを用いて比較されました。
OpenAIがAIのフロンティアリスクに対する包括的なアプローチを発表しました。
OpenAIは、高性能AIシステムの壊滅的なリスクに備えるため、準備チームを設立し、課題を開始しました。
Hugging Faceデータセットを一行のPythonコードで対話的に探索できる新機能がリリースされました。
強化学習と人間フィードバック(RLHF)をPPOアルゴリズムで実装する際の具体的な詳細が解説されました。
Hugging FaceがSDXLの推論速度を向上させるためのシンプルな最適化手法を公開しました。