ミストラル・ミディアムが誤って漏洩した?以前は API 経由でのみ利用可能でしたが、そのパフォーマンスは GPT-4 に近いです。 CEO の最新の声明: これは真実であり、初期のクライアントの従業員によって漏洩されたものです。しかし、引き続き注目してください。 写真 つまり、このバージョンはまだ古く、実際のバージョンの方がパフォーマンスが優れています。 この2日間、「Miqu」という謎のモデルが大手モデルコミュニティで話題を呼んでおり、多くの人がこれがLIamaの微調整版ではないかと疑っています。 写真 また、Mistral CEOは、早期の顧客にできるだけ早くGPT-4のパフォーマンスに近いAPIを提供する必要があったため、Mistral MediumをLlama 2をベースに再トレーニングしたと説明。事前トレーニングはMistral 7Bがリリースされた日に完了したとのこと。 真実が明らかになった今、CEOは依然として秘密にしており、多くのネットユーザーが期待を込めて期待している。 写真 写真 ミストラル・ミディアムが誤って漏洩もう一度事件全体を振り返ってみましょう。 1月28日、Miqu Devという謎のユーザーがHuggingFaceに「miqu-1-70b」というファイルセットを投稿した。 写真 ドキュメントには、新しい LLM の「プロンプト形式」とユーザー対話方法は Mistral と同じであると記載されています。 同日、4chan の匿名ユーザーが miqu-1-70b ファイルへのリンクを投稿しました。 そこで、一部のネットユーザーがこの不思議なモデルに気づき、ベンチマークテストを始めました。 結果は驚くべきもので、EQ-Bench(ローカル評価)で83.5ポイントを獲得し、 GPT-4を除く世界中の他のすべての大規模モデルを上回りました。 ネットユーザーたちは一時期、この大物モデルをランキングに加え、その背後にいる本当のモデルを見つけ出すよう強く求めていた。 疑わしい点は主に 3 つあります。
一部のネットユーザーは比較結果を投稿した。標準的な答えを知っているのは合理的だが、ロシア語の文言でさえミストラル・ミディアムとまったく同じであるということはあり得ない。 写真
しかし、他のネットユーザーは、それがMoEモデルではなく、LIama 2と同じアーキテクチャ、パラメータ、レイヤー数を持っていることを発見しました。 写真 しかし、他のネットユーザーからは、ミストラル7bもラマ7Bと同じパラメータとレイヤー数を持っているのではないかとすぐに疑問視されました。 むしろ、これはミストラルの初期の非 MoE バージョン モデルに似ています。 写真 しかし、多くの議論を経て、多くの人々の心の中でこれがすでに GPT-4 に最も近いモデルであることは否定できません。 写真 現在、ミストラルの共同創設者兼CEOのアーサー・メンシュ氏は、この漏洩は同社の初期の顧客の熱心すぎる従業員が、彼らがトレーニングして公開した古いモデルの量子化バージョンを漏洩したことによって引き起こされたと認めている。 Perplexity に関しては、CEO は Mistral Medium の重量を入手したことがないことも明らかにしました。 写真 ネットユーザーたちはこのバージョンが削除されるのではないかと心配している。 写真 興味深いことに、メンシュ氏はHuggingFaceの投稿を削除するよう求めなかった。 写真 代わりに、私は「帰属の問題を検討するかもしれない」というコメントを残しました。 参考リンク: |
<<: ChatGPTへのチップは本当に効果があります! 10元や10万元は大きな効果がありますが、1セントでは増えるどころか減るだけです。
ロンドン動物学会(ZSL)は、英国で深刻化する生物多様性の問題に取り組むため、ネットワーク・レールと...
チャットボックスを閉じた後、Li Li はカスタマーサービスとの先ほどの会話を思い出しました。製品紹...
[[441526]]近年、ディープラーニングは一連のタスク(画像認識、物体認識、セマンティックセグメ...
導入ノートパソコン、スマートフォン、センサーはすべて、モノのインターネット向けに大量のデータを生成し...
優れた機械学習研究者になるために必要な資質は何でしょうか? 強力なコーディングスキルでしょうか? そ...
[[377490]]海外メディアの報道によると、フェイスブックは1月21日、視覚障害のあるユーザー向...
現在、国内RPA市場の競争は激化しており、多くのメーカーが独自のRPA製品やブランドを立ち上げていま...
[[197951]]基本概念このセクションでは、勾配降下法をより一般化するために、機械学習アルゴリズ...
「暗闇が私たちの光を引き立てる/そして私は漠然とした幻想しか見ることができない/孤独の瞬間のあなた...
執筆者 | Yifeng 2月中、ソラは当然のAIスターとなり、彼が公開した2つのAIビデオは数え切...
先日終了した全国人民代表大会と中国人民政治協商会議では、「科学技術イノベーション」という言葉が頻繁に...
人工知能に必要な条件:ディープラーニングモデル、ビッグデータ、計算能力著者: マイケル・チャン201...