OpenAIの社員がxAIの最新AIモデルGrok3のベンチマーク結果が誤解を招くものであると公然と非難した。
ChainCatcher のメッセージによると、金十の報道で、OpenAI の社員がマスク氏の xAI 社を公然と非難し、同社が発表した最新の AI モデル Grok3 のベンチマーク結果が誤解を招くものであると述べました。これに対し、xAI の共同創業者イゴール・バブシキン(Igor Babushkin)は、同社に不正はないと主張しました。
xAI のグラフは、Grok3 の二つのバージョン------Grok3 Reasoning Beta と Grok3 mini Reasoning------が AIME 2025 で OpenAI の現在最強の利用可能なモデル o3-mini-high を上回るパフォーマンスを示していることを示しています。しかし、OpenAI の社員はすぐに X プラットフォーム上で、xAI のグラフには o3-mini-high の "cons@64" 条件下での AIME 2025 スコアが含まれていないことを指摘しました。
バブシキンは X プラットフォーム上で、OpenAI も過去に類似の誤解を招くベンチマークグラフを発表したことがあると主張しました。これらのグラフは、自社のモデルのパフォーマンスを比較するために使用されていました。
ChainCatcherは、広大な読者の皆様に対し、ブロックチェーンを理性的に見るよう呼びかけ、リスク意識を向上させ、各種仮想トークンの発行や投機に注意することを提唱します。当サイト内の全てのコンテンツは市場情報や関係者の見解であり、何らかの投資助言として扱われるものではありません。万が一不適切な内容が含まれていた場合は「通報」することができます。私たちは迅速に対処いたします。