GoogleがGeminiを公開 — GPT-4より「強力な」AIモデル

07.12.2023

ジェミニエラ |グジョブ

Gemini — 57 の被験者の知識を統合する AI モデル

Gemini — 57 の被験者の知識を統合する AI モデル

Google Gemini は、57 の被験者からの知識を統合して問題を解決し、専門家レベルで人間を超える初の AI です。

12月6日の夜に発売されたGeminiは、Googleのこれまでで最も先進的かつ汎用的なAIモデルで、OpenAIのGPT-4と競合する。

最近人気のある他の大規模言語モデルとは異なり、Gemini はマルチモーダルな方向で構築されており、テキスト、コード、オーディオ、画像、ビデオなどのさまざまな種類の情報を一般化、操作、結合できます。

ジェミニの優れたテスト結果

Googleは、データセンターからモバイルデバイスまで柔軟な使用ニーズに応えるため、Gemini 1.0はGemini Ultra、Gemini Pro、Gemini Nanoの3つの異なるサイズで提供されると述べた。このうち、Gemini Ultra は最大サイズで最も強力なモデルです。

ジェミニの優れたテスト結果

新モデルの特別な機能

ジェミニ フレキシブルモデル 8675 1701887275 |グジョブ
Gemini AI モデルの 3 次元バージョンを相関させます。画像: グーグル

Google が公開したテスト結果によると、Gemini Ultra は大規模マルチタスク言語理解 (MMLU) テストで 90% のスコアを獲得しました。このモデルは、数学、物理学、歴史、法律、医学、倫理など 57 科目を組み合わせて世界知識と問題解決能力の両方をテストするもので、「難しい質問に答える前に、より慎重に考える能力を発揮する」ことができます。

新モデルの特別な機能

この結果により、Gemini は同じテストで 89.8% を獲得し、エキスパート レベルで人間を超えた最初の AI となりました。 GPT-4 の結果は 87%、LLAMA-2 は 68%、Anthropic の Claude 2 は 78.5% に達しました。

さらに、この最強バージョンの Gemini は、主要な言語モデリングの研究開発において 32 のベンチマークのうち 30 を上回り、熟考的な推論を必要とするさまざまなドメインにまたがるマルチモーダルなタスクをカバーする MMMU (大規模マルチモーダル学際的理解) 機能で 59.4% のスコアを獲得しました。

Gemini Ultra および Pro バージョン

Google DeepMind の CEO であり、Gemini チームの代表であるデミス・ハサビス氏は、同社は世界を認識し、世界と対話する人間の方法にインスピレーションを得た新世代の AI モデルを構築したいと述べました。そのおかげで、AI は単なるスマート ソフトウェアにとどまらず、より便利で直感的な、ユーザーのパートナーのような存在になるでしょう。

「本日、Google がこれまでに開発した最も先進的で汎用的な AI モデルである Gemini を導入することで、このビジョンに一歩近づいています」とハサビス氏は述べています。

Googleによると、Gemini 1.0は優れたパフォーマンスに加えて、テキスト、画像、音声などを同時に認識するように訓練されており、微妙な情報をよりよく理解し、複雑なトピックに関連する質問に答えることができるという。このモデルは、Python、Java、C++、Golang などの今日の人気のあるプログラミング言語で解釈してコーディングすることもできます。

Gemini Ultra および Pro バージョン

ジェミニ mm 02 1200 1701887275 1 |グジョブ
Gemini が処理できる情報の種類 (テキスト、写真、サウンド、ビデオなど) の図。画像: グーグル

Google によると、これらの機能は、Gemini が数十万の文書を読み取って情報を抽出するのに役立ち、それによって科学から金融に至るまで、多くの分野で短期間に新たなブレークスルーを生み出す可能性を切り開きます。

Googleは発表会で、Gemini Ultraバージョンは最も複雑なタスクに対応したバージョンであり、正式発売前に安全性テストを完了する段階にあると述べた。 Gemini Nano は、モバイル デバイスで実行されるタスク向けのバージョンで、Pixel 8 Pro に搭載されます。その時点で、携帯電話には、録音コンテンツの要約や Gboard キーボードでのスマート リプライなどの追加機能が追加される予定です。これら 2 つの Gemini バージョンは来年市場に投入される予定です。

一方、Pro バージョンは Bard チャットボットで使用されるようになりました。ユーザーは、読解力、要約力、推論力、プログラミング力、計画力などのさまざまな要件を通じて変化を体験できます。

これは、Bard にとって発売以来最大のアップグレードでもあります。ただし、Bard は現在英語のみをサポートし、180 の国と地域で使用できる Gemini Pro を使用しています。 Googleは、近い将来Bard向けの言語を拡張すると述べた。来年、Bard はアップグレードされ、Gemini Ultra の最も強力なバージョンを使用する予定です。

ルー・クイ – VnExpress

トピック AIとテクノロジー
タグ 誰が テクノロジー グーグル

続きを読む

meta ra m t g i plus 1 | GUDJOB Meta が Facebook、Instagram、WhatsApp 向けの Plus パッケージを発表 Meta が Plus サブスクリプションを展開 Meta が Plus サブスクリプションを展開 メタ は、主力アプリである Instagram、Facebook、WhatsApp の個人ユーザー向けサブスクリプションを世界中で展開しています. Instagram Plus (月額 3.99 ドル)、Facebook… 08.06.2026 google marketing live 2 | GUDJOB Google マーケティング ライブ 2026: Gemini が AI で次世代の広告とコマースを強化 2026 年 5 月 21 日、Google Marketing Live (GML) 2026 イベントでは、あらゆる規模の企業が Google 検索と YouTube でよりスマートかつ効果的に成長できるように設計された、新世代の Gemini… 25.05.2026 AI Website traffic | GUDJOB AI がトラフィック ゲームを変える: クリックがすべてではなくなったとき 長年にわたり、トラフィックとクリック数はデジタル マーケティングの有効性を評価するほぼ中心的な指標でした。しかし、人工知能の急速な発展により、ユーザーがオンラインで情報にアクセスする方法が変わり、ブランドの見方や記憶の仕方にも変化が生じています。検索エンジンや AI プラットフォームが集約、要約、直接応答できるようになるにつれて、ユーザーが情報にたどり着くまでの道のりは、以前のように個々のリンクをクリックすることに完全に依存するものではなくなりました。 この変更は、マーケティング担当者にとって、クリックや Web サイトのトラフィックなどのよく知られた指標が依然としてコミュニケーション活動の価値を完全に反映しているかどうかという重要な疑問を引き起こします。新しい状況において、マーケティングの影響は、ブランドの認知度、情報ソースでの言及頻度から、ユーザージャーニーの後期段階で行われる検索やアクセス行動に至るまで、さまざまなシグナルを通じてますます表現されるようになっています。 AI が情報エコシステムの新しい中間層となるにつれ、トラフィックがどのように生成され測定されるかを再理解することがマーケターにとって重要な課題になりつつあります。 AI時代で変化する検索行動 情報を迅速かつ直感的に検索する必要があるため、AI 統合検索エンジンの人気が高まっています。ユーザーは、答えを見つけるために複数の Web サイトにアクセスするのではなく、検索結果ページで直接情報を受け取ることにますます慣れています。 SparkToroの調査データ SparkToro 米国では、約 60% 2024 年の… 16.03.2026 AI Traffic | GUDJOB ブランドがモバイル アプリやウェブサイトを AI 向けに最適化する必要があるのはなぜですか? これまで、ブランドは Google の検索アルゴリズムを中心にデジタル エクスペリエンスを構築してきましたが、専門家らは、消費者の行動が進化するにつれて、それを変える必要があると述べています。 CX Dive の専門家によると、AI アシスタントが気に入るときは、 OpenAI の ChatGPT、Google の Gemini、Microsoft の Copilot 顧客体験における仲介役をますます担うようになる中、ブランドはこれらのツールの利用をより適切にサポートできるよう、モバイルアプリやウェブサイトを再構築する必要があります。 「今後 1… 04.03.2026