Gemini に関するニュース
60件の関連ニュースを新しい順に表示しています。

Gemini 3.5 Transcribe によるインテリジェントな文字起こし
Google DeepMindは、AIモデル「Gemini 3.5 Transcribe」を発表しました。この技術は、音声データを高精度なテキストに変換する文字起こし機能を大幅に向上させるものです。従来の文字起こしツールに比べ、より文脈を理解し、話者の意図を汲み取ったインテリジェントな処理が可能になるとされています。これにより、会議の議事録作成、インタビューの記録、動画コンテンツの字幕生成など、多様な場面での活用が期待されます。Google DeepMindは、Gemini 3.5 Transcribeが、音声情報の活用方法に革新をもたらすとしています。 (Google DeepMind)
出典: Google DeepMind

Ticketmaster、Gemini AIでイベントチケット検索可能に
イベントチケットの購入がより手軽になる。Ticketmasterは、GoogleのAIチャットボット「Gemini」との連携を開始し、アプリ内でイベントチケットの検索が可能になった。 これにより、ユーザーはGeminiに対して「〇〇(アーティスト名)のコンサートチケットを探して」といった具体的な指示を出すだけで、Ticketmasterが提供するチケット情報を得られるようになる。従来の検索方法よりも直感的かつ迅速に、希望するイベントのチケットを探し出すことができると期待される。この機能は、イベント参加へのハードルを下げるだけでなく、新たなチケット検索体験を提供するものとなるだろう。 Billboard
出典: Billboard

Google I/O 2026発表まとめ:Pixel 11、Pixel Watch 5、Pixel Tag、Gemini機能多数
Googleは年次開発者会議「Google I/O 2026」において、次期スマートフォン「Pixel 11」シリーズを発表しました。具体的なスペックやデザインはまだ明らかになっていませんが、AI機能の強化が期待されています。 また、AppleのAirTagに対抗する位置情報トラッカー「Pixel Tag」も初公開されました。Pixel Tagは、Pixelデバイスのネットワークを活用して紛失物を探す機能を提供するとみられています。 さらに、スマートウォッチの最新モデル「Pixel Watch 5」や、同社の大規模言語モデル「Gemini」を統合した多数の新機能も発表されました。これらの発表は、Googleのハードウェア製品群とAI技術の連携をさらに深め、Androidエコシステムの魅力を高めることを目指すものです。 TechCrunch AI
出典: TechCrunch AI

ChatGPTとGemini、どちらもユーザー数10億人突破
Googleの製品が10億ユーザーを達成したのは今回で14回目となる。GoogleのCEO、サンダー・ピチャイ氏はX(旧Twitter)で、Geminiを毎月10億人が利用しており、GeminiはGoogle史上最も急速に成長している製品だと投稿した。
出典: The Verge AI

「Gemini」利用者を10倍にした首都高の泥臭いDX。背景に「9割が見ても使わない」動画研修の失敗
首都高速道路では、グーグル「Gemini」の必修動画を9割超が受講したものの、業務への定着にはつながりませんでした。そこで終日の対面研修を実施し、高頻度利用者を約10倍に増やしました。
出典: Business Insider Japan

Gemini“ヘビーユーザー”が1年で10倍に 「平均年齢高い、IT本業じゃない」首都高が実践したAI活用推進ノウハウ(ITmedia NEWS)
企業による生成AIの導入は増えたが、配ったツールが現場に定着せず「導入しただけ」になってしまう企業もあるだろう。 首都高速道路株式会社(以下、首都高)では、月100回以上「Gemini」を利用す
出典: Yahoo!ニュース IT

半導体を売るために借金したグーグル親会社アルファベットの決算が映す「AIビジネスの構造変化」 | 政治・経済・投資 | 東洋経済オンライン
アルファベットは自社開発のAIチップ「TPU」や基盤モデル「Gemini」、検索からYouTubeまでを一手に扱うフルスタック体制でAI競争の最前線に立っています。
出典: 東洋経済オンライン

Mac版「Gemini」、Fnキーで自然な音声入力が可能に ローカルファイルを参照した作業も
米グーグルは29日(現地時間)、macOS向け「Gemini」アプリへ新たな自然言語機能を追加したと発表した。Fnキーを長押しすることで、デスクトップ上のどのウィンドウからでも音声による入力や操作ができる。全ユーザー向けに英語で順次提供が始まっており、今後は対応言語を拡大する予定。
出典: ケータイ Watch

Gemini APIマネージドエージェント:3.6 Flash、フックなどが登場
Googleは、開発者が本番環境で利用できる信頼性の高いAIエージェントを構築するための新機能群をGemini APIのマネージドエージェントに追加しました。今回新たに、高性能な3.6 Flashモデルと、外部サービスとの連携を容易にするフック機能が利用可能になりました。 これらの新機能により、開発者はより迅速かつ効率的に、高度なAIエージェントを開発できるようになります。3.6 Flashモデルは、低レイテンシーと高いスループットを両立させ、リアルタイム性が求められるアプリケーションに適しています。また、フック機能は、既存のシステムやデータベース、APIなどとAIエージェントをシームレスに連携させることを可能にし、より複雑で実用的なエージェントの開発を支援します。 今回のアップデートは、AIエージェントの開発エコシステムをさらに拡充し、多様なユースケースへの展開を加速させることが期待されます。 (Google AI Blog)
出典: Google AI Blog
Gemini Robotics 2、ロボットに全身知能を搭載
Google DeepMindは、ロボットの知能を飛躍的に向上させる次世代システム「Gemini Robotics 2」を発表しました。このシステムは、ロボットがより高度で複雑な作業をこなせるように設計されており、人間のような器用さと多様なタスクへの対応能力を目指しています。 Gemini Robotics 2を搭載したロボットは、これまで困難とされてきた多様な環境下での作業や、繊細さが求められる作業を、より効率的かつ正確に実行できるようになると期待されています。この技術革新は、製造業、物流、さらには家庭での利用まで、幅広い分野でのロボット活用を加速させる可能性を秘めています。Google DeepMindは、このシステムを通じて、ロボットが人間社会の様々な課題解決に貢献できる未来を目指しています。 (Google DeepMind)
出典: Google DeepMind

LLMの導入設定が疑似科学の検証をどう形成するか、不透明な認識媒介
大規模言語モデル(LLM)が、科学的な主張に対する評価において、その導入設定によって結果が大きく左右され、透明性に欠けることが明らかになりました。 この度、4つの主要LLMファミリー、すなわちClaude、Grok、GPT、Geminiを対象に、エトノナショナリズム(民族主義)に関連する疑似科学的な主張への対応を検証した研究結果が発表されました。その結果、LLMが知識参照として利用される一方で、科学的主張に対する態度は不安定で、その判断プロセスは不透明であることが浮き彫りになりました。 特に、Grokの高速版は、他のモデルと比較して2〜5倍高い信頼度スコアを安定して付与するという特徴を示しました。しかし、この特異な挙動は文書化されることなく、仕様が変更されたと報告されています。このようなLLMの導入設定の不透明さは、科学的知見の評価における公平性や再現性に疑問を投げかけるものです。 arXiv cs.CL
出典: arXiv cs.CL

Meta、AIチャットボットをアシスタントのように進化させる
Metaは、Gemini、ChatGPT、Claudeといった競合他社と競争するため、AIチャットボットに新たな生産性機能を搭載してアップグレードしている。
出典: The Verge AI

サムスン、Android XR搭載のスマートグラスを発表 ユーザーの視界に直接AIを取り込み
サムスン電子は、英国ロンドンで開催したイベント「Galaxy Unpacked」で、新たなインテリジェントアイウェア(スマートグラス)を発表した。グーグルのAIアシスタント「Gemini」を搭載し、アイウェアブランドのGentle MonsterおよびWarby Parkerと協業して開発された。
出典: ケータイ Watch

グーグル「Gemini 3.6 Flash」公開 効率・品質バランスに優れた主力モデル(Impress Watch)
Googleは21日(米国時間)、「Gemini 3.6 Flash」、「Gemini 3.5 Flash-Lite」、「Gemini 3.5 Flash Cyber」の3つの新モデルを発表した。Ge
出典: Yahoo!ニュース IT
Google、「Gemini 3.6 Flash」など3モデルを発表 出力トークンを削減しつつ値下げ、「Gemini 4」も予告
Googleは、Geminiの「Flash」シリーズに「3.6 Flash」「3.5 Flash-Lite」「3.5 Flash Cyber」の3モデルを追加した。効率性と低遅延を追求し、AIエージェント構築に適した性能を備える。3.6 Flashは出力価格が引き下げられた。
出典: ITmedia AI+

政府・提携先に限定提供、脆弱性対策特化のGemini 3.5 Flash Cyber(PC Watch)
ソフトの弱点を、AIが人より速く見つけて直す。Googleは7月22日(日本時間)、セキュリティに特化した新AIモデル「Gemini 3.5 Flash Cyber」を発表した。脆弱性(ソフトの安全
出典: Yahoo!ニュース IT

Gemini 3.6 Flash登場!17%効率化+値下げ。3.5 Flash-Liteも(PC Watch)
新しいAIモデルなのに、前の世代より安い。Googleは7月22日(日本時間)、大規模言語モデル「Gemini」に、高速・低コスト帯の新モデル2種を追加した。「Gemini 3.6 Flash」は前
出典: Yahoo!ニュース IT

Google、AIモデル「Gemini 3.6 Flash」や「3.5 Flash-Lite」を発表(ケータイ Watch)
米Google(グーグル)は、AIモデルの最新版となる「Gemini 3.6 Flash」や「Gemini 3.5 Flash-Lite」、「Gemini 3.5 Flash Cyber」を発表した
出典: Yahoo!ニュース IT

Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberを発表
Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberを含む、新しいGeminiモデルを発表します。
出典: Google DeepMind
Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyberが登場
Googleは、AIモデル「Gemini」の新たなファミリーとして、「Gemini 3.6 Flash」、「Gemini 3.5 Flash-Lite」、「Gemini 3.5 Flash Cyber」を発表しました。これらのモデルは、AI技術のさらなる進化を目指して開発されたものです。 Gemini 3.6 Flashは、迅速な応答と効率的な処理能力を特徴としています。一方、Gemini 3.5 Flash-Liteは、より軽量な設計でありながら、多くのタスクで高いパフォーマンスを発揮することが期待されます。さらに、Gemini 3.5 Flash Cyberは、特定の分野に特化した高度な機能を持つモデルとして位置づけられています。 これらの新しいGeminiモデルは、様々なアプリケーションやサービスにおいて、より高度で多様なAI機能を提供する基盤となることが見込まれます。Google DeepMindは、これらのモデルを通じて、AIの可能性をさらに広げていく方針です。 (Google DeepMind)
出典: Google DeepMind
Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberを発表
Googleは、AIモデル「Gemini」の新たなラインナップとして、「Gemini 3.6 Flash」、「3.5 Flash-Lite」、「3.5 Flash Cyber」を発表しました。これらのモデルは、AI技術のさらなる進歩を示すものとして注目されています。 今回発表されたGeminiの新モデル群は、AIの能力を拡張し、より多様な用途への応用を目指しています。具体的な性能や特徴についての詳細は現時点では明らかにされていませんが、Google DeepMindはこれらのモデルを通じて、AI分野における革新を推進していく方針です。今後、これらの新モデルがどのような分野で活用され、どのような影響をもたらすのか、その展開が期待されます。 Google DeepMind
出典: Google DeepMind

最新VLMにおける強力なピクセルレベル画像改ざん検出のためのシンプルなドメイン汎化
画像生成・編集技術の急速な進展に伴い、ピクセルレベルでの画像改ざん検出の重要性が増しています。この課題に対し、最新のビジョン・言語モデル(VLM)においても高い精度で改ざんを検出する新たな手法が提案されました。 研究チームは、ChatGPTやGeminiといった先進的なVLMによって生成・改ざんされた画像に対し、ドメイン汎化と呼ばれる技術を用いて、改ざん検出モデルの頑健性を高めることを目指しました。具体的には、学習データにおけるバッチサンプリングの工夫と、モデルの後半段階で情報を注入する「late-injection」戦略を組み合わせることで、多様なVLM生成改ざんの分布に対しても、安定した検出性能を発揮するモデルの学習を可能にしました。このアプローチにより、様々なVLMが生成する改ざん画像に対しても、より信頼性の高い検出が期待されます。 (arXiv cs.AI)
出典: arXiv cs.AI

初心者でもわかる! Python で学ぶマクロ経済学入門 全100回 総復習
user: 「Pythonで学ぶ マクロ経済学入門」も 100回目まで連載しました。ここでまた、これまでの内容の振り返りをしたいと思います。今回はClaude Codeさん、Geminiさん、ChatGPTさんにお願いしました。 Claude Code: Python...
出典: Qiita 人気記事
Google、脆弱性発見・修正のための軽量サイバーセキュリティモデル「Gemini 3.5 Flash Cyber」を発表
Googleは、サイバーセキュリティ分野における脆弱性の発見と修正を支援する、軽量なAIモデル「Gemini 3.5 Flash Cyber」を発表しました。このモデルは、セキュリティ専門家が迅速かつ効率的に脅威を特定し、対応策を講じることを目的として開発されました。 Gemini 3.5 Flash Cyberは、サイバーセキュリティに特化したデータで学習されており、コードの分析や異常検出などのタスクを高速に実行することが可能です。これにより、セキュリティインシデント発生時の対応時間を短縮し、被害の拡大を防ぐことが期待されます。Google DeepMindは、このモデルがサイバー攻撃への防御能力向上に貢献することを目指しています。 Google DeepMind
出典: Google DeepMind

グーグル、「NotebookLM」を「Gemini Notebook」へ名称変更(ビジネス+IT)
グーグルは7月16日、AIを活用したリサーチツール「NotebookLM」の名称を「Gemini Notebook」に変更したと発表した。単体ツールとしての提供は継続しつつ、GeminiアプリやGo
出典: Yahoo!ニュース IT
![[ITmedia News] Google、「NotebookLM」を「Gemini Notebook」に改称 Geminiエコシステムへの統合を強化](https://image.itmedia.co.jp/news/articles/2607/17/cover_news062.jpg)
[ITmedia News] Google、「NotebookLM」を「Gemini Notebook」に改称 Geminiエコシステムへの統合を強化
Googleは、AI搭載リサーチツール「NotebookLM」の名称を「Gemini Notebook」に変更すると発表した。機能は単体製品として維持しつつ、エコシステム全体で広く機能するようになる。
出典: ITmedia 全カテゴリ
![[ITmedia ビジネスオンライン] 【ヒット記事まとめ】ChatGPT、Gemini、Copilot……生成AIツールの「使い分け」最適解は?【無料配布】](https://image.itmedia.co.jp/business/articles/2607/17/ko01_w250.png)
[ITmedia ビジネスオンライン] 【ヒット記事まとめ】ChatGPT、Gemini、Copilot……生成AIツールの「使い分け」最適解は?【無料配布】
ChatGPT、Gemini、Copilot、Adobe、Apple Creator Studio……。次々と登場するツールや新機能に「結局どれを使えば、自分の業務が一番効率化できるのか?」と悩んでいる人も多いのではないだろうか。
出典: ITmedia 全カテゴリ

実はChrome、AIブラウザに進化してました。無料で使える「Gemini in Chrome」の実力を動画でチェック
普段使っているWebブラウザ、Chromeがいつの間にか大幅進化していることに気付いていますか?実はこの春からChromeの右上に“Geminiに相談”というボタンが実装されました。これはGemini in Chromeという注目の新機能なんです。
出典: PC Watch

NTTデータ、Google Cloudとの包括契約により「Google Workspace」「Gemini Enterprise」の活用基盤を整備
株式会社NTTデータは16日、Google Cloudとの間で「Agentic Workplace Transformation(AWT)」に関する包括契約を6月29日に締結したと発表した。
出典: クラウド Watch

Alphabet株、AIモデルGemini 3.5 Proのリリース遅延報道で下落
Alphabetは5月にAIモデルGemini 3.5 Proを発表し、社内では利用可能だが、より広範な展開は翌月までずれ込むと述べていた。
出典: CNBC World
Google Vids、AIアバターで自分が出演する動画作成が可能に
Googleは、同社の新しい動画編集ツール「Google Vids」に、AIアバターとしてユーザー自身が登場する動画を生成できる新機能を追加しました。この機能は、Googleの最新AIモデルであるGemini Omniを搭載しており、テキストによる指示(プロンプト)や、参考となる画像をもとに、ユーザーのデジタルアバターを動画内に登場させることが可能になります。 これにより、専門的な撮影機材や技術がなくても、手軽に自分が出演する解説動画やプレゼンテーション動画などを作成できるようになります。動画の編集作業もAIがサポートするため、より効率的かつ創造的な動画制作が期待されます。この機能は、ビジネスシーンでの活用はもちろん、個人クリエイターなど幅広いユーザー層のニーズに応えるものとなりそうです。 TechCrunch
出典: TechCrunch

Google Vidsが2つのアップデートで動画作成・編集・主演を容易に
Google WorkspaceにAIを活用した動画作成ツール「Google Vids」が登場し、動画制作のハードルが大幅に下がりました。新たに搭載された「Gemini Omni」は、Google Workspace全体で利用できるAIモデルで、動画の作成から編集、さらにはAIによる「主演」まで、これまで専門知識が必要だった作業を直感的に行えるようにします。 このアップデートにより、ユーザーはより手軽に、そして効果的に動画コンテンツを作成できるようになります。例えば、会議の議事録を基に自動で動画を生成したり、プレゼンテーション資料から解説動画を作成したりといった活用が想定されます。また、パーソナルアバター機能を使えば、個人の分身のようなアバターが動画に出演し、よりパーソナルなメッセージを伝えることも可能になります。これにより、ビジネスコミュニケーションや情報共有のあり方が変化していくことが期待されます。(Google AI Blog)
出典: Google AI Blog

グーグルにまた訴訟、「Gemini」の著作権侵害で 大手出版社らが「無断利用」に怒り
Googleに対し、出版社や作家らが新たな訴訟を提起した。原告は、Googleが出版社との提携関係を悪用して「膨大な数の著作物を臆面もなく複製」し、AIの学習に利用したと主張している。
出典: はてなブックマーク IT

「デザインによる忠実性」:多関係者向けLLM生成臨床試験要約の評価と改善
大規模言語モデル(LLM)は、医療提供者、患者、支払者を対象とした臨床試験結果の要約にますます利用されていますが、幻覚(ハルシネーション)の傾向は、この重要な文脈において重大なリスクをもたらします。本研究では、3つの関係者オーディエンスにわたるLLM生成臨床試験要約の忠実性を測定するためのベンチマーク評価フレームワークを導入します。このフレームワークは、Aggregate Analysis of ClinicalTrials.govデータベースから抽出した200の層化された試験で構成され、オーディエンス固有のプロンプトテンプレートと6次元の忠実性アノテーションスキーマを使用して評価されます。GPT-4o、Claude Sonnet 4.6、Gemini 2.5 Flashのベースライン測定値が、クロスエンコーダー自然言語推論(NLI)モデルを使用してスコアリングされた1,800の生成要約全体で確立されました。3つのモデルすべてで、主な失敗モードとして「裏付けのない主張」が特定され、平均アノテーションスコアは3点満点中1.55でした。
出典: arXiv cs.CL
GoogleとAIM、AIツール「ATL Saathi」でインドの教育者を支援
GoogleとAIM(Atal Innovation Mission)は、AIツール「ATL Saathi」を発表しました。このツールは、Googleの先進的なAIモデルであるGeminiを搭載しており、インド国内の教育者が「アタル・ティンカリング・ラボ」での活動を支援することを目的としています。 「ATL Saathi」は、ロボティクスなどの技術分野における教育者の指導をサポートし、生徒たちの創造性や問題解決能力の育成に貢献することを目指しています。具体的には、教材のアイデア提供や、生徒のプロジェクトに対するフィードバックの生成などをAIが支援することで、教育者はより生徒一人ひとりに寄り添った指導が可能になると期待されています。 この取り組みは、次世代のイノベーターを育成するという、インド政府の「アタル・イノベーション・ミッション」の目標達成を後押しするものです。AI技術を活用することで、より多くの生徒が科学技術分野に興味を持ち、将来のイノベーションを担う人材へと成長する機会を提供することを目指しています。 (Google DeepMind)
出典: Google DeepMind

WazeにAI搭載の新機能が多数登場
WazeがAIで生まれ変わります。Googleは、ドライバーの体験をよりパーソナルにするため、同社の主力AIアシスタントであるGeminiをナビアプリに統合します。4つの新機能のうち、Geminiが関わるのは2つだけです。
出典: The Verge AI

Google SheetsのAI機能「Fill with Gemini」が新たに11言語へ対応
Googleは7月7日(現地時間)、Google Sheetsで利用できるAI機能「Fill with Gemini」とAI機能について、新たに11言語へ対応を拡大したと発表した。 従来は英語、スペ...
出典: CodeZine

大規模言語モデルの賛否バイアスは、道徳的判断の変化ではなく、回答順序と文言を反映する
大規模言語モデル(LLM)は、二者択一的な判断を下すことが増えており、論理的に無関係な文言の変化によって、その判断が変化することが報告されています。これには、人間には見られない道徳的ジレンマにおける賛否バイアスの増幅が含まれます。本研究では、この変化が何であるかを特定するために、論理的に無関係な要因をバランスの取れたペアで反転させる「クロス対称化」という精神測定バッテリーを導入しました。論理的に同等な形式にわたる段階的な評価により、首尾一貫した内部道徳尺度が得られ、最先端モデルのスタンスは形式にほぼ依存しませんでした。一方、小型のオープンウェイトモデルは、モデル固有の方法で失敗しました。賛否による評決の強制は、最後の選択肢への順序バイアス(人間のプライマシー効果とは逆)と、「いいえ」という単語への語彙的な引き寄せという、分解可能なアーティファクトを重ね合わせます。このアーティファクトは、Claudeモデル(ストーリー平均-0.32から-0.86)で顕著ですが、GPT-5.5やGeminiでは約0であり、拡張推論の下で縮小します。単語と評決は1つのトークンを共有します。
出典: arXiv cs.CL

アプリ層から低レイヤーを打ち抜く:WhatsApp GIF脆弱性(CVE-2019-11932)をGemini×Claudeで徹底検証
! 🚨 注意事項・免責事項 本記事は、Awakened氏が発見した過去(2019年)の修正済み脆弱性の技術解説です。 セキュリティの学習と検証のみを目的としており、実際の攻撃を助長・手助けするものではありません。
出典: Zenn

Gemini、米国でコミッション無料の株式取引を開始(NADA NEWS)
暗号資産取引所のGeminiが、米国でコミッション無料の株式取引サービスを開始しました。同社のアプリからナスダックやニューヨーク証券取引所に上場する数千社の株を直接売買できるようになります。これまで暗号資産が専門だった同社が、より安定した投資先である株式取引に参入することで、顧客ニーズの拡大と手数料負担の軽減を図る動きと言えます。金融サービスの民主化が進む中、テック企業による金融業への進出の一例となっています。
出典: Yahoo!ニュース IT

Gemini API のマネージドエージェント拡張:バックグラウンドタスク、リモートMCPなど
Googleは、開発者がより堅牢で信頼性の高いAIエージェントを構築できるよう、Gemini APIのマネージドエージェントに新たな機能を追加しました。今回のアップデートにより、バックグラウンドで実行されるタスクや、リモートで制御可能なMCP(マルチモーダル・コントロール・プレーン)といった機能が利用可能になります。 これらの新機能は、AIエージェントを単なる対話インターフェースから、より複雑な業務を遂行できる実用的なツールへと進化させます。例えば、バックグラウンドタスク機能を使えば、ユーザーが直接操作していなくても、AIエージェントがデータ処理や定期的な更新などの作業を継続的に実行できるようになります。また、リモートMCP機能は、開発者や管理者が外部からエージェントの動作を監視・制御することを可能にし、運用管理の柔軟性と安全性を高めます。 これらの拡張機能により、開発者は、より複雑でミッションクリティカルなアプリケーションやサービスにAIエージェントを組み込むことが容易になり、本番環境での信頼性を高めたAIエージェントの開発が促進されると期待されます。(Google AI Blog)
出典: Google AI Blog

Gemini APIのマネージドエージェント機能拡充:バックグラウンドタスク、リモートMCPなどを追加
開発者が信頼性の高い、本番環境対応のエージェントを構築できるように、Gemini APIのマネージドエージェントに新機能を追加します。
出典: Google AI Blog

物語に誘惑される:半開テキストサンドボックスにおけるルール遵守の評価
LLM(大規模言語モデル)が半開テキストゲーム環境において自律的な裁定者としてますます展開されるにつれて、ユーザーの意図がシステムルールと衝突する際に、堅牢なルール遵守が不可欠になります。しかし、これらのモデルは「役立つ」かつ「従順」であるように訓練されているため、私たちが「レトリック注入」と呼ぶ攻撃クラスに対して脆弱になります。これは、敵対的なユーザーが偽論理的推論や権威主義的強制などの物語的フレームワーク技術を悪用して、裁定ロジックを回避するものです。私たちは、テーブルトークRPG(TRPG)のメカニクスに基づいたマルチエージェントの敵対的ベンチマークであるCoC-Seduceを提案します。これは、ルールが裁定のために明示的でありながら、インタラクションが完全に自然言語で行われる半開環境の理想的なインスタンスです。3つの最先端モデル、すなわちGPT-5.4、Claude Sonnet 4.6、Gemini 3.5 Flashを敵対的ジェネレーターとして使用し、4つの世界設定と16のスキルカテゴリにわたる5,376のサンプルを生成します。
出典: arXiv cs.CL

佃煮の日「クソダサポスター」ホントにAIに作れない? GeminiとChatGPTに挑戦させてみた結果
農林水産省の公式Xが6月29日に投稿した「佃煮の日」ポスターが、良い意味で“クソダサい”と話題になった。コメント欄には「AIには出せない温かみがあって好き」「AI使わないところがほんと良い」という声が目立ったという。……でも待ってほしい。今のAIなら、こういう雰囲気も作れるのでは?
出典: ITmedia NEWS 速報

GitHub Copilot、Gemini 2.5 ProおよびGemini 3 Flashの廃止を発表
GitHubは7月31日(現地時間)、従来はGitHub Copilotで利用可能だったAIモデル「Gemini 2.5 Pro」と「Gemini 3 Flash」の廃止を発表した。対象となるモデルは...
出典: CodeZine

【Gemini】Gemを活用して、爆速でGoogleスライドと台本を自動生成する方法
はじめに 初めまして、エンジニア2年目のなべと申します。 普段は、バックエンドエンジニアとして、システムの開発・運用保守を行っています。 今回は「GeminiのGemを活用して、短時間でGoogleスライドと台本を作成する方法」について説明していきます。 現状の課題 ...
出典: Qiita 人気記事

Google、6月に発表したAI関連の新機能をまとめて紹介
Googleは7月1日(現地時間)、6月に発表したAI関連製品およびサービスのアップデート情報をまとめて公開した。今回の発表では、Gemini 3.5や新モデルGemma 4 12B、Android ...
出典: CodeZine

GitHub Copilot、Gemini 2.5 Proと3 Flashのサポートを7月31日に終了へ
GitHubは7月2日(現地時間)、「GitHub Copilot」におけるGemini 2.5 ProおよびGemini 3 Flashモデルのサポートを7月31日で終了することを発表した。対象はC...
出典: CodeZine

腹立たしいGoogleのCM、建国の父たちがAIを受け入れる姿を描く
「グループプロジェクト、でも1776年風に。」新しいGoogle WorkspaceのCMはこの言葉から始まります。そして、そこからさらに気まずい展開に。この映像は、建国の父たちが独立宣言書を起草するためにGoogleのコラボレーションツールとGeminiに頼ったらどうなるかを想像したものです。
出典: The Verge AI

Gemini「あなたのこと、これだけ知ってます」新機能「パーソナルスナップショット」を発見
知りたいね、どれくらい知っているのかを。Geminiをより自分向けにカスタムできる「Personal Intelligence(パーソナル・インテリジェンス)」機能は活用していますか? こちらやこちらの記事にて、詳しく解説しています。このパ…
出典: GIZMODO Japan

「Google スライド」で複数スライドからなる編集可能なプレゼン全体を生成可能に(窓の杜)
米Googleは6月30日(現地時間)、「Google スライド」にGeminiで複数のスライドからなるプレゼンテーション全体を生成する機能を追加した。 本機能では、1つのプロンプトを入力するだ
出典: Yahoo!ニュース IT

とあるはてなーブックマークの解析(Claudeは個人評を避けたので、Geminiに調べてもらいました)
***のブックマーク - はてなブックマーク https://b.hatena.ne.jp/***/bookmark このはてなユーザーは親ロシア・反ウクライナ的でありますが、その理由が分かりません。これまでのブックマークから何か読み解けるものはないでしょうか?
出典: はてなブックマーク IT

最新AIエージェント機能16連発!徹底解説&コンソール画面で検証してみた
こんにちは! KDDIアイレットの取り組みとして6月22日〜7月3日の期間で開催中の「Google Cloud Next '26 / Google I/O やってみた系ブログリレー」、最終日の投稿です。 今回は「Gemini Enterprise Agent Platfor...
出典: Qiita 人気記事

ノーコードでスプレッドシートが“操作できるアプリ”に。Gemini の Sheet Canvas が想像以上だった
こんにちは! KDDIアイレットの取り組みとして6月22日〜7月3日の期間で開催中の「Google Cloud Next '26 / Google I/O やってみた系ブログリレー」、最終日の投稿です。 今回は「Google スプレッドシートの Sheet Canvas」を...
出典: Qiita 人気記事

安くて速い!米Google、新型画像・動画生成AIモデル2種類を提供開始(ビジネス+IT)
米Googleは2026年6月30日、高速かつ低コストな画像生成モデル「Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite)」と、対話型で動画編集が可能な
出典: Yahoo!ニュース IT

Gemini×Obsidianを最強コンビ!フル活用する方法 | ライフハッカー・ジャパン
私は、最近になって乗り換えたばかりの「Obsidian」ユーザーです。 新米ユーザーではありますが、すでにいろいろと考え抜いたフォルダの階層構造を構築し、ノート間の関係を視覚化する「グラフ」システムを拡張しています。
出典: はてなブックマーク IT

AIの会話に、心地いい「間」を。 ── Gemini Live APIでAI同士のポッドキャストを作った話
こんにちは! KDDIアイレットの取り組みとして6月22日〜7月3日の期間で開催中の「Google Cloud Next '26 / Google I/O やってみた系ブログリレー」、本日は10日目の投稿です。 今回は「Gemini Live API」での検証をお届けします...
出典: Qiita 人気記事

【2026年7月版】生成AI主要8サービス料金早見表 ── Claude Sonnet 5登場から気になるFable/Mythosの行方(BUSINESS INSIDER JAPAN)
各生成AIにおいて2026年6月は、新機能や新モデル登場など大きな動きがあった。 ChatGPTやClaudeは価格据え置きだが、グーグルのGeminiはエントリープランを値下げした。 2026年7月
出典: Yahoo!ニュース IT

【2026年7月版】生成AI主要8サービス料金早見表 ―― Claude Sonnet 5登場から気になるFable/Mythosの行方
各生成AIにおいて2026年6月は、Geminiのエントリープランが値下げ。各社のAI新モデルにも動きがありました。2026年7月1日時点における、生成AI主要8サービス料金早見表を見ていきましょう。
出典: Business Insider Japan

Google、「Nano Banana 2 Lite」を発表。「Gemini Omni Flash」も公開プレビュー(窓の杜)
米Googleは6月30日(現地時間)、画像生成AI「Nano Banana 2 Lite」を発表した。動画生成モデル「Gemini Omni Flash」に関しても、APIを通じた提供が開始される
出典: Yahoo!ニュース IT