TOPIC TIMELINE
タイムライン検索
特定トピックに関する記事を時系列で並べて「いつ・何が起きたか」を俯瞰します。
2025年12月11日
エージェントワークフローを用いた生物学実験のプロトコルエラー検出本記事は、2025年夏季インターンシッププログラムで勤務された秋葉凌羽さんによる寄稿です。 はじめに 東京科学大学生命理工学院学士課程3年の秋葉凌羽と申します。PFN の2025年夏インターンシッププログラムに参加し、実 […] 投稿 エージェントワークフローを用いた生物学実験のプロトコルエラー検出 は Preferred Networks Tech Blog に最初に表示されました。
Preferred Networks
2026年4月22日
Moonshot AI、「Kimi K2.6」を発表--多数のエージェントを連携可能中国のAI企業Moonshot AIは、新型会話型AI「Kimi K2.6」を発表した。今回のアップデートの最大の特徴は、複数のエージェント機能を同時に連携させられる点だ。 従来のAIシステムでは単一のエージェントが個別のタスクを処理していたが、K2.6では異なる役割を持つ複数のエージェントを組み合わせることで、より高度で複雑な業務に対応することが可能になった。これにより、データ分析から文書作成、プロジェクト管理など、多段階のプロセスが必要とされる作業をより効率的に実行できるようになる。 同社によれば、このマルチエージェント連携機能により、AIの汎用性が大幅に向上し、ビジネスや研究開発など様々な分野での応用範囲が拡がることが期待されている。 (引用元:Moonshot AI)
2026年5月12日
Co-Scientist:研究を加速させるマルチエージェントAIパートナーGeminiで構築された協調的AIパートナー「Co-Scientist」を紹介。研究者が科学的なブレークスルーを加速させるのを支援する。
Google DeepMind
2026年5月27日
Strands Agents、NVIDIA NIM、Amazon Bedrock AgentCoreを使用した高性能生成AIシステムの構築このポストでは、統合アーキテクチャを使用して、並列推論、コンテキスト永続性、追跡可能な実行パスを実証するマルチエージェントキャンペーンレビュー システムの構築方法を学ぶことができます。
AWS Machine Learning Blog
2026年5月27日
Amazon Bedrock AgentCoreを使用したAWS上の高度にスケーラブルなサーバーレスLangGraphマルチエージェントシステムの構築このポストでは、LangGraphエージェントをオーケストレーターとして統合し、Amazon Bedrock AgentCore Memoryと連携させて、AWS上に高度にスケーラブルでサーバーレスなマルチエージェント生成AI システムを構築するソリューションを提供しています。
AWS Machine Learning Blog
2026年5月29日
FormInv: 数学推論ベンチマークにおけるセマンティック不変性の測定プロトコルMathCheck(ICLR 2025)のパラフレーズ品質監査により、129グループ中4つのセマンティック的に不正確なパラフレーズ(3.1%)が検出されました。これらを削除するとGPT-4oはランク2からランク4に低下し、Claude HaikuとDeepSeek V3がそれを上回ります。これらのランク変動は単一モデル評価では見えません。
arXiv cs.LG
2026年5月29日
ディベートは弱い審査官がより強いモデルに報酬を与えるのに役立ちます理論的な約束にもかかわらず、スケーラブルな監視プロトコルとしてのディベートは混合した実証結果をもたらしています。いくつかの設定では利益を得ていますが、特に審査官が隠された情報を持たない場合は、他の設定では効果がありません。より強いディベーター・より弱い審査官の設定で提案者批評家ディベートを研究しました。
arXiv cs.CL
2026年5月29日
微分可能な信念ベースの対戦相手形成人間の協調は、戦略的行動を通じて他者の信念に影響を与える能力に依存している。マルチエージェント強化学習では、対戦相手形成がこの影響を複製しようとしているが、既存の方法は通常、対戦相手のパラメータ、ポリシー、または価値空間内で動作している。
arXiv cs.AI
2026年5月29日
StoryMI: 操作可能なマルチエージェント治療対話生成大規模言語モデル(LLM)は流暢な対話を生成できますが、先行研究は状況的な根拠付け、動的戦略制御、および動機面接(MI)の臨床基準に合致した評価が不足しています。我々はStoryMIを導入しました。これは制御可能なMI対話生成のための複数LLMエージェントフレームワークです。
arXiv cs.CL
2026年5月29日
エージェンティックAI、ネストされた学習、セマンティックキャッシングによるAI持続性を通じたハルシネーション軽減ハルシネーションは本番LLMシステムにおける主要な信頼性の障壁であり、特にマルチエージェントパイプラインでは根拠のない主張が段階を通じて伝播する可能性があります。本論文は、HOPE着想のネストされた学習アーキテクチャとコンティニュアムメモリシステム(CMS)を応用しています。
arXiv cs.AI
2026年5月29日
認知圏論トランスフォーマー:言語モデリングのための圏論的帰納的バイアス認知圏論トランスフォーマー(CCT)は3億600万パラメータのアーキテクチャで、事前学習されたGPT-2 Smallバックボーンを圏論から導出された認知的に根拠のあるコンポーネント、および認知科学からのいくつかのインスピレーションで拡張しています。マッチドステップ・プロトコル下(215,000最適化ステップ)で...
arXiv cs.AI
2026年6月1日
WHO、コンゴ民主共和国のエボラ出血熱流行を抑制するため地域社会の協力を呼びかけテドロス・アダノム・ゲブレイェスス事務局長がイトゥリ州での遺体処理プロトコルに対する抗議後に訴えかけ。エボラ出血熱の流行を抑制するため、地域社会の協力が求められている。
The Guardian World
2026年6月1日
状態拡張とコンセンサスを用いた分離可能ダイナミクスの拡張可能な制約付きマルチエージェント強化学習状態拡張ポリシー学習と双対変数の分散コンセンサスを組み合わせた制約付きマルチエージェント強化学習の分散アプローチを提示する。本手法は、エージェントが分離可能なダイナミクスを持つシステムを対象とし、グローバルリソース制約を満たすために調整する必要がある。
arXiv cs.LG
2026年6月1日
RAG対応のクロスモデル多数決ワークフローを使用したバイオメディカル関連性生成・検証におけるChatGPTの評価プロトコルarXiv:2605.30400v1 ChatGPTが疾患中心のバイオメディカル関連性を生成する能力を評価するためのプロトコルを提示する。バイオメディカルオントロジーを使用して関連性を生成し、生物学的エンティティを検証し、文献を使用して関連性を検証する方法を概説する。プロトコルには自己一貫性戦略が含まれる。
arXiv cs.CL
2026年6月1日
マルチエージェントLLM較正のための反事実グラフマルチエージェントLLMシステムはしばしば合意を証拠として扱い、パネル内の多くのエージェントが同じ答えを出した場合、その答えはより信頼性が高いと想定される。本研究は、エージェント間の通信後にこの仮定が失敗する可能性があることを示す。通信は相関した失敗と偽の合意を引き起こす可能性がある。
arXiv cs.CL
2026年6月1日
HADT: 自律型地球観測衛星クラスター向けの異種マルチエージェント差分トランスフォーマー本論文は、光学およびSAR衛星を含む地球観測ミッションを実施する異種衛星クラスターにおける自律的なリソース管理の問題に対処し、自動運用モードでは衛星に知的能力を備える。
arXiv cs.AI
2026年6月2日
AI政策と政治的活動に関する私たちの見解AI政策と政治的活動、透明性、思慮深い規制とAI安全性への支援、および外部の政治団体が企業に代わって発言していないという私たちのアプローチ。
OpenAI
2026年6月2日
コンゴ民主共和国の医療従事者がエボラ出血熱の治療と安全対策を実施コンゴ民主共和国の医療従事者がエボラ出血熱の患者治療に当たっており、感染防止に向けた安全対策を強化している。同国ではエボラ出血熱の感染事例が確認されており、医療現場での対応が急務となっている。医療従事者は個人防護具の装着や感染管理プロトコルの徹底により、患者の治療と自身の安全確保に取り組んでいるとのこと。国際社会からの支援も受けながら、感染拡大防止に努めている。
BBC News
2026年6月2日
MindGames Arena 一般化トラック:遅延段階ごと報酬帰属を用いたIn2AIソリューションマルチエージェント戦略的相互作用のための言語モデルエージェントの訓練には、中核的な困難が存在します。任意のアクションの質は、実現しなかった将来のイベント、ゲーム規則に違反する動き、または他のプレイヤーの決定に依存する可能性があります。標準的な強化学習はこれを想定していません。
arXiv cs.AI
2026年6月2日
マルチモデルAIシステムにおける創発的協調的熟慮:認識論的統合のためのBFT派生プロトコルビザンチン障害耐性由来のアーキテクチャである「Consilium Protocol」を提示します。このプロトコルは構造化されたマルチモデルAI熟慮を実現し、モデル間の不一致を誤りではなく認識論的信号として扱います。言語モデルに設計された認知的ペルソナを割り当てることで、モデルが何であるかを分離します。
arXiv cs.AI
2026年6月2日
思慮深い選別:マルチエージェント知識ベースのためのプロトコルAIエージェントが孤立したツールから共有知識エコシステムの協力的参加者へと移行する中、集団的知識の選別ガバナンスが重要な課題となっています。人間のプラットフォームガバナンスメカニズムは直接適用できません。エージェントの無ステート性は抑止力ベースの制裁を損なうため。
arXiv cs.AI
2026年6月4日
マルチエージェント推論におけるストリーミング通信マルチエージェント推論システムの効率化に向けた新しいアプローチが提案された。従来の方式では、推論を完了した後に結果を次のエージェントに転送していたため、システムの深さに応じて処理遅延が増加していた。 新手法「StreamMA」は、この課題に対し、各推論ステップを逐次的に後続エージェントへ送信する仕組みを導入。これにより、全プロセスの完了を待つことなく、段階的に情報を流通させることが可能となる。 注目される点は、推論の初期段階ほど信頼性が高いという特性を活用している点。信度の高い段階の情報のみを選別して利用することで、エラーの発生を抑制しながらシステム全体の精度向上を実現しているという。 この手法により、複数のエージェントが連携する推論システムにおいて、応答時間の短縮と信頼性の向上を両立させることが期待される。 (出典:arXiv cs.CL)
2026年6月4日
🚀 Antigravity 2.0 初心者向け10の鉄則 — Googleのマルチエージェント基盤を使いこなすはじめに Google I/O 2026で一番の衝撃は、新モデルではなく Antigravity 2.0 でした。AI搭載IDEだった1.0から、マルチエージェント・オーケストレーション基盤へと完全に生まれ変わったのです。 内部テストの数字は圧倒的です: 93体のエ...
Qiita 人気記事
2026年6月4日
ウェブサーバーを数秒以内にダウンさせる「HTTP/2 Bomb」攻撃がOpenAIのCodexを使って発見されるセキュリティ研究者がOpenAIの大規模言語モデル「Codex」を活用して、ウェブサーバーを数秒以内にダウンさせることができる「HTTP/2 Bomb」と呼ばれる新型攻撃手法を発見した。この攻撃は、HTTP/2プロトコルの仕様の脆弱性を悪用し、少量のデータで大規模な負荷を生成することが特徴とのこと。AI技術が攻撃検出に貢献する一方で、サイバー攻撃の開発にも利用される可能性が示唆されており、セキュリティ対策の重要性がより高まっている。
はてなブックマーク IT
2026年6月5日
アーサー・ヘイズ氏、HYPEとNEARを売却──AI企業のIPOラッシュを警戒(NADA NEWS)暗号資産(仮想通貨)取引所BitMEX(ビットメックス)の共同創設者であるArthur Hayes(アーサー・ヘイズ)氏は6月4日、ハイパーリキッド(HYPE)とニアプロトコル(NEAR)のトークン保
Yahoo!ニュース IT
2026年6月6日
家庭用PCでも数秒でサーバを“落とせる”、HTTP/2の脆弱性をCodexが発見 さくらインターネットも対策(ITmedia NEWS)セキュリティ企業Codexが、HTTP/2プロトコルに新たな脆弱性を発見しました。この脆弱性を悪用すると、家庭用パソコンからわずか数秒でサーバーをダウンさせることが可能だとのこと。さくらインターネットを含む国内企業も既に対策を講じ始めています。HTTP/2は広く使われているプロトコルであるため、この脆弱性は多くのウェブサービスに影響を及ぼす可能性があり、業界全体での迅速な対応が求められています。
Yahoo!ニュース IT
2026年6月8日
エージェントAI制御評価における攻撃選択は安全性を大幅に低下させるAI制御は、能力の高い信頼できないAIエージェントを、より弱い信頼できるモニターと限定的な人間監査予算の下で展開するための安全性フレームワークである。制御評価は、レッドチーム攻撃ポリシーをブルーチームモニターと対立させることでこれらのプロトコルをストレステストするが、現在の評価は通常、攻撃のタイミングを戦略的に選択しない攻撃者を想定している。本研究は、攻撃決定を攻撃開始時期を決定する開始ポリシーと進行中の攻撃を中止するかどうかを決定する停止ポリシーに分解することで、エージェント設定における攻撃選択能力を研究した。BashArenaとLinuxArenaの2つのエージェント設定において、両ポリシーは基礎となる攻撃能力を変えることなく、測定された経験的安全性を大幅に低下させた。監査予算1%の場合、開始ポリシーはBashArenaとLinuxArenaの両方で安全性を20ポイント削減し、停止ポリシーはBashArenaで20ポイント、LinuxArenaで28ポイント削減した。これらの削減は、攻撃選択の効果の上限として解釈されるべきである。
arXiv cs.AI
2026年6月8日
CAF-Gen:議論構造を充実させるためのマルチエージェントシステム自然言語テキストから複雑な推論を形式化することは、計算言語学における中心的な課題である。現在の議論マイニング技術は基本的な主張と前提を識別するが、前提のタイプ、証明基準、議論スキームなどの特徴を組み込むカーネアデス議論枠組み(CAF)といった高度なスキーマが必要とする豊かな構造情報を捉えるのに苦労している。本研究は、浅い議論構造をCAF準拠の議論モデルに充実させるために設計された自動マルチエージェントフレームワークCAF-Genを導入することでこの制限に対処している。反復的なクリエイター・レビュアーパイプラインを採用することで、クリエイターエージェントの出力は批評的エージェントによって検証され、構造的整合性が確保される。このマルチエージェント協働は、単一パス生成モデルに典型的な構造的不安定性を軽減するために重要である。実験結果は、反復的なフィードバックループが結果データの品質を向上させ、元のアノテーションとの強い一致を達成しながら、構造的により豊かなモデルを生成することを示している。
arXiv cs.CL
2026年6月9日
「NTLM」の廃止、「Kerberos」への移行は第2フェイズへ ~Microsoftが発表(窓の杜)マイクロソフトが古い認証プロトコル「NTLM」の廃止計画を発表し、より安全な「Kerberos」への移行を段階的に進めることを明らかにしました。第2フェイズでは、Windowsシステムにおける認証方式の大規模な転換が予定されています。この移行により、セキュリティ上の脆弱性が減少し、企業のシステムセキュリティが強化されると期待されています。同社は企業ユーザーに対し、段階的な準備を進めるよう推奨しています。
Yahoo!ニュース IT
2026年6月10日
データジャーナリストエージェント:データを検証可能なマルチモーダルな物語へ変換データジャーナリストエージェント「Data2Story」は、生のデータから非専門家が信頼できる物語を生成するマルチエージェントフレームワークです。 このシステムは、データの分析、視覚化、記事作成までを一貫して行い、仮想のニュースルームとして機能します。 すべての主張がデータ、コード、外部参照に根拠を持つ検証可能性と、読者のニーズに応じたマルチモーダルな記事生成が特徴です。
arXiv cs.CL