TOPIC TIMELINE
タイムライン検索
特定トピックに関する記事を時系列で並べて「いつ・何が起きたか」を俯瞰します。
2025年11月7日
デンマーク、15歳未満のSNS利用を禁止へデンマーク政府は、15歳未満の子供を対象に、ソーシャルメディアの利用を禁止する方針を固めました。この措置は、若年層の精神的な健康を守ることを主な目的としています。 近年、SNSの普及とともに、青少年の間での依存やいじめ、精神的な不調といった問題が深刻化しており、デンマーク政府は早期からの対策が必要だと判断しました。今回の禁止措置により、子供たちがSNSに触れる機会を制限し、心身の健やかな成長を促すことが期待されています。 具体的な禁止の施行時期や、年齢制限の実施方法、違反した場合の対応などについては、今後詳細が検討される見通しです。 Associated Press
Associated Press
2025年12月8日
Kubernetesスケジューラのベンチマークテスト本記事は、PFNのインターンシップを経て現在はアルバイトとして勤務されている上田蒼一朗さんによる寄稿です。 はじめに Preferred Networks(以下PFN)ではKubernetesを用いた機械学習基盤の開発・ […] 投稿 Kubernetesスケジューラのベンチマークテスト は Preferred Networks Tech Blog に最初に表示されました。
Preferred Networks
2026年1月16日
Listen Labs、バイラルな看板採用キャンペーンでAI顧客インタビューをスケールさせるために6,900万ドルを調達アルフレッド・ワールフォルスは選択肢がなくなってきていた。彼のスタートアップ Listen Labs は100人以上のエンジニアを雇う必要があったが、マーク・ザッカーバーグと競争していた。
VentureBeat AI
2026年2月20日
日本語の自然さを測る評価手法の検証Preferred Networksでは大規模言語モデル (LLM) PLaMoの開発を継続して行っています。 LLMを開発するにあたってその能力を評価するベンチマークは非常に重要です。英語においては様々なベンチマークが […] 投稿 日本語の自然さを測る評価手法の検証 は Preferred Networks Tech Blog に最初に表示されました。
Preferred Networks
2026年2月25日
コード生成ベンチマークのためのサンドボックス環境の開発はじめに Preferred Networksでは、大規模言語モデル「PLaMo」の開発を行っています。 PLaMoは開発サイクルにて様々なベンチマークによりその能力を評価していますが、今回はコード生成ベンチマークにてモ […] 投稿 コード生成ベンチマークのためのサンドボックス環境の開発 は Preferred Networks Tech Blog に最初に表示されました。
Preferred Networks
2026年5月15日
DatabricksがGPT-5.5をエンタープライズエージェントワークフローに導入DatabricksがOfficeQA Proベンチマークで最先端の成績を達成したGPT-5.5をエンタープライズエージェントワークフローに活用しています。
OpenAI
2026年5月15日
ベオグラード万博 開幕まであと1年 日本館ロゴ・シンボルマーク発表セルビアのベオグラードで2027年に開催される国際博覧会まで、開幕まであと1年となった。日本館の運営を担当する関係機関が、館のロゴとシンボルマークを新たに発表した。 発表されたデザインは、日本文化の創意性と遊び心を象徴するものとなっており、世界の来場者に日本の魅力を効果的に伝える意図が込められている。ベオグラード万博での日本館出展を通じて、日本の伝統と現代性を融合させた文化的価値観を国際的に発信することが目指されている。 今後、開幕に向けて展示内容の具体化が進められ、世界各国からの来訪者に向けたプログラムの企画も加速するものと考えられる。 (引用元:JETRO)
JETRO
2026年5月18日
pretrained model向けのベンチマークの構築Preferred Networks では、大規模言語モデル PLaMo の開発を継続して行っています。 LLM を開発するうえで、モデルの能力を適切に測定するベンチマークは重要です。英語ではさまざまなベンチマークが日々 […] 投稿 pretrained model向けのベンチマークの構築 は Preferred Networks Tech Blog に最初に表示されました。
Preferred Networks
2026年5月20日
移民街から子供を「強制隔離」デンマークの統合政策 独は学習プログラムに年2400億円「教師が対面で教えてくれることで『国が私を助けてくれる』という安心感があった。1つの教室に生徒が18人で窮屈だったが、1人で暮らす上で役立った」 2016年か…
産経新聞
2026年5月26日
中東情勢アップデート:レバノンの空爆と避難命令、ガザへの人道支援制限夜通しのイスラエル空爆の激化によってレバノンの人々は再び家を逃れるよう強いられ、一方ガザ地区の人道支援団体は囲い込み地域への人道支援配送の継続的な制限を報告していると、国連が火曜日に発表しました。
UN News
2026年5月27日
NVIDIA Vera CPUが競合製品に対して「強力なパンチを繰り出している」エージェンシャルAIへのシフトは、AIファクトリーの新しいCPU要件を生み出します:高速コア、膨大なメモリ帯域幅、およびすべてのコアがアクティブな場合でも高いパフォーマンスを維持する能力です。初期ベンチマークでは...
NVIDIA Blog
2026年5月27日
イランミサイルの可能性「高い」 貨物船攻撃で韓国外務省アラビア湾での貨物船攻撃について、韓国外務省はイランがミサイルを使用した可能性が高いと指摘しました。この事案は、米国とイランの対立構造やイスラエル・パレスチナ紛争の深刻化に伴うイラン傘下の民兵組織の活動活発化など、中東地域における構造的な緊張を反映しています。ホルムズ海峡を経由する世界の石油輸送量の約25~30%が影響を受ける可能性があり、韓国を含む先進国経済とエネルギー安全保障に直結する問題として注視されています。
時事通信
2026年5月28日
世界ニュース速報:レバノン暴力継続、イスラエルが国連事務総長との「関係断絶」、ハイチでの国内避難民、フランスの獄舎過剰収容への警告国連は、ベイルート南部と国内の南部地域に対するイスラエルの激化した空襲に続くレバノンにおける敵対行為の激化について深刻な懸念を表明しています。
UN News
2026年5月28日
イスラエルがレバノン首都を『標的攻撃』イスラエルがレバノンの首都ベイルートを直接攻撃し、中東紛争が新たな段階に入りました。これまで比較的守られていた首都への攻撃は、国家間の全面戦争に近づいたことを示しています。先月合意された停戦協定の綻びが背景にあり、イスラエルとイスラム武装勢力ヒズボラは互いに相手が約束を守っていないと非難し、協定は形骸化しつつあります。軍事的優位性を持つ側がさらなる強硬姿勢に出る一方、後ろ盾を持つ相手も簡単には屈しない状況が、この危険な悪循環を生み出しているのです。
BBC News
2026年5月28日
米イラン戦闘終結覚書、トランプ大統領の最終判断を待つ状態米国とイランの軍事的対峙を終わらせる覚書交渉が最終段階に入り、トランプ大統領の判断待ちとなっています。1979年の革命以降、両国は軍事衝突と外交的断絶を繰り返してきましたが、今回の交渉は過去数十年の対立構造の転換を示唆するものです。ただし覚書は国際条約より拘束力が低く、実効性には詳細な実行メカニズムが不可欠とされています。またイスラエルやサウジアラビアといった同盟国の懸念も大きく、米国外交の信頼性が問われる複雑な状況となっています。
時事通信
2026年5月29日
ガザ地区の病院が空爆で複数の死亡報告、イスラエルがハマス指導者を標的ガザ地区の病院が空爆による被害を報告しました。同病院によると、ハマスの司令官を標的とした空爆により複数の人命が失われたとのことです。 被害状況としては、少なくとも5人の子どもを含む複数の死傷者が確認されています。同病院は負傷者の治療にあたっており、被害の全容把握はまだ進行中とみられます。 イスラエル側は同作戦がハマス指導部を狙った軍事作戦であることを示唆しているとも報じられています。一方、ガザ地区ではこの空爆による民間人被害の責任を巡り、国際的な関心が集まっています。 今回の空爆は、ガザ地区での継続する紛争における新たな被害事例として、地域の人道状況をめぐる懸念をさらに深めています。 引用元:BBC News
BBC News
2026年5月29日
ガザシティの病院、空爆で複数の死亡を報告、イスラエルがハマス指導者を標的にハマスの司令官を標的にしたと思われる空爆により、少なくとも5人の子どもを含む複数の人員が殺害されたと報告されている。
BBC News
2026年5月29日
ウクライナ戦争から学んだHezbollahが光ファイバードローンを使ってイスラエルを攻撃光ファイバードローンは現在、Hezbollahがイスラエルの兵士と民間人に対する主要な兵器となっています。
BBC News
2026年5月29日
ウクライナ戦争から学ぶ、ヒズボラが光ファイバー無人機でイスラエルを攻撃ヒズボラがイスラエルへの攻撃手段として、光ファイバーケーブルで操作する無人機を運用していることが明らかになった。この技術は、ウクライナにおける最近の紛争から得られた知見を応用したものとされている。 光ファイバー接続型の無人機は、GPS信号の妨害を受けにくいという特性を持つ。従来の衛星測位システムに頼る無人機と異なり、より安定した遠隔操作が可能となる。ヒズボラはこうした利点を活かし、兵士と民間人の両方を標的とした攻撃を実行しているという。 中東地域における無人機戦術は急速に進化を遂行している。各勢力が国際紛争から得た軍事技術を自らの作戦に組み込む動きが加速しており、地域の安全保障環境が一層複雑化している可能性が指摘されている。 (BBC News)
BBC News
2026年5月29日
イスラエル、レバノン首都を「標的を絞った攻撃」で襲撃ベイルートはこれまでのところ大きな被害を免れていましたが、イスラエルとヒズボラは先月の停戦破りについて互いに非難してきました。
BBC News
2026年5月29日
Amazon Bedrock AgentCoreのデータセット管理でエージェントとともに成長するテストスイートを構築エージェント評価は、急速に変化するオンラインシグナルと安定したオフラインベースラインを組み合わせることで最も強力になります。エージェントが時間とともに本当に改善されているかどうかを理解するには、固定ベンチマークが必要です。
AWS Machine Learning Blog
2026年5月29日
新しい『60 Minutes』の責任者ニック・ビルトン氏、パラマウントのCBS Newsが視聴率低下前に番組をピボットするため採用したと述べるニック・ビルトン氏はニューヨーク・タイムズの元コラムニストであり、Netflixで複数のドキュメンタリーを制作しており、CBS Newsの編集最高責任者バリ・ワイス氏と協働した経歴がある。
CNBC Business
2026年5月29日
ネタニヤフ首相、IDF にガザの支配率を70%に増加させるよう指示と表明イスラエルのネタニヤフ首相は、国防軍に対してガザ地域の支配範囲を現在の水準から70%まで拡大するよう指示したと明らかにしました。 この方針転換は、2025年10月にイスラエルとハマスが合意した停戦条件と相反する内容となっています。停戦合意では、イスラエルの軍事作戦に一定の制限が設けられていたとみられていますが、今回の指示はその枠組みを逸脱する可能性があります。 ネタニヤフ首相がこうした指示を公表した背景には、国内の政治的圧力や安全保障上の考慮があるとみられます。ガザ地域の支配拡大により、イスラエルの軍事的優位性の確保を意図している可能性があります。 この発言は、停戦合意の実行可能性に対する懸念を高める可能性があり、中東の緊張状況にさらなる影響を与える可能性があります。 (BBC News)
BBC News
2026年5月29日
ネタニヤフ首相、IDF のガザ支配率を70%まで拡大するよう指示したと発表イスラエルによる支配拡大は、2025年10月にイスラエルとハマスが合意した停戦条件に矛盾することになります。
BBC News
2026年5月29日
チェーンが保たれる、答えが折れる:敵対的圧力下での推論モデルの軌跡と答えの乖離推論モデルはシングルターンベンチマークで評価されているが、ユーザーが正解に異議を唱えるマルチターン対話環境に配備されている。継続的な敵対的圧力下では、これまで文書化されていない障害モードが見つかった:思考の連鎖は最初のターンから最後まで事実上正確であるが、回答は変わる。
arXiv cs.AI
2026年5月29日
BEAMS: AI モデリング・シミュレーション評価ベンチマーク実世界の意思決定を支援するAIツールは、推奨事項を知らせ解釈可能にするシミュレーションモデルを構築できる必要があります。モデリング実務の側面を自動化できるツールは、人間の専門知識を補完する必要があり、置き換えるべきではありません。BEAMS Initiativeは、開発を指導することを目的としています。
arXiv cs.AI
2026年5月29日
検出可能効果の事前登録:4ビット量子化ベンチマーク用ペアリングMDEバジェット、パイロット監査付きこれはペアリングなしパイロット監査を伴う計画方法に関する注記である。古典的なペアリング二項サンプルサイズ計算(Miettinen, 1968)を量子化ベンチマークに適応させ、ペアリングされた最小検出可能効果(MDE)の保守的な下限を提供している。
arXiv cs.LG
2026年5月29日
FormInv: 数学推論ベンチマークにおけるセマンティック不変性の測定プロトコルMathCheck(ICLR 2025)のパラフレーズ品質監査により、129グループ中4つのセマンティック的に不正確なパラフレーズ(3.1%)が検出されました。これらを削除するとGPT-4oはランク2からランク4に低下し、Claude HaikuとDeepSeek V3がそれを上回ります。これらのランク変動は単一モデル評価では見えません。
arXiv cs.LG
2026年5月29日
ReverseMath: 数学問題生成の拡張可能性と検証可能性を実現する逆向き回答手法数学推論ベンチマークはLLMの評価に不可欠だが、多くは静的で公開評価やトレーニングパイプラインを通じて繰り返し露出しており、真の推論と暗記を区別することが困難である。一方、新しい数学問題の手動構築は...
arXiv cs.CL
2026年5月29日
BenchTrace:LLMエージェントの反省能力と制御された進化をテストするベンチマークarXiv:2605.29225v1 文書の発表。自己進化型エージェントは過去の失敗を反省することで時間とともに改善されますが、既存の評価には2つの制限があります。タスクスコアのみを測定して反省の質は不明であり、エージェント自身のエピソード実行に依存して特定の失敗パターンに対応するメカニズムがありません。本論文では新しいアプローチを提示しています。
arXiv cs.AI