TOPIC TIMELINE
タイムライン検索
特定トピックに関する記事を時系列で並べて「いつ・何が起きたか」を俯瞰します。
2025年11月7日
デンマーク、15歳未満のSNS利用を禁止へデンマーク政府は、15歳未満の子供を対象に、ソーシャルメディアの利用を禁止する方針を固めました。この措置は、若年層の精神的な健康を守ることを主な目的としています。 近年、SNSの普及とともに、青少年の間での依存やいじめ、精神的な不調といった問題が深刻化しており、デンマーク政府は早期からの対策が必要だと判断しました。今回の禁止措置により、子供たちがSNSに触れる機会を制限し、心身の健やかな成長を促すことが期待されています。 具体的な禁止の施行時期や、年齢制限の実施方法、違反した場合の対応などについては、今後詳細が検討される見通しです。 Associated Press
Associated Press
2025年12月8日
Kubernetesスケジューラのベンチマークテスト本記事は、PFNのインターンシップを経て現在はアルバイトとして勤務されている上田蒼一朗さんによる寄稿です。 はじめに Preferred Networks(以下PFN)ではKubernetesを用いた機械学習基盤の開発・ […] 投稿 Kubernetesスケジューラのベンチマークテスト は Preferred Networks Tech Blog に最初に表示されました。
Preferred Networks
2026年1月16日
Listen Labs、バイラルな看板採用キャンペーンでAI顧客インタビューをスケールさせるために6,900万ドルを調達アルフレッド・ワールフォルスは選択肢がなくなってきていた。彼のスタートアップ Listen Labs は100人以上のエンジニアを雇う必要があったが、マーク・ザッカーバーグと競争していた。
VentureBeat AI
2026年2月20日
日本語の自然さを測る評価手法の検証Preferred Networksでは大規模言語モデル (LLM) PLaMoの開発を継続して行っています。 LLMを開発するにあたってその能力を評価するベンチマークは非常に重要です。英語においては様々なベンチマークが […] 投稿 日本語の自然さを測る評価手法の検証 は Preferred Networks Tech Blog に最初に表示されました。
Preferred Networks
2026年2月25日
コード生成ベンチマークのためのサンドボックス環境の開発はじめに Preferred Networksでは、大規模言語モデル「PLaMo」の開発を行っています。 PLaMoは開発サイクルにて様々なベンチマークによりその能力を評価していますが、今回はコード生成ベンチマークにてモ […] 投稿 コード生成ベンチマークのためのサンドボックス環境の開発 は Preferred Networks Tech Blog に最初に表示されました。
Preferred Networks
2026年3月9日
データセクション、Stability AI初期メンバーのScott Trowbridge氏がCBOとして参画データセクションはStability AIの創業初期段階から携わったScott Trowbridge氏をChief Business Officer(最高事業責任者)として採用することを発表した。 Trowbridge氏はStability AIでの経験を活かし、データセクションのAIインフラ事業の拡大と強化を推進する役割を担う。同社は生成AI分野での競争が激化する中、ビジネス戦略の強化と事業規模の拡大を重点課題としており、今回の人事異動はその一環と位置づけられる。 AIインフラはデータやコンピュートリソース、モデル開発などの基盤技術を支える領域であり、急速に発展するAI業界において戦略的に重要な位置を占めている。Trowbridge氏の参画により、同社はこの分野での競争力強化を図るとみられる。 (引用元:Stability AI)
Stability AI
2026年5月15日
DatabricksがGPT-5.5をエンタープライズエージェントワークフローに導入DatabricksがOfficeQA Proベンチマークで最先端の成績を達成したGPT-5.5をエンタープライズエージェントワークフローに活用しています。
OpenAI
2026年5月15日
インドの小規模企業向けWhatsApp上のBusiness AIを導入WhatsApp Businessアプリに直接AI搭載カスタマーサポートを提供することで、小規模企業を支援するため、インドでBusiness AIをロールアウトしました。
Meta AI
2026年5月15日
ベオグラード万博 開幕まであと1年 日本館ロゴ・シンボルマーク発表セルビアのベオグラードで2027年に開催される国際博覧会まで、開幕まであと1年となった。日本館の運営を担当する関係機関が、館のロゴとシンボルマークを新たに発表した。 発表されたデザインは、日本文化の創意性と遊び心を象徴するものとなっており、世界の来場者に日本の魅力を効果的に伝える意図が込められている。ベオグラード万博での日本館出展を通じて、日本の伝統と現代性を融合させた文化的価値観を国際的に発信することが目指されている。 今後、開幕に向けて展示内容の具体化が進められ、世界各国からの来訪者に向けたプログラムの企画も加速するものと考えられる。 (引用元:JETRO)
JETRO
2026年5月18日
pretrained model向けのベンチマークの構築Preferred Networks では、大規模言語モデル PLaMo の開発を継続して行っています。 LLM を開発するうえで、モデルの能力を適切に測定するベンチマークは重要です。英語ではさまざまなベンチマークが日々 […] 投稿 pretrained model向けのベンチマークの構築 は Preferred Networks Tech Blog に最初に表示されました。
Preferred Networks
2026年5月20日
移民街から子供を「強制隔離」デンマークの統合政策 独は学習プログラムに年2400億円「教師が対面で教えてくれることで『国が私を助けてくれる』という安心感があった。1つの教室に生徒が18人で窮屈だったが、1人で暮らす上で役立った」 2016年か…
産経新聞
2026年5月22日
海外輸出検討事業者向け「中小企業海外ビジネス人材育成塾」対面セミナー開催国際機関がこのほど、中小企業の海外進出を推進するための人材育成プログラムを実施することを発表した。 対象は、輸出ビジネスの拡大を視野に入れている中堅・中小企業および起業家層。5日間にわたる集中研修の最終段階が、6月9日、11日、12日に実施される予定である。 プログラムでは、国際取引の基礎知識から実践的なビジネス展開まで、段階的に学習できるカリキュラムを用意。参加者は講義を通じて、海外市場分析やマーケティング戦略、契約交渉といった国際ビジネスに必要な知識を習得する。 最終日が公開形式で開催されることから、本格的な参加検討を控えている事業者も、講座内容を事前に確認できる利点がある。 グローバル化する市場環境において、人材育成を通じた中小企業の競争力強化が重要視されている中、このようなプログラムの充実は、日本企業の海外展開を後押しする施策として期待される。 (JETRO)
JETRO
2026年5月27日
NVIDIA Vera CPUが競合製品に対して「強力なパンチを繰り出している」エージェンシャルAIへのシフトは、AIファクトリーの新しいCPU要件を生み出します:高速コア、膨大なメモリ帯域幅、およびすべてのコアがアクティブな場合でも高いパフォーマンスを維持する能力です。初期ベンチマークでは...
NVIDIA Blog
2026年5月28日
「制御不能」なアメリカのチップ文化は海外に広がっているかアメリカのウェイターが20%未満のチップを受け取ることに不満を感じている中、チップは他の地域でも増加傾向にある。
BBC News
2026年5月28日
カンボジア名誉領事が3.7億円申告漏れ 現地事業の顧問料申告せず―仙台国税局カンボジアの名誉領事が現地事業の顧問料約3.7億円を申告せず、仙台国税局に指摘されました。この事案は、海外で得た収入について日本での申告義務を理解していなかったことが背景にあります。日本の税法では、居住者が世界中で得た所得すべてが課税対象となる制度が採用されていますが、この原則が十分に周知されていない実態が浮き彫りになりました。専門職や国際的に活動する人材向けの税務教育強化が課題となっています。
時事通信
2026年5月28日
ラグビー・ホンダ所属選手を逮捕 豪国籍、妻への傷害容疑―三重県警ホンダ所属のラグビー選手がオーストラリア国籍で、妻への傷害容疑で三重県警に逮捕されました。本事案は、プロスポーツ選手による家庭内暴力であり、日本のトップリーグに属する外国籍選手という複雑な属性を持つため、スポーツ界のガバナンス体制の不備が浮き彫りになっています。NBA やNFLなど海外の主要リーグでは家庭内暴力に対して出場停止や契約解除といった厳格な懲戒基準を設けているのに対し、日本のラグビー界ではこうした国際基準との乖離が指摘されています。本事案を通じて、企業スポーツチームの選手受け入れ時の身辺調査や倫理規範の整備といった予防的枠組みの必要性が課題として認識されることになるでしょう。
時事通信
2026年5月29日
栃木強盗殺人 海外逃亡の容疑者を公開手配へ栃木県で発生した強盗殺人事件の容疑者が海外に逃亡したため、警察が公開手配することになりました。容疑者は事件後に国外脱出したとみられ、現在の所在地は特定されていません。公開手配により、顔写真やSNSを通じて広く情報を拡散し、市民からの情報提供を求める方針です。ただし、国境を越えた追跡には相手国の法制度や国際条約など複雑な障壁があり、捜査が長期化する可能性があります。
NHK
2026年5月29日
パリがシリコンバレー以外の最も重要なAI都市である理由ヨーロッパのスタートアップエコシステムは大幅に成熟した。その起業家たちは、すぐに海外に目を向けるのではなく、国内で企業を拡大することに前向きになっている。
TechCrunch
2026年5月29日
Amazon Bedrock AgentCoreのデータセット管理でエージェントとともに成長するテストスイートを構築エージェント評価は、急速に変化するオンラインシグナルと安定したオフラインベースラインを組み合わせることで最も強力になります。エージェントが時間とともに本当に改善されているかどうかを理解するには、固定ベンチマークが必要です。
AWS Machine Learning Blog
2026年5月29日
パランティアは「最先端AI企業」なのか──海外で広がる“監視国家AI”への警戒 | 海外ニュース翻訳情報局パランティアは「最先端AI企業」なのか──海外で広がる“監視国家AI”への警戒 2026年3月5日、首相官邸、外務省は、高市総理がPalantir Technologiesのピーター・ティール共同創業者兼会長幹部と面会したことを公表した。
はてなブックマーク IT
2026年5月29日
強盗殺人容疑の指示役40代男を公開手配へ 事件後に出国―栃木女性殺害事件で県警栃木県の女性殺害事件で、強盗殺人容疑の指示役とされる40代男性が公開手配されることになりました。この男性は事件後に出国したとみられています。県警は市民からの通報情報を活用する「公開的捜査」へ転換することで、従来の静的な捜査の限界を補おうとしています。組織的犯罪における指示役の海外逃亡は、犯罪の国際化・階層化を示す警告信号であり、国内の治安網が直面する新たな課題を浮き彫りにしています。
時事通信
2026年5月29日
自衛官、NSATU派遣へ ウクライナ支援―防衛省防衛省は自衛官をウクライナ支援のためNSATU(北大西洋安全保障技術研修センター)に派遣する方針を決定しました。これまで海外派遣に慎重だった日本が、ウクライナ紛争の長期化に伴い人材育成支援に踏み切る転換点となります。自衛隊の訓練体系と防衛知見をウクライナの防衛能力強化に活かす判断である一方、ロシア側の反発や派遣自衛官の安全、憲法解釈論争など複数のリスクを内包しています。この決定は、民主主義陣営結束の強化を目指す日本の国際的ポジショニングの変化を反映しています。
時事通信
2026年5月29日
チェーンが保たれる、答えが折れる:敵対的圧力下での推論モデルの軌跡と答えの乖離推論モデルはシングルターンベンチマークで評価されているが、ユーザーが正解に異議を唱えるマルチターン対話環境に配備されている。継続的な敵対的圧力下では、これまで文書化されていない障害モードが見つかった:思考の連鎖は最初のターンから最後まで事実上正確であるが、回答は変わる。
arXiv cs.AI
2026年5月29日
BEAMS: AI モデリング・シミュレーション評価ベンチマーク実世界の意思決定を支援するAIツールは、推奨事項を知らせ解釈可能にするシミュレーションモデルを構築できる必要があります。モデリング実務の側面を自動化できるツールは、人間の専門知識を補完する必要があり、置き換えるべきではありません。BEAMS Initiativeは、開発を指導することを目的としています。
arXiv cs.AI
2026年5月29日
検出可能効果の事前登録:4ビット量子化ベンチマーク用ペアリングMDEバジェット、パイロット監査付きこれはペアリングなしパイロット監査を伴う計画方法に関する注記である。古典的なペアリング二項サンプルサイズ計算(Miettinen, 1968)を量子化ベンチマークに適応させ、ペアリングされた最小検出可能効果(MDE)の保守的な下限を提供している。
arXiv cs.LG
2026年5月29日
FormInv: 数学推論ベンチマークにおけるセマンティック不変性の測定プロトコルMathCheck(ICLR 2025)のパラフレーズ品質監査により、129グループ中4つのセマンティック的に不正確なパラフレーズ(3.1%)が検出されました。これらを削除するとGPT-4oはランク2からランク4に低下し、Claude HaikuとDeepSeek V3がそれを上回ります。これらのランク変動は単一モデル評価では見えません。
arXiv cs.LG
2026年5月29日
ReverseMath: 数学問題生成の拡張可能性と検証可能性を実現する逆向き回答手法数学推論ベンチマークはLLMの評価に不可欠だが、多くは静的で公開評価やトレーニングパイプラインを通じて繰り返し露出しており、真の推論と暗記を区別することが困難である。一方、新しい数学問題の手動構築は...
arXiv cs.CL
2026年5月29日
BenchTrace:LLMエージェントの反省能力と制御された進化をテストするベンチマークarXiv:2605.29225v1 文書の発表。自己進化型エージェントは過去の失敗を反省することで時間とともに改善されますが、既存の評価には2つの制限があります。タスクスコアのみを測定して反省の質は不明であり、エージェント自身のエピソード実行に依存して特定の失敗パターンに対応するメカニズムがありません。本論文では新しいアプローチを提示しています。
arXiv cs.AI
2026年5月29日
GTA:スケーラブルなWebエージェント用ロングホライズンタスク生成arXiv:2605.29218v1 文書の発表。言語モデルをブラウジングおよびツール使用機能と組み合わせたWebエージェントは、オープンなWebアシスタントとしての可能性を示していますが、スケーラブルなプロセスレベルの監督の不足により進展が制限されています。既存のベンチマークは主に手動で構築されており、粗い開始ゴール注釈のみを提供しています。
arXiv cs.AI
2026年5月29日
多言語LLMタスク実行における言語役割の分離多言語LLMは、指示、ソースコンテンツ、および必要な応答言語が一致しない場合にますます使用されています。既存のベンチマークは多言語命令追従評価を拡張していますが、完全にクロスされた設計内でこれら3つの役割を分離することはめったにありません。MTM-Benchを導入します。
arXiv cs.CL