TOPIC TIMELINE
タイムライン検索
特定トピックに関する記事を時系列で並べて「いつ・何が起きたか」を俯瞰します。
2026年1月13日
Salesforceが職場AI戦争でMicrosoftとGoogleに対抗する新しいSlackbot AIエージェントをロールアウトSalesforceは火曜日に完全に再構築された同社の職場アシスタント Slackbot の新バージョンをローンチし、単純な通知ツールから変革した。
VentureBeat AI
2026年5月26日
xAIがコーディングエージェント「Grok Build」ベータ公開。サブエージェントを並列に実行可能などイーロン・マスク氏が設立したAI企業のxAIが、コーディングに特化したAIエージェント「Grok Build」早期ベータ版を公開しました。 Grok Buildはプロフェッショナルなソフトウェアエンジニアリングおよび複雑なコーディングに対応...
Publickey
2026年5月28日
データ過負荷から実行可能な洞察へ:ベライゾン・コネクトがエージェントAIを100,000ユーザーにスケールこの投稿では、ベライゾン・コネクトがエージェントAIソリューションを構築・スケールして、日々100,000ユーザーの圧倒的なフリートデータを明確で実行可能な洞察に変換した方法を紹介します。プロセスについて説明します。
AWS Machine Learning Blog
2026年5月29日
ネタニヤフ首相、IDF にガザの支配率を70%に増加させるよう指示と表明イスラエルのネタニヤフ首相は、国防軍に対してガザ地域の支配範囲を現在の水準から70%まで拡大するよう指示したと明らかにしました。 この方針転換は、2025年10月にイスラエルとハマスが合意した停戦条件と相反する内容となっています。停戦合意では、イスラエルの軍事作戦に一定の制限が設けられていたとみられていますが、今回の指示はその枠組みを逸脱する可能性があります。 ネタニヤフ首相がこうした指示を公表した背景には、国内の政治的圧力や安全保障上の考慮があるとみられます。ガザ地域の支配拡大により、イスラエルの軍事的優位性の確保を意図している可能性があります。 この発言は、停戦合意の実行可能性に対する懸念を高める可能性があり、中東の緊張状況にさらなる影響を与える可能性があります。 (BBC News)
BBC News
2026年5月29日
強化学習ベースの産業用ディスパッチングにおけるシミュレーション・ツー・リアル・ギャップの解決(実行セマンティクスを通じて)イベント駆動型スケジューリング・ポリシーは産業環境で導入されており、非同期で部分的に観測されたシステム状態下で決定が行われます。その結果、決定状態は時間的一貫性を欠き、アクション実行可能性が明示的に定義されず、実行の由来に関する問題が生じます。
arXiv cs.AI
2026年5月29日
台風6号 来週に沖縄・奄美接近か 九州~関東甲信も大雨おそれ台風6号が来週に沖縄・奄美地域に接近する見込みとなっています。沖縄・奄美では猛烈な暴風が予想される一方、九州から関東甲信地域では台風接近前から段階的な大雨が見込まれています。地域によって気象悪化のタイミングが異なるため、沖縄・奄美は短時間での急激な悪化に備える必要がある一方で、本州側は準備期間を活用しながらも対応遅延に注意が必要です。気象庁の予測精度に一定の不確実性があるため、自治体や企業は現時点で実行可能な避難施設確保や人員配置などの対策を優先的に進めることが重要です。
NHK
2026年6月1日
COLLEAGUE.SKILL: 専門知識蒸留による自動化されたAIスキル生成LLMエージェントは孤立したタスク完了だけでなく、人間の専門知識、判断、対話スタイルの限定的な表現を保持することが期待されています。人や役割に関連する実行可能な知識は通常埋め込まれているため、このような人物中心のエージェントの構築は困難です。
arXiv cs.AI
2026年6月1日
NVIDIAがRTX PCsとDGX SparkでローカルAIエージェント機能を強化NVIDIAがローカルAIエージェント機能を強化する新展開を発表した。RTX PCsとDGX Sparkプラットフォームで、エッジデバイス上での実行を想定したAIエージェント機能を拡張する取り組みだ。 OpenClawやHermesといったオープンソースプロジェクトが急速に採用されており、開発者コミュニティから高い関心を集めている。これらのエージェントはクラウドに依存せず、ローカル環境でアプリケーション操作やコンテンツ生成、プロセス自動化、複数ステップのタスク管理を実行可能な点が特徴だ。 ローカル実行により、データプライバシーの向上やレイテンシの削減、インターネット接続への依存軽減といった利点が期待される。NVIDIAのプラットフォームを通じた提供により、より多くの開発者が高度なAI機能を自身のハードウェア環境で活用しやすくなる見通しだ。 (引用元:NVIDIA Blog)
NVIDIA Blog
2026年6月2日
ProtStructQA:タンパク質構造推論における表示閾値タンパク質言語システムはしばしば、もっともらしい生物学的テキストを生成するかどうかで評価されていますが、構造的な質問はより鋭い意味論を持ちます:3次元座標系における測定を表示します。タンパク質構造質問応答のための実行可能なベンチマークProtStructQAを導入しました。
arXiv cs.CL
2026年6月2日
論文: 決定エンジンにおけるソルバー後のロバスト性:実行可能領域と摂動下での平滑性arXiv:2606.00002v1 発表タイプ:新規 要約:混合整数線形計画法(MILP)決定エンジンは、高リスク産業システムの公称最適計画を定期的に出力します。しかし実展開はソルバー時間の仮定と一致することはめったにありません。コスト、需要、またはリソース利用可能性の小さな摂動により、実行可能性が無効になるか、不連続性を引き起こす可能性があります。
arXiv cs.AI
2026年6月2日
大規模言語モデルにおけるインタラクティブ推論の評価:実行可能なゲームを用いた階層的ベンチマーク推論を能動的な証拠収集と信念更新として扱うマルチターン対話型推論評価フレームワークを紹介します。LLMはタスクルールのみを受け取り、隠れた環境への的を絞ったクエリを発行し、時間とともに部分的な観察を統合し、推論を停止する時期を決定する必要があります。
arXiv cs.AI
2026年6月3日
Single file Gleam BEAM programs with escript | Gleam programming languageGleam プログラミング言語が、単一ファイルで実行可能な escript 形式のサポートを実現しました。これにより、開発者は複数ファイルを分割せず、1つのファイルで BEAM 仮想機上で動作する実行可能なプログラムを作成できるようになります。この機能は、スクリプトやツール開発の効率化につながり、Gleam の利便性が向上することになります。
はてなブックマーク IT
2026年6月4日
Googleが新しいオープンソース「Gemma 4 12B」をリリース、音声と映像を分析でき16GBノートパソコンで完全にローカル実行可能Googleは新たなオープンソースAIモデル「Gemma 4 12B」をリリースしました。約120億のパラメータを備え、Apache 2.0ライセンスの下で公開される同モデルは、16GBのメモリを搭載した一般的なノートパソコンでの完全なローカル実行が可能です。 従来のマルチモーダルAIとは異なり、エンコーダレスのUnified アーキテクチャを採用することで、音声と映像データを言語モデルの基盤に直接入力できる仕様となっています。この設計により、データ変換に伴うオーバーヘッドを大幅に削減しながら、複数の形式のコンテンツ分析を実現します。 HuggingFaceやKaggleを通じて無料でダウンロード可能であり、企業から個人開発者まで幅広いユーザーが活用できます。手軽にアクセス可能な高性能AIの提供により、エッジデバイスやオンプレミス環境でのAI導入がより身近になると考えられます。 (VentureBeat AI)
VentureBeat AI
2026年6月5日
脱炭素の灯を消すな# 脱炭素化への継続的な取り組みが必要 気候変動対策の継続性が改めて議論の対象となっている。世界的な環境問題への対応が求められる中、脱炭素化に向けた政策推進の重要性が指摘されている。 エネルギー産業の転換や再生可能エネルギーの導入拡大など、構造的な変化を伴う取り組みには時間を要する。こうした長期的な視点に立つことの必要性が強調されている。各国の経済状況や産業構造は異なるものの、気候変動という共通課題への対応は不可欠との見方が広がっている。 一方、脱炭素化の推進にあたっては、経済成長とのバランスや産業競争力の維持といった課題も存在する。これらの課題に対して、継続的な政策支援と技術開発が求められているという指摘もある。 今後、国内外を問わず脱炭素化への取り組みが加速することが予想される中、長期的で実行可能な環境政策の構築が焦点となりそうだ。 (日本経済新聞)
日本経済新聞
2026年6月9日
もう面倒じゃない。「ショートカット」をAIが作ってくれるようになります #WWDC26iPhoneの「ショートカット」使ってますか?ボタンのワンタップなどで実行可能なオリジナルのアクションを設定できる機能で、たとえば……などなど、使いこなすとタスクを爆速で終わらせられる、超強力なやつです。ただ、難点が。設定がめんどい…。まる…
GIZMODO Japan
2026年6月10日
Cohereが単一のH100で動作するコーディングエージェントをオープンソース化Cohereは、単一のH100で実行可能なオープンソースのコーディングエージェント「North Mini Code」を発表しました。 この300億パラメータのモデルは、サブエージェントのオーケストレーション、アーキテクチャマッピング、コードレビューなど、エージェントソフトウェアエンジニアリングを対象としています。 256,000トークンのコンテキストウィンドウと64,000トークンの最大生成長をサポートし、Apache 2.0ライセンスでHugging Faceで利用可能です。
VentureBeat AI
2026年6月10日
ビジネスワールドモデルarXiv:2606.10044v1 新規発表 概要:企業は生産性向上、コスト削減、製品・サービスの強化のため、AI搭載ツールの導入を拡大しています。しかし、AIの変革の可能性は、事前に定義されたタスクの自動化を超え、知能システムが高レベルの戦略的目標からビジネスイニシアチブを計画、最適化、実行できるようにすることにあります。本稿では、ビジネスおよび組織環境に特化したワールドモデルであるビジネスワールドモデル(BWM)の概念とアーキテクチャを紹介します。AI、認知科学、制御理論におけるワールドモデルに着想を得たBWMは、ビジネスの状態、ダイナミクス、制約、目標、および実行可能なアクション空間をエンコードし、自律的な意思決定をサポートします。ビジネスの状態、ダイナミクス、アクションが主要なビジネスエンティティにリンクされた、ビジネスセマンティクス中心の定式化を提案します。このフレームワーク内で、エージェントは代替アクションシーケンスをシミュレートし、将来のビジネス成果への影響を推定し、不確実性下でのトレードオフを評価できます。
arXiv cs.AI
2026年6月11日
いつ尋ねるかを知る:階層型言語エージェントのための自己ゲート型明確化arXiv:2606.11349v1 発表タイプ:新規 概要:階層的推論では、エージェントが重要な情報が不足していることを認識せずに誤った分岐にコミットしてしまう中間決定点で障害が発生することがよくあります。明確化を外部の不確実性トリガーとして扱うのではなく、ACTION-RATINGという、ナビゲーションと同じ共有順序尺度でエージェントのアクションスペース内に明確化を配置する定式化を提案します。これにより、各決定点で尋ねることが行動と直接競合し、ヘルプの要求が中間状態で観察可能になります。エージェント自身の評価から、強制的な(実行可能な分岐がない)モードと機会的な(有力な候補があるにもかかわらず残存する不確実性)という2つの構造的に異なる情報探索モードが出現します。
arXiv cs.AI
2026年6月16日
Dr-DCI: ダイナミックなワークスペース拡張による直接コーパスインタラクションのスケーリング大規模コーパスでのエージェント検索は、スケーラブルな候補発見のためにリトリーバーを介したインターフェース(例:BM25またはColBERT)に依存しています。これらのインターフェースは関連文書を効果的にランキングしますが、証拠をランキング結果または制限された文書ビューとしてのみ提示するため、エージェントが素材を再編成したり、文書間の制約を検証したりする能力を制限します。直接コーパスインタラクション(DCI)は、柔軟な検索、フィルタリング、比較、検証のためのシェル実行可能なコーパス操作を公開することで、この制限に対処します。しかし、コーパスが成長するにつれて、フルコーパスのターミナルコマンドは遅くなり、不安定になるため、パフォーマンスと効率が低下します。本研究では、リトリーバー誘導型DCIフレームワークであるDR-DCIを提案します。これは、検索をローカルワークスペースを拡張するためのエージェント呼び出し可能なアクションとして扱います。エージェントは、フルコーパスを直接操作するのではなく、関連文書を動的に進化するワークスペースにプルし、その中でDCI操作を実行します。
arXiv cs.AI
2026年6月17日
ホルムズ海峡は迂回可能か? 過去の事例では商業的実行可能性がなかったとアナリスト火曜日、エビアン・レ・バンで開催されたG7サミットの首脳たちは、ホルムズ海峡を迂回する代替ルートの特定を模索していた。ドナルド・トランプ米国大統領は、金曜日には「完全に開かれる」と述べていた。
France 24
2026年6月17日
ガーナ、国連決議採択後初の主要会合で「補償的正義」を推進3日間にわたるアクラでの主要会合で、80カ国以上の国家元首や参加者が和解と restitution(弁済)に向けた実行可能な約束を追求する。ガーナは、奴隷化されたアフリカ人の奴隷貿易を人類に対する最悪の犯罪と宣言する画期的な国連(UN)決議の採択を受け、大陸の「補償的正義」への推進を前進させるための会議を主催している。
The Guardian World
2026年6月17日
ホンダ・シビックに任意のコードを実行可能な脆弱性「EvilValet」が見つかるホンダ車は、オーディオシステムやナビを内蔵した車載のヘッドユニットをUSB経由でアップデートすることが可能です。しかし、ここに任意のコードを実行可能な脆弱性があることを、技術専門家のエリック・マクドナルド氏が指摘しています。
はてなブックマーク IT
2026年6月18日
TRIDENT:証明可能な安全なマルチエージェント強化学習のためのハイブリッド・セーフティ・フィジックス結合の打破ネットワーク化されたサイバーフィジカルシステムにおける安全な協調は、学習アルゴリズムにハイブリッドな離散・連続アクション、厳格な学習時間安全制約、物理法則に支配されたダイナミクスを同時に処理することを強制します。これら3つの特徴が、既製のモジュールの単純な組み合わせを無効にするバイアスの有向サイクルを形成することを示し、これを3者結合補題として形式化します。次に、3つのコンポーネントが互いの漏洩を相殺するように共同設計された初のMARLフレームワークであるTRIDENTを導入します。具体的には、Gumbel-SoftmaxバイアスをO(tau)からO(tau^2)に低減するRichardson-Romberg勾配補正、反復ごとの実行可能性を強制するLyapunov制約付き逐次信頼領域更新、報酬ではなく価値を分解する物理情報付き残余クリティックです。制約付きナッシュ均衡へのO~(1/sqrt(K))収束率と、累積違反に対するO(sqrt(K))バウンドを証明します。
arXiv cs.LG
2026年6月19日
LLMエージェントにおける明確化要求のための不確実性分解最近の論文では、対話型大規模言語モデル(LLM)エージェントには、古典的な偶然的/認識的(aleatoric/epistemic)不確実性フレームワークが不十分であり、プロアクティブな明確化要求や共有メンタルモデル構築といった新たなエージェント機能を引き出すための、仕様不備を認識し、分解可能で、伝達可能な不確実性表現が必要だと主張しています。実用的なデプロイメントの制約(ブラックボックスAPI、対話レイテンシ予算、ラベル付き軌跡の欠如)は、ログ確率ベース、マルチサンプリング、トレーニングベースの方法を排除し、デプロイメント時にこれらのシグナルを提示するための最も実行可能な手法としてプロンプトベースの推定を残します。我々は、タスク仕様が曖昧な場合にエージェントが明確化を求めることを可能にする、アクションの信頼度と要求の不確実性(u)を分離する、シンプルなプロンプトベースの分解でこの要求に応えます。
arXiv cs.AI
2026年6月23日
AlphaMemo:自己進化型アルファマイニングエージェントのための構造化検索プロセスメモリLLMエージェントは、金融の事前知識、記号的推論、実行可能なファクター生成、フィードバック駆動の洗練を組み合わせることで、アルファマイニングに有望です。しかし、それらは組み合わせ爆発の探索空間、ノイズが多く非定常なフィードバック、冗長な発見、過去の成功を安易に再利用することによる過学習のリスクに直面しています。これらの課題に対処するため、構造化検索プロセスメモリを備えた自己進化型アルファマイニングエージェントであるAlphaMemoを提案します。AlphaMemoは、最終的なファクターや完全な軌跡のみを記憶するのではなく、特定の親ファクターのコンテキストでどの編集モチーフが機能するか、または失敗するかについての再利用可能な証拠を記録します。Abstract Syntax Tree(AST)の違いからモチーフを抽出し、探索台帳の事前知識の上に信頼度ゲート付き残差メモリを適用し、非対称の拒否制御を使用して高信頼度の失敗パターンを抑制します。
arXiv cs.AI
2026年6月24日
ニューロシンボリック・ドライブ:運転VLAのためのルール根拠に基づく忠実な推論連鎖思考(CoT)推論を組み込んだ運転VLAモデルは、事前学習済みのVLM表現を活用し、中間的な決定を自然言語で提示するため魅力的ですが、現在の根拠は、計画された動作と因果的に関連付けられるステップバイステップの決定セマンティクスを欠いていることがよくあります。本稿では、古典的なルールベースプランナーから直接抽出されたルール根拠に基づく推論トレースで運転VLAを監視するニューロシンボリック運転フレームワーク「Neuro-Symbolic Drive」を提案します。我々の重要な発見は、ルールベースプランナーがすでに実行可能な推論エンジンとして機能するシンボリックAIシステムであるということです。それらはアクティブな安全制約について推論し、候補となる操作を探索し、最終的な軌道を選択します。我々は、シミュレーションでこれらのプランナーを計測し、実行された軌道と各ルール評価ステップでの内部決定トレースの両方をキャプチャします。各トレースは構造化されたルール根拠に基づく推論にシリアライズされ、軌道とペアになってQwen3.5-4Bを運転VLAとしてファインチューニングします。
arXiv cs.AI
2026年6月24日
EXPO-SQL:実行ベースの節レベルポリシー最適化によるテキスト・トゥ・SQLテキスト・トゥ・SQLは、自然言語でデータベースをクエリできるようにし、実行可能なSQLクエリを生成します。最近の手法では、学習のために実行フィードバックを活用するために、大規模言語モデルベースの強化学習(RL)がますます採用されています。しかし、既存のRL手法は、SQLクエリのすべての節に均一なクエリレベルの報酬を割り当て、正しい節と間違った節を同等に扱います。この粗い粒度の報酬設計は、正しいSQL生成のための不十分な学習シグナルにつながります。この問題に対処するため、節レベルの報酬を通じてきめ細かな監視を提供するEXPO-SQL(EXecution-based clause-level Policy Optimization for Text-to-SQL)を提案します。節レベルの報酬を割り当てるために、この手法は、エラーメッセージや節ごとの増分実行を含む実行結果を分析することで、誤った節を特定します。
arXiv cs.CL
2026年6月25日
NotebookLMで要件定義が楽になった話 ― 仕様駆動開発(SDD)の前段を整える - WHITEPLUS TechBlogこんにちは、ホワイトプラス コアシス開発グループのfjtです! 以前仕様駆動開発(SDD)を実際のプロジェクトで試してみたという記事を書きました。AIが実行可能なレベルまで構造化した仕様書を先に作り、それに基づいて実装を任せるという開発手法の話です。
はてなブックマーク IT
2026年6月25日
シャープレイ値を超える:非対称シャープレイ値の効率的な計算本研究では、特徴量寄与度推定法を用いた機械学習モデルの解釈可能性の問題に取り組みます。特に、因果グラフを利用してモデルに依存しない説明に因果知識を組み込むことを可能にする、非対称シャープレイ値(ASV)として知られるシャープレイ値の派生形を検討します。SHAPの計算が#P困難な特定の文脈において、ASVの正確な計算が多項式時間で可能であることを示します。このアルゴリズム的結果を拡張するため、根本的な因果グラフのトポロジカル順序における同値類の概念を導入し、ASVの計算時間を短縮するのに役立ちます。特に、因果グラフが根付き有向木である場合に、それ(同値類)を計算する多項式時間アルゴリズムを提示します。最後に、任意の因果DAGにおけるASVを近似するためのアルゴリズムを開発します。これは、トポロジカル順序を一様にランダムにサンプリングする手順に依存します。このサンプリングメカニズムを実装するために、既知のアルゴリズムとより単純な代替手段を活用します。実験結果は、現実的な因果構造における提案手法の実用的な実行可能性を示しています。
arXiv cs.AI
2026年6月26日
Amazon Bedrock搭載AIエージェントで自己サービス型のAWSヘルス分析を構築し、実行可能なヘルスインサイトを発見する本投稿では、Model Context Protocol (MCP) を介して公開されるAIエージェントを使用して、自己サービス型のヘルスイベント分析を提供するオープンソースソリューション、Chaplin (Customer Health and Planned Lifecycle Intelligence Nexus) の構築方法を説明します。
AWS Machine Learning Blog