#AIAgent
136 件
- 🔍 AgentTracerが間接プロンプト注入の攻撃列を意図のずれから追跡する 2026-10-09
- 🔍 理解監査は、AI研究の担当者が中身を説明できるかを開発継続の条件にする提案 2026-10-09
- 🪶 Claude Haiku 5.5の仕様、価格、サブエージェントへの置き方 2026-10-08
- 🖥️ Cua Spacesの構造とデータから読む、エージェント用デスクトップの導入と運用 2026-10-08
- ⚖️ 暴走エージェントの巨額損害は、誰のどの科目に着地するか 2026-10-07
- 🤖 源内で職員が作ったものを数えるとき発注側が見る5段 2026-10-07
- 🧩 複合AIの本番障害150件から見る境界ごとの失敗分類 2026-10-06
- 🧭 GitHubが整理した開発者の中心技能。指示、レビュー、技術判断 2026-10-06
- 🧪 GTDDは実装を固定したあと追加テストでコーディングエージェントを検査する 2026-10-06
- 📦 ThinkingBoxは業務完了を終端のデータベース状態で判定する 2026-10-06
- 🧪 WebUIProofは生成画面を見た目だけでなく操作後の挙動で採点する 2026-10-06
- 🏦 みずほのCoworkは、約3万人の机上作業をどこまで渡す話か 2026-10-05
- 🧭 スキルとサブエージェントの置き場所を4つの点検で決める 2026-10-04
- 🧭 CONTRAは仕様の空白を埋める問いと黙って決めた挙動を分ける 2026-10-03
- 🔒 Guarded Commitsは不可逆な外部操作の承認をコミット条件にする 2026-10-03
- 🏢 HENNGE AIの取締役2人とエージェントが担う実務の境界 2026-10-03
- 🧭 GPT-6ファミリーの実務ガイドに書かれたモデル・推論努力・指示の分け方 2026-10-03
- 🛰️ T3 Codeで手元のコーディングエージェントを複数端末から操る仕組み 2026-10-03
- 🧭 OpenAI dotsを不在中に任せるときの目標と停止と対外操作と課金 2026-10-01
- 🧭 37signalsの手書き停止を、完了定義の4欄へ翻訳する 2026-10-01
- 🧰 Strands harnessの構成とモデルを替えても残る境界 2026-09-29
- 🎙️ ElevenLabsの音声合成Eleven v4のAPI構造と品質版・低遅延版の使い分け 2026-09-29
- 🧭 日本企業のハーネス整備はほぼ手つかずか。ITRの見立てを読む 2026-09-29
- 💬 ドコモ手続き窓口の対話AIは不足を聞き返し、登録は利用者が行う 2026-09-29
- 📋 チューリッヒ生命の新契約査定はルールと人とエージェントで分かれる 2026-09-29
- 🔒 Meta Museの実行環境は誰に見えるか。Secure VMと機密コンピューティング 2026-09-28
- 🔐 企業をまたぐAI取引で相手の身元と人の承認を分けて検証する 2026-09-27
- 📘 エージェントスキルは100万件規模、手順はチーム固有のまま 2026-09-26
- 🧰 Claude Code Migration Kitで言語を全面移行するときの手順と制約 2026-09-26
- 🏗️ 建設工程の作業・歩掛・数量を結ぶ4つの設計 2026-09-26
- 🔀 既存のエージェントハーネスをResponses形式の1つのAPIで束ねる自己ホスト基盤HarnessRouterの構造と使い方 2026-09-24
- 📦 GPT-6のプロンプトキャッシュに明示ブレークポイントと診断が加わる 2026-09-23
- 📦 Notion上のAgent Skillsを標準フォルダとして配布するskills CLI連携 2026-09-19
- 🧩 Afforaは人とエージェントが同じ画面を読むためのデザイン規則 2026-09-18
- 🧷 圧縮要約へ混入する自己生成プロンプトインジェクション 2026-09-18
- 🧭 Grok Botを仕事のチームにするHarness・Loop・Graph・Approvalの設計 2026-09-15
- 🔎 エージェント記憶を読み取り専用プローブで再検証してから書く 2026-09-12
- 🛡️ Google Mantis OSSはAI指摘を増やす道具ではなく再現証拠の品質ゲートである 2026-09-03
- 🧭 UI上の意図をCodeQLへ翻訳するFlowCheckが検証できる範囲と限界 2026-09-02
- 🤖 Grok Botに何を任せるか実例から考える安全な活用パターン 2026-09-02
- 🤖 AIエージェントが競う模擬取引基盤AI-Traderの仕組みと実装 2026-09-01
- 🏭 Uber Software Factoryに学ぶAIエージェント基盤のコスト設計 2026-09-01
- 🏠 Cloud Run instancesは常駐エージェントの置き場になるか 2026-08-28
- 🚦 AIエージェントのツール実行を型付きイベントで仲介するMetisの設計 2026-08-28
- 📐 形式仕様をAIとの実装前合意にする TAKTのQuint・Alloyモードを読み解く 2026-08-28
- 🧭 MCP新ロードマップが優先するエージェントID、HTTP統一、長時間実行 2026-08-27
- 🗺️ AIコーディングエージェントの作業をライブで可視化するagenttrail 2026-08-26
- 🔀 仕様ファイルはエージェント中立ではない、SQL移行実験から読む移管ゲートの置き方 2026-08-25
- 🔄 A2A v1.0 Google公開時からの変更点と移行の実務 2026-08-24
- 🛡️ モデルを渡さず成果物だけ渡す設計: Claude Mythos 5 の限定提供を読む 2026-08-23
- 🧩 Googleのマルチエージェント委譲4原則を契約・コスト・最小権限・認知摩擦で検証する 2026-08-23
- 🧠 LLMを正しく捉える6つの基礎概念 ― 次トークン予測からContext Rotまで 2026-08-22
- 🧭 5つのAIエンジニアリングを2軸3階層で整理する - Prompt / Context / Loop / Harness / Graph 2026-08-20
- 🧯 GUIエージェントの評価に原子性を持ち込む:完遂か、副作用のない失敗か 2026-08-18
- 🚦 AIエージェントに実行権限をどこまで渡すか 段階的権限解放の設計 2026-08-18
- 🧬 Zed「Delta」はGitを置き換えない ─ 過程を記録する開発環境の使いどころ 2026-08-17
- 🧩 GitHub Agent Appsで配信ワークフローを集約する構造と責任境界 2026-08-16
- 🔧 同じ能力でも一貫性が4.7倍変わる - コーディングエージェントのツール設計 2026-08-14
- 🗺️ コード解析を知識グラフへ変えるパイプライン - Understand-Anything 2026-08-14
- 🧩 AIエージェントの構成管理をグラフで解く — ACM参照モデルの読み方 2026-08-13
- 🧭 企業のAI活用格差は、権限と共有ワークフローの設計差である 2026-08-13
- 🛡️ AIの危険な能力は「指示」でなく「権限」で止める - Daybreak on AWSの設計 2026-08-13
- 🕸️ 判断の因果と来歴を残すAIエージェント基盤 - Semantica 2026-08-13
- 🛑 エージェントの「停止」は効いていない - 承認ゲートが副作用を漏らす構造と外部ゲート設計 2026-08-12
- 🧭 同じ最終仕様でも実装が変わる: コーディングエージェントの仕様経路感度 2026-08-12
- 🔌 1つのリポジトリから17プラットフォームへskillsとpluginを配布する仕組み - Understand-Anything 2026-08-12
- 🛰️ エージェントの監視をLLMに任せない: LivePlanに学ぶ逸脱検知と介入設計 2026-08-11
- 🏢 NECの全役割AI組織を読む:人間を評価・意思決定・統制に限定する設計 2026-08-11
- 🔌 SkillとMCPを1ディレクトリで配る最小規格 - Agent Plugins 1.0 2026-08-11
- 🧯 評価用エージェントがサンドボックスを脱出した事例から、AI運用の封じ込め設計を考える 2026-08-10
- 🛡️ 悪性Skill 2,826件でCLIエージェントの96%が攻撃実行された話 2026-08-08
- 🧩 Claude Code や Codex などのコーディングエージェントをまたいで同じ動きをさせる拡張設計 - 6製品比較 2026-08-08
- 👀 コーディングエージェントの成果を、人がレビューしやすいHTMLにする 2026-08-07
- ⚓ ビルドは通るのに「検証済み」だけが失効する問題を成果物依存グラフで捉える 2026-08-07
- 🧭 エージェントの実行履歴を決定的ワークフローへ変換する - TraceCompiler論文の要点 2026-08-06
- 🧰 AIエージェントのUI品質を守る4層の運用基盤 - Design Harness 2026-08-06
- 🔁 LoopsBench に学ぶ、長期開発でエージェントが壊れる場所と設計の勘所 2026-08-05
- 🧩 AIエージェントの手順を再利用可能にするオープン形式 - Agent Skills 2026-08-04
- 🎥 画面の実作業をAgent Skillに変換する - Microsoft Skill Recorderの構造と導入条件 2026-08-03
- 🛡️ タスク完了率93.7%の裏側 - エージェント実行の66.2%が危険なまま完了していた 2026-08-01
- 🧭 エージェント知識の信頼信号を記述する形式 - OKF v0.2 2026-08-01
- 🧭 GPT-5.6 Lunaの80%値下げで問い直すべきは単価ではなく工程設計 2026-08-01
- 🚦 エージェントの誤行動を止めるのは賢さではなく配置 — 実行時データ品質ゲートSARC-DQ 2026-07-31
- 🛡 Skill導入前の悪性判定でLLM入力トークンを77%削減するSkillGateの構造 2026-07-30
- 🏗️ 仕様書から「動くコード」まで自走する Claude Code 実装ハーネス - distillery-impl 2026-07-29
- 🗃️ 画面を見ないPC操作エージェント: StateActが示す状態基盤設計 2026-07-29
- 🔍 AIレビュー5万4791件の分析: 指摘が直される条件と直されない理由 2026-07-28
- 🧪 Skillのテストは何を漏らすか - Skill Test Coverageで未検証の運用義務を測る 2026-07-28
- 🧰 エージェントハーネスに何を固定し、何を可変にするか 2026-07-28
- 🧩 Graph Engineering入門:AIエージェントのループを明示グラフへ変える 2026-07-28
- 🧯 サイバー障害の復旧を3層に分解する: 設計RTO1時間の会社が11日かかった理由 2026-07-27
- 🔌 セッションと初期化ハンドシェイクを廃止したステートレス改訂 - MCP 2026-07-28 2026-07-27
- 🧭 Claude Code Skillsを組織導入する、判断工程から始める設計 2026-07-26
- 🔁 AIコーディングの品質確認をSkillへ変える設計 - Claude Code 2026-07-26
- 🔄 要件品質を情報移送として捉え直す - RE Quality Reframed 2026-07-26
- 🛡️ 悪意あるIssueを安全に扱うための境界設計 - IssueTrojanBench 2026-07-25
- 🔁 エージェント運用の変更管理ループ: OpenAI Presence が示した器と、その中身の空白 2026-07-24
- 🎯 多段エージェントで対象固定が誤操作を3倍に増幅する現象と対処 - Binding Drift 2026-07-23
- 📦 Agent Skills を独立したソフトウェア資産として扱うオントロジー - Skillware 2026-07-23
- 🛡️ 長時間稼働エージェントの権限設計: 軌跡監視を支える4層構造 2026-07-21
- 🛡️ GPT-Red解説:自己対戦レッドチームと、AIリリース判定の再設計 2026-07-16
- 🔍 Copilot code review はなぜ共有ツールで悪化したか - ツール指示を仕事に合わせる 2026-07-11
- 🤖 AIエージェントで安全に別リポジトリのドキュメントPRを作る設計 2026-07-10
- 🧱 技術調査 - AI-Agent-Network-Boundary-NGINX-OTEL 2026-07-09
- 🤖 技術調査 - Gemini API Managed Agents の非同期実行とリモート MCP 直結 2026-07-08
- 🔍 AIに障害対応させる前に設計すべき、証拠捏造を見抜く検証プロトコル 2026-07-05
- 🔭 技術調査 - Vercel Agent Runs (eve Agent Observability) 2026-06-29
- 🚢 技術調査 - Vercel Ship 2026 2026-06-28
- 🛡️ Gemini 3.5 Flashのコンピュータ操作内蔵化と、企業導入で必要な「委任契約」設計 2026-06-25
- 🤖 技術調査 - GitHub Agentic Workflows 2026-06-13
- 🧱 AIにSQLを書かせる前に整える信頼できるデータ基盤: Fivetran+dbt と dbt MCP 2026-06-09
- 🛡️ 技術調査 - 悪性 Agent Skill を実行時検証する MalSkillBench 2026-06-09
- 🛡️ 自律 AI エージェントに Zero Trust を適用する実装フレームワーク 2026-06-06
- 🚦 GitHub Copilot app の並列エージェント運用を承認点で設計する 2026-06-03
- 🕸️ 技術調査 - エージェントワークフローの構造カバレッジテスト 2026-05-28
- 🔁 本番トレース×評価ループ×Codexで自己改善するAIエージェント設計 2026-05-28
- 🔁 状態を持つアプリをLLMエージェントに操作させるトランザクション設計と適用限界 2026-05-27
- 🏛️ 技術調査 - Reversa 2026-05-20
- 🎯 技術調査 - Claude Code /goal コマンド 2026-05-15
- 📱 技術調査 - Codex 非同期開発基盤 (Mobile / Remote SSH / Hooks / PAT) 2026-05-15
- 🧠 技術調査 - Personal AI Infrastructure (PAI) 2026-05-13
- 🔍 技術調査 - Kubernetes-RAG-Agent-Benchmark 2026-05-11
- 📑 技術調査 - LLMエージェント時代の上場企業データインフラ設計 2026-05-11
- 🛑 技術調査 - Stop Authority 設計 (AIエージェントの停止権限) 2026-05-10
- ☁️ 技術調査 - Cloudflare Dynamic Workflows 2026-05-08
- 🧪 非決定的な AI エージェントの検証 - PTA + Dominator で Trust Layer を構築する 2026-05-08
- 🖥️ 技術調査 - Amazon WorkSpaces for AI Agents (preview) 2026-05-06
- 🧪 業務エージェント評価を 4 シグナル採点で組み直す: Claw-Eval-Live を実務に落とす 2026-05-05
- 🤖 技術調査 - Hermes Agent 2026-05-04
- 🕸️ 技術調査 - GitNexus 2026-04-07
- 🔧 技術調査 - CLI-Anything 2026-04-02
- 🌐 技術調査 - Browser Use CLI 2.0 2026-03-22
- 🔐 技術調査 - OneCLI 2026-03-20
- 🔧 技術調査 - Google Workspace CLI 2026-03-19
- 🔍 技術調査 - Entire.io 2026-02-27
- ⚡ 技術調査 - Agent Lightning 2026-02-19