#AIAgent
89 件
- 🔀 仕様ファイルはエージェント中立ではない、SQL移行実験から読む移管ゲートの置き方 2026-08-25
- 🔄 A2A v1.0 Google公開時からの変更点と移行の実務 2026-08-24
- 🛡️ モデルを渡さず成果物だけ渡す設計: Claude Mythos 5 の限定提供を読む 2026-08-23
- 🧩 Googleのマルチエージェント委譲4原則を契約・コスト・最小権限・認知摩擦で検証する 2026-08-23
- 🧠 LLMを正しく捉える6つの基礎概念 ― 次トークン予測からContext Rotまで 2026-08-22
- 🧭 5つのAIエンジニアリングを2軸3階層で整理する - Prompt / Context / Loop / Harness / Graph 2026-08-20
- 🧯 GUIエージェントの評価に原子性を持ち込む:完遂か、副作用のない失敗か 2026-08-18
- 🚦 AIエージェントに実行権限をどこまで渡すか 段階的権限解放の設計 2026-08-18
- 🧬 Zed「Delta」はGitを置き換えない ─ 過程を記録する開発環境の使いどころ 2026-08-17
- 🧩 GitHub Agent Appsで配信ワークフローを集約する構造と責任境界 2026-08-16
- 🔧 同じ能力でも一貫性が4.7倍変わる - コーディングエージェントのツール設計 2026-08-14
- 🗺️ コード解析を知識グラフへ変えるパイプライン - Understand-Anything 2026-08-14
- 🧩 AIエージェントの構成管理をグラフで解く — ACM参照モデルの読み方 2026-08-13
- 🧭 企業のAI活用格差は、権限と共有ワークフローの設計差である 2026-08-13
- 🛡️ AIの危険な能力は「指示」でなく「権限」で止める - Daybreak on AWSの設計 2026-08-13
- 🕸️ 判断の因果と来歴を残すAIエージェント基盤 - Semantica 2026-08-13
- 🛑 エージェントの「停止」は効いていない - 承認ゲートが副作用を漏らす構造と外部ゲート設計 2026-08-12
- 🧭 同じ最終仕様でも実装が変わる: コーディングエージェントの仕様経路感度 2026-08-12
- 🔌 1つのリポジトリから17プラットフォームへskillsとpluginを配布する仕組み - Understand-Anything 2026-08-12
- 🛰️ エージェントの監視をLLMに任せない: LivePlanに学ぶ逸脱検知と介入設計 2026-08-11
- 🏢 NECの全役割AI組織を読む:人間を評価・意思決定・統制に限定する設計 2026-08-11
- 🔌 SkillとMCPを1ディレクトリで配る最小規格 - Agent Plugins 1.0 2026-08-11
- 🧯 評価用エージェントがサンドボックスを脱出した事例から、AI運用の封じ込め設計を考える 2026-08-10
- 🛡️ 悪性Skill 2,826件でCLIエージェントの96%が攻撃実行された話 2026-08-08
- 🧩 Claude Code や Codex などのコーディングエージェントをまたいで同じ動きをさせる拡張設計 - 6製品比較 2026-08-08
- 👀 コーディングエージェントの成果を、人がレビューしやすいHTMLにする 2026-08-07
- ⚓ ビルドは通るのに「検証済み」だけが失効する問題を成果物依存グラフで捉える 2026-08-07
- 🧭 エージェントの実行履歴を決定的ワークフローへ変換する - TraceCompiler論文の要点 2026-08-06
- 🧰 AIエージェントのUI品質を守る4層の運用基盤 - Design Harness 2026-08-06
- 🔁 LoopsBench に学ぶ、長期開発でエージェントが壊れる場所と設計の勘所 2026-08-05
- 🧩 AIエージェントの手順を再利用可能にするオープン形式 - Agent Skills 2026-08-04
- 🎥 画面の実作業をAgent Skillに変換する - Microsoft Skill Recorderの構造と導入条件 2026-08-03
- 🛡️ タスク完了率93.7%の裏側 - エージェント実行の66.2%が危険なまま完了していた 2026-08-01
- 🧭 エージェント知識の信頼信号を記述する形式 - OKF v0.2 2026-08-01
- 🧭 GPT-5.6 Lunaの80%値下げで問い直すべきは単価ではなく工程設計 2026-08-01
- 🚦 エージェントの誤行動を止めるのは賢さではなく配置 — 実行時データ品質ゲートSARC-DQ 2026-07-31
- 🛡 Skill導入前の悪性判定でLLM入力トークンを77%削減するSkillGateの構造 2026-07-30
- 🏗️ 仕様書から「動くコード」まで自走する Claude Code 実装ハーネス - distillery-impl 2026-07-29
- 🗃️ 画面を見ないPC操作エージェント: StateActが示す状態基盤設計 2026-07-29
- 🔍 AIレビュー5万4791件の分析: 指摘が直される条件と直されない理由 2026-07-28
- 🧪 Skillのテストは何を漏らすか - Skill Test Coverageで未検証の運用義務を測る 2026-07-28
- 🧰 エージェントハーネスに何を固定し、何を可変にするか 2026-07-28
- 🧩 Graph Engineering入門:AIエージェントのループを明示グラフへ変える 2026-07-28
- 🧯 サイバー障害の復旧を3層に分解する: 設計RTO1時間の会社が11日かかった理由 2026-07-27
- 🔌 セッションと初期化ハンドシェイクを廃止したステートレス改訂 - MCP 2026-07-28 2026-07-27
- 🧭 Claude Code Skillsを組織導入する、判断工程から始める設計 2026-07-26
- 🔁 AIコーディングの品質確認をSkillへ変える設計 - Claude Code 2026-07-26
- 🔄 要件品質を情報移送として捉え直す - RE Quality Reframed 2026-07-26
- 🛡️ 悪意あるIssueを安全に扱うための境界設計 - IssueTrojanBench 2026-07-25
- 🔁 エージェント運用の変更管理ループ: OpenAI Presence が示した器と、その中身の空白 2026-07-24
- 🎯 多段エージェントで対象固定が誤操作を3倍に増幅する現象と対処 - Binding Drift 2026-07-23
- 📦 Agent Skills を独立したソフトウェア資産として扱うオントロジー - Skillware 2026-07-23
- 🛡️ 長時間稼働エージェントの権限設計: 軌跡監視を支える4層構造 2026-07-21
- 🛡️ GPT-Red解説:自己対戦レッドチームと、AIリリース判定の再設計 2026-07-16
- 🔍 Copilot code review はなぜ共有ツールで悪化したか - ツール指示を仕事に合わせる 2026-07-11
- 🤖 AIエージェントで安全に別リポジトリのドキュメントPRを作る設計 2026-07-10
- 🧱 技術調査 - AI-Agent-Network-Boundary-NGINX-OTEL 2026-07-09
- 🤖 技術調査 - Gemini API Managed Agents の非同期実行とリモート MCP 直結 2026-07-08
- 🔍 AIに障害対応させる前に設計すべき、証拠捏造を見抜く検証プロトコル 2026-07-05
- 🔭 技術調査 - Vercel Agent Runs (eve Agent Observability) 2026-06-29
- 🚢 技術調査 - Vercel Ship 2026 2026-06-28
- 🛡️ Gemini 3.5 Flashのコンピュータ操作内蔵化と、企業導入で必要な「委任契約」設計 2026-06-25
- 🤖 技術調査 - GitHub Agentic Workflows 2026-06-13
- 🧱 AIにSQLを書かせる前に整える信頼できるデータ基盤: Fivetran+dbt と dbt MCP 2026-06-09
- 🛡️ 技術調査 - 悪性 Agent Skill を実行時検証する MalSkillBench 2026-06-09
- 🛡️ 自律 AI エージェントに Zero Trust を適用する実装フレームワーク 2026-06-06
- 🚦 GitHub Copilot app の並列エージェント運用を承認点で設計する 2026-06-03
- 🕸️ 技術調査 - エージェントワークフローの構造カバレッジテスト 2026-05-28
- 🔁 本番トレース×評価ループ×Codexで自己改善するAIエージェント設計 2026-05-28
- 🔁 状態を持つアプリをLLMエージェントに操作させるトランザクション設計と適用限界 2026-05-27
- 🏛️ 技術調査 - Reversa 2026-05-20
- 🎯 技術調査 - Claude Code /goal コマンド 2026-05-15
- 📱 技術調査 - Codex 非同期開発基盤 (Mobile / Remote SSH / Hooks / PAT) 2026-05-15
- 🧠 技術調査 - Personal AI Infrastructure (PAI) 2026-05-13
- 🔍 技術調査 - Kubernetes-RAG-Agent-Benchmark 2026-05-11
- 📑 技術調査 - LLMエージェント時代の上場企業データインフラ設計 2026-05-11
- 🛑 技術調査 - Stop Authority 設計 (AIエージェントの停止権限) 2026-05-10
- ☁️ 技術調査 - Cloudflare Dynamic Workflows 2026-05-08
- 🧪 非決定的な AI エージェントの検証 - PTA + Dominator で Trust Layer を構築する 2026-05-08
- 🖥️ 技術調査 - Amazon WorkSpaces for AI Agents (preview) 2026-05-06
- 🧪 業務エージェント評価を 4 シグナル採点で組み直す: Claw-Eval-Live を実務に落とす 2026-05-05
- 🤖 技術調査 - Hermes Agent 2026-05-04
- 🕸️ 技術調査 - GitNexus 2026-04-07
- 🔧 技術調査 - CLI-Anything 2026-04-02
- 🌐 技術調査 - Browser Use CLI 2.0 2026-03-22
- 🔐 技術調査 - OneCLI 2026-03-20
- 🔧 技術調査 - Google Workspace CLI 2026-03-19
- 🔍 技術調査 - Entire.io 2026-02-27
- ⚡ 技術調査 - Agent Lightning 2026-02-19