💡 読み方: まず①で「AIが自分で考え動く仕組み」をつかみ、⑤④②で「その部品と設計」、⑥⑧で「安全な場と鍵」、⑦③で「観測と測定」、最後に⑨で「複数AI協働」へ。番号はX投稿の並び順(辞書順ではなく依存関係順が読みやすい)。
Claude や GLM 等、AIの「頭脳」本体のこと。文章を読んで考え、文章で答える。
LLMが一度に「見える」情報の窓。会話・ファイル・指示など、この窓に入ったものしかLLMは知らない。
プログラムが実際に動いている状態・動かすための土台。「実行中の環境」くらいの意味。
砂場。外に影響が漏れないように隔離された安全な作業場。
能力を比べるための共通テスト。体育の体力測定みたいなもの。
autonomous agent loop ReAct agentic workflowagent harness engineering Agent = Model + HarnessSWE-bench Terminal-Bench 2.0 GAIA benchmarkcontext engineering context window RAGfunction calling tool use MCP (Model Context Protocol)agent sandbox code execution environment docker isolationagent observability Langfuse LLM tracingagent permissions OWASP LLM Top 10 prompt injectionmulti-agent framework AutoGen OpenAI Swarm