ポートフォリオ概要

GitHub
AIエージェント開発・運用 / Python / LLMルーティング / 2025年5月〜活動開始

コードはAI(Claude Code等)が生成し、自身は要件の言語化・設計・検証・運用に集中するAI駆動開発スタイルです。下記の数値はAI生成を含む出力規模であり(手書き行数ではありません)、品質は複数LLM独立レビュー × 実測裁定 × 記録のプロセスで担保しています。ベースは陸上自衛隊19年で培った計画策定・30-40人のチーム指揮・文書作成——「何を作るかを固め、形になったものを検証する」仕事をAI時代に組み直したものです。

ご提供できること: 業務自動化・AIアプリ開発の要件整理から実装、24時間安定運用までの一貫対応(受託納品実績あり・下記参照)

約15万行
アプリケーションコード(1年累積)
約16万行
テストコード(1年累積)
8,000+
テストケース
10,000+
総コミット(全リポジトリ)
23
GitHubリポジトリ(公開14+非公開9)
20
技術記事(公開済み)
約6ヶ月
24h本番運用
※ 数値は2026-08実測値(SSOT正典から転記・丸め表記)・専門用語は末尾の用語集(P.4-5)を参照

武器: Claude Codeフルスタックカスタマイズで開発生産性を最大化

Hooks & Skills — 開発ライフサイクル完全自動化

  • 5種のHooksでライフサイクル制御: PreToolUse(19パターン破壊ガード)/ PostToolUse(CSV履歴)/ SessionStart(ハンドオフ表示)/ Stop(日記追記)/ Notification(Discord連携)
  • カスタムSkills: TDD / 体系的デバッグ / コードレビュー / プラン執行等の再利用可能ワークフローを定義
  • CronCreate自律ループ: Issue自動実装・定期lint・自動コミット等の無人開発を稼働中
  • LLMルーティング: 月27億トークンをGLM/MiniMax/Sonnetの3層に振り分け、自作プロキシで約67%コスト削減・$180/月(約2.7万円)で運用(軽量作業は最安モデルに自動集約)。同種の「タスク種別×モデル×コスト」設計は顧客案件のLLM導入にもそのまま横展開可能

MCP & Subagent — 外部ツール統合と並列実行

  • MCP 10+サーバー統合(異なるツール・サービスをつなぐ共通規格): Brave Search / GitHub / Playwright / Discord / Context7 / Exa等をシームレスに連携
  • Subagent並列実行: 独立タスクを4並列でディスパッチ — コードレビュー・テスト・探索を同時実行
  • 各AIの一次設定(CLAUDE.md / Memory)は後述の Obsidian SSOT の必要部分を同期・反映
  • Windows Terminal 4分割(WSL2)で4セッション同時管理、最大4×N画面
Claude Code CLI Hooks (5種) Custom Skills MCP 10+ Servers Subagent 並列実行 Obsidian SSOT CronCreate

どこでも開発 — モバイルフルスタック環境

  • Tailscale VPN + SSH + tmux でスマホから Claude Code CLI を操作
  • 外出先の隙間時間でもAI開発セッションを継続可能
  • 知見をガイド15リポジトリ(50冊超)として GitHub Pages で公開(モバイル最適化)

公開ガイド15リポジトリ(50冊超) — 実践知識の体系化

  • Claude Code / Git / tmux / WSL2 / Tailscale / Python / Docker / MCP
  • OpenClaw運用5冊 / トラブルシューティング / セキュリティ
  • スマホブラウザ最適化済み — 移動中でも即座に参照可能

Obsidian SSOT — プロジェクトライフサイクル管理と知識の資産化

AI生成コードの品質を担保する多重検証プロセス — 実例による証明

AIの盲点を仕組みで検出する — 実運用で機能した3層の検出機構

なぜ仕組みが要るか — 実例

  • 対象: BUYMA販売管理システム(Flask + Celery + Redis
  • テスト2,000件超が全て緑・CIも緑の状態で、本番の定期処理が動いていない状態を検知。原因は「ワーカーがタスクを登録しているか」をテストが検証していなかったというAI生成コード特有の盲点
  • この盲点を捕まえたのはコード読解ではなく、「1度目で終わらず、独立した2度目のレビューを課す」運用ルール

3層の検出機構 — どう防ぐか

  • ① 独立レビュー: 異なるセッション/異なるLLMに独立レビューさせる——1つのAIの見落としを別の目で拾う
  • ② 実測裁定: 指摘は検証コマンドに変換して実測結果だけで採否——誤った指摘はgrep実測で参照0件を確認し却下
  • ③ 記録と再利用: 判断過程をナレッジベース(判断記録1,300+件)に保存——同じ失敗モードの再発防止に再利用。修復時は同じ穴が再び「緑」に隠れない回帰テストを新設
Python / Flask / Celery / Redis 複数LLM独立レビュー 実測裁定 回帰テスト新設 判断記録
💡 AIにコードを書かせる開発で最も危険なのは「検証が通ったように見える」こと。個別のバグ潰しではなく、AIの出力を鵜呑みにしない検出機構をプロセスとして組み込むことが主眼です。このプロセスが、P.3「受託実績」での「バグ報告→2.5時間で修正納品」の速さと品質を支えています。

柱1: NexusCore — AIエージェント開発フレームワーク

何に使えるか: 複数LLMの性能とコストをタスク種別に合わせて使い分ける、業務自動化・AIアプリ開発の基盤フレームワーク(LLM導入のPoC〜本番運用に適用可能な設計)

マルチエージェントシステム

LLMルーティング(8プロバイダー対応・設計仕様)

Python 3.12 FastAPI Gradio pytest GitHub Actions CI/CD Apache 2.0
GitHub: fukukei23/NexusCore テスト: 5,000+ケース API: FastAPI REST + OpenAPI SDK自動生成

柱2: OpenClaw — 24時間AIエージェント運用

何に使えるか: 常時稼働するAIサービスの監視・運用体制の設計ノウハウ(顧客案件の24時間稼働要件にも適用可能・運用インフラ構築と運用の実績)

2台体制・2026年2月より連続稼働中(約6ヶ月)

59体専門エージェント + 3層Heartbeat

Claude Code GLM-5 MiniMax Discord Bot VPS + Docker Cron / Heartbeat

受託実績: SHOWROOM楽曲報告自動入力ツール

ココナラ受注 → 納品完了(2025年12月)

プロジェクト概要

  • ライブ配信プラットフォーム「SHOWROOM」の使用楽曲報告(JASRAC/NexToneコード入力)をExcelから全自動化するデスクトップツール
  • ココナラ(クラウドソーシング)で受注し、納品済み・顧客満足
  • Python環境がないクライアント向けにexeファイル(ダブルクリック即実行)としてパッケージング

技術的ハイライト

  • 自律復帰ロジック: ポップアップ広告・通信エラーを自動検知し、画面リセット&再入力で自己修復
  • 自動判別: 楽曲コードの頭文字からJASRAC/NexTone欄を自動振り分け
  • フェイルセーフ: 空行自動削除・50件上限到達で自動停止
  • AI駆動開発: バグ報告→2.5時間で修正納品。実質4日間で本番安定稼働
  • 受託の一気通貫: 要件確認(Excel仕様)→設計→exe納品→本番検証→修正対応まで納品責任を持って完走——「作って終わり」でない保守まで含む対応
Python Selenium Playwright PyInstaller Excel連携 AI駆動開発 受託案件

その他の成果物(開発済み・本番未導入)

成果物概要URL
Atelier Kyo ManagerBUYMA販売管理システム。出品パイプライン自動化・価格スクレイピング・注文ステートマシン・AIチャットボットGitHub
LINE予約システムLINE Bot + Stripe決済 + Cloudflare Workersで構築した予約管理システムGitHub
X自動投稿パイプラインX(旧Twitter)自動投稿・OAuth1永続化・信頼度自動承認・72h SLA(設計・開発中・非公開リポジトリ)非公開
RAG検索エンジン(ssot-search v2)個人知識ベース4,000+文書向けの本格RAG検索。見出し単位チャンキング・日本語意味検索(ruri-v3 + ChromaDB)・ベクトル+字句のハイブリッド検索・30分毎の差分インデックス更新・外部LLM生成テストセット39問による3条件精度評価(Recall@5 0.026→0.744)非公開(詳細は面談で説明可能)
Zenn自動投稿パイプラインGitHub Actions(discover.yml / publish.yml)でトピック自動発掘 → 記事公開を連鎖自動化(公開リポジトリ・稼働中)GitHub
公開ガイドサイト4本Claude Code Guide(12章) / OpenClaw Stack Guide(11章) / Loop Engineering Guide(自律開発ループ) / Claude Code Textbook(全てGitHub Pages・モバイル対応)GitHub Pages
Zenn技術記事公開済み + 連載中(AIエージェント / Claude Code / MCP / LLM運用等)zenn.dev/fukukei23
他プロジェクトcontextforge / orchestrix 等20+GitHub
開発環境ガイド(50冊)SSH / Tailscale / tmux / Docker等のクイックリファレンスガイド。スマホブラウザ最適化済みGitHub Pages

資格・認定

資格名等級認定関連性
ファイナンシャル・プランニング技能士 2級 厚生労働大臣認定(国家資格) 家計・資産形成・ライフプランをロジックで設計する力を公式に証明。AI駆動開発と掛け合わせ「個人の資産最適化エージェント」構想にも直結

スキルマップ

★★★ = 実務で常用 / ★★☆ = 応用可(拡張中)
カテゴリスキルレベル客観指標(根拠)
Claude Code運用Hooks(5種ライフサイクル自動化)・Skills(TDD/デバッグ/レビュー)・MCP(10+サーバー統合)・Subagent並列実行・Obsidian SSOT設計運用・CronCreate自律ループ★★★判断記録1,300+件 / 自作スキル30+個 / 自律ループ稼働中 / SSOT 140+日運用
AIエージェントマルチエージェント設計・LLMルーティング・コスト最適化★★★NexusCore 12エージェント設計・5,000+テスト / ルーティング3層$180/月
RAGチャンキング / ベクトルDB(ChromaDB) / ハイブリッド検索(RRF) / 精度評価(Recall・MRR)★★☆ssot-search v2: 4,000+文書・30分毎差分更新・Recall@5 0.744(旧検索0.026から改善)
LLM活用GLM / MiniMax / Claude の3層ルーティング設計・運用★★★3層実運用・27億トークン/月・約67%コスト削減
インフラVPS + Docker + Caddy / Heartbeat + Cron / CI/CD(GitHub Actions)★★☆OpenClaw 24h本番・2026年2月より連続稼働・2台体制(拡張中)
AI駆動実装Python / FastAPI / Docker / GitHub Actions をAI指示で構築・運用(設計・指示・動作確認・本番運用を担当)★★☆アプリ約15万行を設計〜本番運用(拡張中)
テストpytest / ミューテーションテスト / カバレッジ80%+ / セキュリティスキャン★★☆テスト8,000+ / NexusCore約85%カバレッジ(拡張中)

用語集(私のプロジェクトでの実装)

本文中の点線の下線が付いた用語と対応します。各用語の「私の実装」を1-2行で示します。
LLMルーティング
自作プロキシ(glm-rate-proxy)で月27億トークンを3層に振り分け・$180/月・約67%コスト削減。
Claude Code
本ページの成果は全てClaude Code上で構築。Hooks・Skills・Subagent・SSOT連動で全面カスタマイズ。
Hooks
5種稼働: 破壊コマンド遮断(19パターン)/ 操作履歴CSV / セッション開始時handoff表示 / 終了時日記追記 / Discord通知。
Skills
自作35個(sentaku / ssot-record / multi-llm-review等)。作業手順をSKILL.md化して再利用。
CronCreate
無人ループ稼働中: 30分毎自動同期・毎朝Daily Triage・stats集計等、durable cron約9件。
GLM / MiniMax / Sonnet
GLM=日常85% / MiniMax=大量処理14% / Sonnet=重要作業1%未満の3層使い分け。
MCP
10+サーバー常時接続(Brave Search / GitHub / Playwright / Discord / Context7 / Exa等)。
Subagent
最大4並列でレビュー・テスト・探索を同時実行。Terminal 4分割で4セッション並列管理。
WSL2
主作業環境。Windows Terminal 4分割でClaude Codeを4タブ並列稼働。
Tailscale VPN
スマホから自宅PCのWSL2へ安全接続。モバイル開発環境の基盤。
tmux
セッションを裏で維持・再接続で作業状態に復帰。OpenClaw 2台運用でも常時稼働。
Flask
atelier-kyo-manager(BUYMA販売管理・41,939行・2,178テスト)のWebフレームワーク。
Celery
同システムの定期実行ワーカー。タスク未登録事故を発見し回帰テスト新設(本文カード参照)。
Redis
同システムの重複実行ロック・Celeryブローカー・キャッシュ。
CI
NexusCore 5,000+ / atelier 2,178テストをGitHub Actionsで自動実行。本ページはpre-commitが数値整合を自動検査。
LLM
出品文生成・価格推定・利益計算コメント等に実装(atelierのagents群・NexusCore 12エージェント)。
ミューテーションテスト
NexusCoreの品質ゲート層。壊してもテストが失敗しない盲点を検出。
FastAPI
NexusCoreのAPI基盤。OpenAPI文書自動生成・5,000+テスト。
VPS
OpenClaw「フクロウ」の基盤(Docker + Caddy + UFW)。2026年2月から連続稼働。
Heartbeat
OpenClawの3層死活監視(1分/5分/30分)。「止めずに保つ」運用の中核。
JASRAC / NexTone
SHOWROOM楽曲報告ツールの自動振り分け先。頭文字判別・50件上限フェイルセーフ(受託納品済み)。
Stripe
reserve-optimizerの決済基盤。LINE Bot → Stripe Checkout → 予約確定。
Cloudflare Workers
同システムのWebhook受信・Stripe呼出・DB書込み層。
OAuth1
X自動投稿パイプラインの永続化層(署名キー暗号化・72h SLA・開発中)。
RAG
ssot-search v2として実装: 4,021文書 / 24,010チャンク / Recall@5 0.026→0.744。
ChromaDB
ssot-search v2のベクトル保管庫。30分毎の差分更新。
ハイブリッド検索
ベクトル+字句をRRF統合。単独より取りこぼしが少ないことを実測確認。
Recall@5
検索精度指標(上位5件に正解が入った割合)。外部LLM生成39問・採点基準事前固定。
GitHub Actions
4系統: NexusCore CI / atelier CI / 本repo pre-commit / Zenn自動投稿。
Docker
OpenClawをVPS上で隔離稼働。Caddy + Bot + エージェントをcomposeで束ねる。