
「AIに聞く」から「AIに任せる」時代へ
小さく始めて全社 DX を加速。安全・権限・ログを揃えた共通基盤で、業務を 24 時間動かす AI エージェントを構築します。
4つのAIエージェントを、Harnessのレールの上で稼働させます
観察(ログモニタリング)→ 計画(/goal)→ 実行(/loop・/ci-cd)→ 振り返り(/eval)——あらゆるフェーズをHarnessが統括。
現在、4つのエージェントがリアルタイムで協業しています
協業のプロセスはHarnessの監査ログとしてリアルタイムで記録され、すべての操作を事後にトレース可能です エージェントを統制されたレールの上で稼働させます
稼働中エージェント
観察エージェント
データ収集・環境監視
計画エージェント
戦略立案・タスク分解
実行エージェント
タスク実行・自動処理
省察エージェント
結果評価・モデル最適化
AIエージェント会話
処理フロー
タスク受付
要求を受け付け
データ収集
観察が実行
計画立案
計画が設計
自動実行
実行が処理
学習・改善
省察が評価
エージェントを統制されたレールの上で稼働させます
業界で成熟したAIコーディングツールとオープンソースのエージェントフレームワークを統合し、目標の定義から継続的な評価に至るまで、完全なAI開発Harnessを構築。エージェントの稼働を安全、統制可能、かつ計測可能にします。あなたの /goal はどのようなものですか?無料の3分診断をお試しください。
目標の定義
ビジネスのゴールを、エージェントが実行可能なタスクに変換
イテレーションのサイクル
タスクの分解 → 実行 → フィードバック → 修正のサイクル
継続的インテグレーション(CI)
エージェントによるコードの変更を、自動ビルドおよびデプロイに統合
インフラストラクチャ
サンドボックス、環境、権限分離による安全な実行基盤
テストと検収
単体テスト、統合テスト、E2Eテストなど、複数の関門で品質を担保
ログ監査
すべての操作をトレース、再生、監査可能
効果測定
ゴールデンデータセットによる回帰テストと、本番環境の指標による効果の測定
リリース前に、まずは確実に動作することを証明します。
業務フローをSOP(標準作業手順)として定着させ、データ、ログ、評価の3点セットで検証します。本番環境にリリースする前に、確実に動作することを証明します。
業務の洗い出し
お客様の業務フローをSOPとして標準化
データによる検証
実際のデータを用いてSOPを実行(精度、所要時間、エラー率)
ログ監査
全ステップのログをトレース可能、異常も再現可能
評価のクローズドループ
Before/Afterの指標比較、基準に達しない場合はリリースしない
ブラウザ自動化(ego lite)で実際のユーザー操作をシミュレーションし、隔離環境でSOPの各ステップを検証。リリース前にワークフローの断絶を特定します。
AI Agent導入の3ステップ
小さく始めて全社DXを加速
Phase 1: 社内AI基盤構築
社員がAgentを作成・共有できるプラットフォームを2週間で構築。低リスクで効果を実感
Phase 2: 品質・ガバナンス強化
RAG連携、権限管理、監視ログ、SSO対応で安心して全社展開
Phase 3: 外部展開・収益化
AIプラットフォームを外部提供し、新たな収益源を創出
Phase 1: 社内AI基盤構築
社員がAgentを作成・共有できるプラットフォームを2週間で構築。低リスクで効果を実感
Phase 2: 品質・ガバナンス強化
RAG連携、権限管理、監視ログ、SSO対応で安心して全社展開
Phase 3: 外部展開・収益化
AIプラットフォームを外部提供し、新たな収益源を創出
雑務(dirtywork)は、dirtywork 専任エージェントにお任せください。
デプロイ、テスト、データ移行、反復作業など、エンジニアの時間の60%以上を消費する雑務(dirtywork)を、専門エージェントが24時間365日体制で引き受けます。人間は、Agent にはできないことだけに集中します。
デプロイとリリース
CI/CD の自動化、環境構築、リリース検証をエージェントが実行
テストと検収
回帰テスト、E2E テスト、不具合の再現を自動で実施
日常の運用・保守
モニタリング、ログ分析、アラート対応を24時間365日体制で継続的に実施
Before / After — EC シーン
商品登録(ECサイト)
注文異常の調査
カスタマーサポートのトークスクリプト更新
人間はビジネスの意思決定とプロダクトのクオリティ(味付け)を担当し、AIが実行を担います。
雑務専門エージェント。企業との綿密な対話を通じて、企業のシステムに最適化して構築します。
🧑💼人(Human)
- ビジネスの意思決定
- 要件定義
- アーキテクチャの意思決定
- 受入基準
- エスカレーション対応
🤖専門エージェント(AI)
- コードの実装
- テストの実行
- デプロイ操作
- データの整理
- モニタリングへの対応
お客様がビジネスのゴールを提示すれば、エージェントがそれを実行可能なタスクに分解し、雑務(dirtywork)を完了させます。お客様のシステムに最適化して構築されているため、お客様のリポジトリ、CIパイプライン、環境を直接操作することが可能です。
業界の主流フレームワークを基盤に、再利用可能な業務用ツールチェーンを構築。
モデルへの接続(SDK)、タスクのオーケストレーション(Agent Framework)、コードの実行(Coding Agent Harness)に至るまで、業界で成熟したツールとオープンソースフレームワークの組み合わせが、プロジェクト推進のためのエンジニアリング基盤を形成します。 私たちのチームは、この階層化・体系化されたツールチェーンの実践を3年以上にわたり継続しています。
複数モデルへの統一接続——OpenAI / Anthropic / Google に対応し、単一のAPI呼び出しで利用可能。
ai-sdk
Vercel 製,モデルへの統一接続とストリーミングインタラクションを実現。
openai-sdk
OpenAI 公式 SDK
claude-sdk
Anthropic 公式 SDK
マルチエージェントのオーケストレーション、ステート管理、ワークフロー制御。
Mastra
TypeScript エージェントフレームワーク
Agno
マルチエージェントシステム(Python)
LangChain / LangGraph / DeepAgents
LangChain エコシステムによるフルスタック対応:チェーン抽象化 / グラフステートオーケストレーション / 高度なマルチエージェント協業
Microsoft Agent Framework
マイクロソフト公式フレームワーク——AutoGen と Semantic Kernel の統合により誕生、.NET / Python に対応
CrewAI
マルチエージェントの役割分担とオーケストレーション——実際のチームのようにタスクの委任と協業を実現。
PI Agent
自己拡張可能なエージェントハーネス(earendil-works オープンソース)。
コードの記述、テスト、デプロイを担うコーディングエージェント。反復的なエンジニアリング作業を引き受けます。
Claude Code
Anthropic 公式ターミナルコーディングエージェント
Codex
OpenAI 公式コーディングエージェント
Gemini CLI
Google 公式ターミナルエージェント
Google Antigravity
Google のエージェント対応 IDE
OpenCode
オープンソースのターミナルコーディングエージェント
OpenClaw
オープンソースエージェント
Grok Build
xAI コーディングエージェント
DeepSeek Harness
DeepSeek オープンソースモデルを搭載したコーディングエージェントハーネス
PI Agent
自己拡張可能なコーディングエージェントハーネス(earendil-works オープンソース)
CITEC Harness Engineering パッケージ
ソリューション
ERP 相談エージェント
在庫、財務、人事管理の統合的な最適化
BI 分析エージェント
データ収集、分析、予測、レポート生成の完全自動化
CRM 顧客エージェント
カスタマーサービス、セールスサポート、マーケティングの自動化
EC 運用エージェント
在庫管理、価格設定、カスタマーエクスペリエンスの自動化
ミニプログラムECエージェント
越境EC対応、商品データの自動クロール(スクレイピング)
データ収集・評判分析エージェント
24時間365日体制で全域のマルチソースデータを感知し、情報のクレンジング、イベント識別、リスクの早期警告、そして詳細レポートの生成を自律的に完了
