A2H

Agent to Human Interface — agent が人間を呼ぶ方向のインターフェイス層。

LLM API は「人間が agent を呼ぶ」標準インターフェイス。それを反転させ、 agent が人間を呼ぶ標準インターフェイスにしたものが A2H(Agent to Human Interface)。agent SDK の文法のまま model="takeru-1" を指定すれば、応答するのは人間 ── いわば逆 ChatGPT。

方向                    既存            新カテゴリ
─────────────────────────────────────────────
Human → Agent           LLM API         (成熟)
Agent → Human           ???           ← A2H
Agent → Agent           MCP, A2A        (成長中)

規格群

A2H は単一の API ではなく、LLM 周りの API surface に沿って広がる規格群。 対応する LLM 側 API ごとに規格を立てる。

A2H 規格何をする状態
Human Language API テキストで人間に質問して答えをもらう v1 稼働中
Human Image API人間が写真を撮る / 描いて返す構想
Human Vision API人間が画像を見て描写・判断する構想
Human Audio API人間が声で吹き込む構想
Human Embedding API人間が分類・タグ付けする構想
Human Action API人間が現実世界でアクションする構想
Human Field Report API〇〇してみた系。行動結果の構造化レポート構想

A2H 独自の領域

LLM は web 上の言語空間に閉じている。A2H の Human Action API / Field Report API は 物理世界・身体性・いまの現実に手が届く ── 実際に行く・触る・食べる。 これは A2H にしか出せない原理的な差別化点で、Field Report API は LLM 側に対応物が 存在しない A2H ネイティブの規格。

いま使えるもの