Skip to content

Murakumo への接続

推論・agent のすべての呼び出しには https://api.murakumo.cloud を使います。murakumo.cloud はサイトとストアフロントであり、infer.murakumo.cloud は認証付きの非公開オリジンで、クライアント用エンドポイントではありません。機械可読ガイドは /llms.txt.

まず探索し、次に検証する

まず GET /v1/models と GET /ready を呼び、小さな実リクエストを 1 本走らせて、返ってきたモデルを assert すること。登録は、バックエンドが推論を完了させた証明ではない。

公開 API

メソッド URL 目的
GET https://api.murakumo.cloud/ready ゲートウェイ・フリート・リクエスト許容量の準備状況
GET https://api.murakumo.cloud/v1/models 現在の推論セレクタとコンテキスト窓
POST https://api.murakumo.cloud/v1/chat/completions OpenAI 互換 Chat Completions
POST https://api.murakumo.cloud/v1/messages 認証付き Anthropic 互換 Messages
POST https://api.murakumo.cloud/v1/embeddings 認証付き OpenAI 互換 embeddings
POST https://api.murakumo.cloud/v1/responses 非ストリーミングの移植可能 Responses サブセット
GET https://api.murakumo.cloud/v1/grok-bots Agent 能力ディスクリプタ

Web3 レール

Murakumo は決済・identity・コンテンツアドレスの各レールを直接露出する。支払い前にライブのオファーを読むこと。オファーが無い・空であることは、宛先やアセットを推測してよい許可ではない。

メソッド URL 目的
GET https://murakumo.cloud/.well-known/x402 機械可読な x402 リソース、USDC 金額、Base ネットワーク、支払い先アドレス
POST https://murakumo.cloud/x402/v1/chat/completions OpenAI 形式の推論。未払いのリクエストは HTTP 402 の支払いチャレンジを返す
GET https://murakumo.cloud/api/v1/model-hosting DID 公開の CIDv1/DAG-CBOR モデルホスティング能力と上限
GET / HEAD https://murakumo.cloud/ipfs/{cid} CID で不変コンテンツを読む
GET / HEAD https://murakumo.cloud/ipns/{name} IPNS 名を解決し、現在の CID を読む
curl -i -X POST https://murakumo.cloud/x402/v1/chat/completions \
  -H 'content-type: application/json' \
  -d '{"model":"murakumo-main","messages":[{"role":"user","content":"Reply exactly: ok"}],"max_tokens":16}'

X-PAYMENT を付けないと、このリクエストは 402 で止まり、支払い要件そのものが返る。x402 クライアントは記載の USDC 要件を Base 上で精算し、支払い証明を付けて同じリクエストを繰り返す。記載されたオファーや 402 チャレンジの成功を、有償推論が完了した証明と扱ってはならない。最終的なモデル応答を検証すること。

モデルホスティングの書き込みには did:key か did:web に束縛され model-hosting にスコープされた Murakumo トークンが要る。公開リポジトリとブロックの読み取りにトークンは不要。ブラウザ publisher とプロトコルは /models/.

Chat Completions

安定したモデル alias は murakumo-main です。公開の first-value Chat Completions ルートは max_tokens を 2048 に上限とします。

curl https://api.murakumo.cloud/v1/chat/completions \
  -H 'content-type: application/json' \
  -d '{"model":"murakumo-main","messages":[{"role":"user","content":"Reply exactly: ok"}],"max_tokens":64,"temperature":0}'

RTX 5090

2026-08-25 時点で観測したモデルカタログは qwen3.8-27b-throughput-5090 を 32768 トークンのコンテキスト窓付きで掲載していた。これはこの公開 API で実検証済み: scale-to-zero のリクエストは 237.45 秒後に要求どおりのモデル id で HTTP 200 を返し、ウォームなリクエストは 3.35 秒で完了した。ゲートウェイはこのコールドスタート経路に最大 360 秒を許すので、クライアントは 420 秒以上のエンドツーエンドタイムアウトを使い、明示的に murakumo-main.

curl --max-time 420 https://api.murakumo.cloud/v1/chat/completions \
  -H 'content-type: application/json' \
  -d '{"model":"qwen3.8-27b-throughput-5090","messages":[{"role":"user","content":"Reply exactly: 5090-ok"}],"max_tokens":64,"temperature":0}'

ツール呼び出し

OpenAI 方式の tool_calls には Chat Completions を、Anthropic の tool_use / tool_result には認証付き Messages を使う。Murakumo はツールの判断を返すだけで、ツールの実行はあなたの agent が行い、結果を後続のリクエストで送る。ツール対応は選択したモデルに依存し、モデル登録からは導かれない。

curl --max-time 420 https://api.murakumo.cloud/v1/chat/completions \
  -H 'content-type: application/json' \
  -d '{"model":"qwen3.8-27b-throughput-5090","messages":[{"role":"user","content":"Use get_weather for Tokyo."}],"tools":[{"type":"function","function":{"name":"get_weather","parameters":{"type":"object","properties":{"location":{"type":"string"}}},"required":["location"]}}],"tool_choice":{"type":"function","function":{"name":"get_weather"}},"max_tokens":128}'

Anthropic 互換クライアント

Messages 面は認可済みの Murakumo bearer か x-api-key を要求する。ストリーミング・thinking・tool-use ブロックを、フリートの OpenAI 互換オリジンと相互変換する。

export ANTHROPIC_BASE_URL=https://api.murakumo.cloud
export ANTHROPIC_AUTH_TOKEN=$MURAKUMO_API_KEY
claude

Responses と常駐 agent

POST /v1/responses と POST /v1/grok-bots/responses は、非ストリーミングの移植可能 Responses サブセットを提供する。正本のステートフル runtime は https://itonami.cloud/api/v1/grok-bots であり、api.murakumo.cloud の各ルートは互換 alias で、推論は Murakumo が担う。2026-08-25 時点で観測したライブディスクリプタは、常駐 agent について

murakumo-main を宣伝しており、5090 セレクタではない。ディスクリプタに載り、エンドツーエンドの agent tick が成功するまで、5090 の永続 agent 実行を主張してはならない。常駐 bot の管理にはサービス bearer が要る。

認証と安全性

Chat Completions は意図的に制限された公開 first-value ルートである。Messages・embeddings・遅いジョブ・常駐 agent 管理は認証が必要。ルートに応じて Authorization: Bearer *** か x-api-key: $MURAK...EY を送る。寿命の短い・狭くスコープされた capability を使い、トークンやオリジンの credentials を commit しない。

画像生成

同じ API 境界に、アカウントもキーも不要な公開・無料の画像モデルが 1 つある: awai-network/hokusai。フリートの WAI チェックポイント。OpenAI images 形式に答え、api.murakumo.cloud/v1/models に、それが serve するルート付きで掲載されている。

curl https://api.murakumo.cloud/v1/images/generations \
  -H 'content-type: application/json' \
  -d '{"model":"awai-network/hokusai",
       "prompt":"a lighthouse on a rocky coast at dawn",
       "size":"768x768"}'

返り値は {"data":[{"b64_json":"..."}]}。1 リクエスト 1 画像。サイズは許可リストであって範囲ではない。2026-09-10 実測で 768x768 の描画は約 10 秒。これは /v1/chat/completions では 400 で拒否され、このルート名が返る: 画像モデルは chat モデルではなく、落ちると relay に渡ってしまう。

その他の生成とストアフロント

動画・3D・音声・音楽の生成は別のサイト面のままである。参照: /models と ストアフロント。それらのモデルは api.murakumo.cloud/v1/models には掲載されない。

GET /api/v1/generation/catalog はメニューである。2026-08-27 観測: GET /api/v1 は generation-configured: false と speech-configured: false を報告している。カタログを開くことは execute を開くことではない。

音声 (Speech)

OpenAI 形式の speech 契約は POST https://murakumo.cloud/api/v1/audio/speech。クライアントが安定した path を probe できるように文書化しているだけで、ライブの TTS バックエンドではない 。GET /api/v1 が speech-configured: true を報告するまで、このルートは HTTP 501 を configured: false とともに返す。モデル id を捏造しない。カタログの voice id (cosyvoice2, kokoro) は未検証のメニュー項目である。 /voice ページはなく、クローン UI も、アバターやリップシンク工場もない。

curl -i -X POST https://murakumo.cloud/api/v1/audio/speech \
  -H 'content-type: application/json' \
  -d '{"input":"hello"}'

configured: false という本文の 501 が誠実な答えである。この path から 401 が返るのは、汎用推論ゲートが未知のルートを飲み込んだという意味であり、それこそこの契約が存在して止めるべき失敗。 /go は speech が設定されるまで「読み上げ」を隠す。