Murakumo への接続
推論・agent のすべての呼び出しには https://api.murakumo.cloud を使います。murakumo.cloud はサイトとストアフロントであり、infer.murakumo.cloud は認証付きの非公開オリジンで、クライアント用エンドポイントではありません。機械可読ガイドは /llms.txt.
公開 API
| メソッド | URL | 目的 |
|---|---|---|
| GET |
https://api.murakumo.cloud/ready
|
ゲートウェイ・フリート・リクエスト許容量の準備状況 |
| GET |
https://api.murakumo.cloud/v1/models
|
現在の推論セレクタとコンテキスト窓 |
| POST |
https://api.murakumo.cloud/v1/chat/completions
|
OpenAI 互換 Chat Completions |
| POST |
https://api.murakumo.cloud/v1/messages
|
認証付き Anthropic 互換 Messages |
| POST |
https://api.murakumo.cloud/v1/embeddings
|
認証付き OpenAI 互換 embeddings |
| POST |
https://api.murakumo.cloud/v1/responses
|
非ストリーミングの移植可能 Responses サブセット |
| GET |
https://api.murakumo.cloud/v1/grok-bots
|
Agent 能力ディスクリプタ |
Web3 レール
Murakumo は決済・identity・コンテンツアドレスの各レールを直接露出する。支払い前にライブのオファーを読むこと。オファーが無い・空であることは、宛先やアセットを推測してよい許可ではない。
| メソッド | URL | 目的 |
|---|---|---|
| GET |
https://murakumo.cloud/.well-known/x402
|
機械可読な x402 リソース、USDC 金額、Base ネットワーク、支払い先アドレス |
| POST |
https://murakumo.cloud/x402/v1/chat/completions
|
OpenAI 形式の推論。未払いのリクエストは HTTP 402 の支払いチャレンジを返す |
| GET |
https://murakumo.cloud/api/v1/model-hosting
|
DID 公開の CIDv1/DAG-CBOR モデルホスティング能力と上限 |
| GET / HEAD |
https://murakumo.cloud/ipfs/{cid}
|
CID で不変コンテンツを読む |
| GET / HEAD |
https://murakumo.cloud/ipns/{name}
|
IPNS 名を解決し、現在の CID を読む |
curl -i -X POST https://murakumo.cloud/x402/v1/chat/completions \
-H 'content-type: application/json' \
-d '{"model":"murakumo-main","messages":[{"role":"user","content":"Reply exactly: ok"}],"max_tokens":16}'
X-PAYMENT を付けないと、このリクエストは 402 で止まり、支払い要件そのものが返る。x402 クライアントは記載の USDC 要件を Base 上で精算し、支払い証明を付けて同じリクエストを繰り返す。記載されたオファーや 402 チャレンジの成功を、有償推論が完了した証明と扱ってはならない。最終的なモデル応答を検証すること。
モデルホスティングの書き込みには did:key か did:web に束縛され model-hosting にスコープされた Murakumo トークンが要る。公開リポジトリとブロックの読み取りにトークンは不要。ブラウザ publisher とプロトコルは /models/.
Chat Completions
安定したモデル alias は murakumo-main です。公開の first-value Chat Completions ルートは max_tokens を 2048 に上限とします。
curl https://api.murakumo.cloud/v1/chat/completions \
-H 'content-type: application/json' \
-d '{"model":"murakumo-main","messages":[{"role":"user","content":"Reply exactly: ok"}],"max_tokens":64,"temperature":0}'
RTX 5090
2026-08-25 時点で観測したモデルカタログは qwen3.8-27b-throughput-5090 を 32768 トークンのコンテキスト窓付きで掲載していた。これはこの公開 API で実検証済み: scale-to-zero のリクエストは 237.45 秒後に要求どおりのモデル id で HTTP 200 を返し、ウォームなリクエストは 3.35 秒で完了した。ゲートウェイはこのコールドスタート経路に最大 360 秒を許すので、クライアントは 420 秒以上のエンドツーエンドタイムアウトを使い、明示的に murakumo-main.
curl --max-time 420 https://api.murakumo.cloud/v1/chat/completions \
-H 'content-type: application/json' \
-d '{"model":"qwen3.8-27b-throughput-5090","messages":[{"role":"user","content":"Reply exactly: 5090-ok"}],"max_tokens":64,"temperature":0}'
ツール呼び出し
OpenAI 方式の tool_calls には Chat Completions を、Anthropic の tool_use / tool_result には認証付き Messages を使う。Murakumo はツールの判断を返すだけで、ツールの実行はあなたの agent が行い、結果を後続のリクエストで送る。ツール対応は選択したモデルに依存し、モデル登録からは導かれない。
curl --max-time 420 https://api.murakumo.cloud/v1/chat/completions \
-H 'content-type: application/json' \
-d '{"model":"qwen3.8-27b-throughput-5090","messages":[{"role":"user","content":"Use get_weather for Tokyo."}],"tools":[{"type":"function","function":{"name":"get_weather","parameters":{"type":"object","properties":{"location":{"type":"string"}}},"required":["location"]}}],"tool_choice":{"type":"function","function":{"name":"get_weather"}},"max_tokens":128}'
Anthropic 互換クライアント
Messages 面は認可済みの Murakumo bearer か x-api-key を要求する。ストリーミング・thinking・tool-use ブロックを、フリートの OpenAI 互換オリジンと相互変換する。
export ANTHROPIC_BASE_URL=https://api.murakumo.cloud export ANTHROPIC_AUTH_TOKEN=$MURAKUMO_API_KEY claude
Responses と常駐 agent
POST /v1/responses と POST /v1/grok-bots/responses は、非ストリーミングの移植可能 Responses サブセットを提供する。正本のステートフル runtime は https://itonami.cloud/api/v1/grok-bots であり、api.murakumo.cloud の各ルートは互換 alias で、推論は Murakumo が担う。2026-08-25 時点で観測したライブディスクリプタは、常駐 agent について
murakumo-main を宣伝しており、5090 セレクタではない。ディスクリプタに載り、エンドツーエンドの agent tick が成功するまで、5090 の永続 agent 実行を主張してはならない。常駐 bot の管理にはサービス bearer が要る。
認証と安全性
Chat Completions は意図的に制限された公開 first-value ルートである。Messages・embeddings・遅いジョブ・常駐 agent 管理は認証が必要。ルートに応じて Authorization: Bearer *** か x-api-key: $MURAK...EY を送る。寿命の短い・狭くスコープされた capability を使い、トークンやオリジンの credentials を commit しない。
画像生成
同じ API 境界に、アカウントもキーも不要な公開・無料の画像モデルが 1 つある: awai-network/hokusai。フリートの WAI チェックポイント。OpenAI images 形式に答え、api.murakumo.cloud/v1/models に、それが serve するルート付きで掲載されている。
curl https://api.murakumo.cloud/v1/images/generations \
-H 'content-type: application/json' \
-d '{"model":"awai-network/hokusai",
"prompt":"a lighthouse on a rocky coast at dawn",
"size":"768x768"}'
返り値は {"data":[{"b64_json":"..."}]}。1 リクエスト 1 画像。サイズは許可リストであって範囲ではない。2026-09-10 実測で 768x768 の描画は約 10 秒。これは /v1/chat/completions では 400 で拒否され、このルート名が返る: 画像モデルは chat モデルではなく、落ちると relay に渡ってしまう。
その他の生成とストアフロント
動画・3D・音声・音楽の生成は別のサイト面のままである。参照: /models と ストアフロント。それらのモデルは api.murakumo.cloud/v1/models には掲載されない。
GET /api/v1/generation/catalog はメニューである。2026-08-27 観測: GET /api/v1 は generation-configured: false と speech-configured: false を報告している。カタログを開くことは execute を開くことではない。
音声 (Speech)
OpenAI 形式の speech 契約は POST https://murakumo.cloud/api/v1/audio/speech。クライアントが安定した path を probe できるように文書化しているだけで、ライブの TTS バックエンドではない 。GET /api/v1 が speech-configured: true を報告するまで、このルートは HTTP 501 を configured: false とともに返す。モデル id を捏造しない。カタログの voice id (cosyvoice2, kokoro) は未検証のメニュー項目である。 /voice ページはなく、クローン UI も、アバターやリップシンク工場もない。
curl -i -X POST https://murakumo.cloud/api/v1/audio/speech \
-H 'content-type: application/json' \
-d '{"input":"hello"}'
configured: false という本文の 501 が誠実な答えである。この path から 401 が返るのは、汎用推論ゲートが未知のルートを飲み込んだという意味であり、それこそこの契約が存在して止めるべき失敗。 /go は speech が設定されるまで「読み上げ」を隠す。