Todos os produtos
Search
Central de documentação

Alibaba Cloud Model Studio:Integrar modelos de geração multimodal

Última atualização: Jul 14, 2026

Integre modelos de geração de imagens por meio do mecanismo de extensão de cada ferramenta (Skill, Slash Command ou Agent).

Exemplo: Integração de modelo de geração de imagens no Claude Code

Este exemplo demonstra como integrar um modelo de geração de imagens no Claude Code usando um Slash Command. O processo é semelhante para outras ferramentas, com diferenças apenas no mecanismo de extensão e no caminho do arquivo de configuração.

Etapa 1: Criar um Slash Command

Crie o arquivo .claude/commands/text-to-image.md no diretório raiz do projeto com o seguinte conteúdo:

Call the Token Plan text-to-image API to generate an image based on a description.

User request: $ARGUMENTS

## Steps

1. Extract prompt (image description), model, and size (default: 1024*1024) from the user request. If the user explicitly specifies a model (for example "model=wan2.7-image" or "use wan2.7-image"), you must use exactly that model name and must not fall back to the default; use the default qwen-image-2.0 only when no model is specified. Common image generation models include qwen-image-2.0, qwen-image-2.0-pro, wan2.7-image, wan2.7-image-pro, and z-image-turbo; see the Model Studio model list for the full set.

2. Call the API to generate an image (use the Bash tool to run curl):

curl -s -X POST "https://token-plan.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
  -H "Authorization: Bearer $ANTHROPIC_AUTH_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "<model>",
    "input": {
      "messages": [{"role":"user","content":[{"text":"<prompt>"}]}]
    },
    "parameters": {"size":"<size>"}
  }'

3. Extract the image URL from output.choices[*].message.content[*].image in the response JSON.

4. Download the image to the current directory with curl -s -o "generated_$(date +%Y%m%d_%H%M%S).png" "<URL>".

5. Display the generated image file path to the user.

Etapa 2: Gerar uma imagem

No Claude Code, digite /text-to-image draw a cat. Para usar um modelo diferente do padrão, inclua o nome do modelo na solicitação. Exemplo: /text-to-image draw a cat using wan2.7-image.

Outras ferramentas

A tabela a seguir lista o mecanismo de extensão e o caminho do arquivo de configuração de cada ferramenta. Salve o mesmo conteúdo do exemplo do Claude Code no caminho correspondente.

Ferramenta

Mecanismo de extensão

Caminho do arquivo de configuração

Claude Code

Slash Command

.claude/commands/text-to-image.md

Codex

Skill

~/.codex/skills/token-plan-image/SKILL.md

Qwen Code

Skill

~/.qwen/skills/text-to-image/SKILL.md

OpenCode

Agent

.opencode/agents/text-to-image.md

OpenClaw

Skill

~/.openclaw/workspace/skills/token-plan-image/SKILL.md

Hermes Agent

Skill

~/.hermes/skills/media/text-to-image/SKILL.md

Nota

Ferramentas baseadas em Skill (Codex, Qwen Code, OpenClaw, Hermes Agent) exigem front matter YAML no início do arquivo:

---
name: "token-plan-image"
description: "Call the Token Plan text-to-image model to generate images from text descriptions. Activates when the user asks to draw or generate images."
---

(... same content as the Claude Code example above ...)

O Agent do OpenCode requer um formato diferente de front matter:

---
description: "Call the Token Plan text-to-image model to generate images from text descriptions."
mode: subagent
tools:
  bash: true
  write: false
  edit: false
---

(... same content as the Claude Code example above ...)