A AI Function é um recurso nativo de inferência de IA via SQL no EMR Serverless StarRocks que permite chamar LLMs da série qwen diretamente em consultas SQL. Este tópico descreve as regras de faturamento, os preços de tokens por modelo e região e exemplos de cálculo de taxas. Para consultar as funções de IA disponíveis, a sintaxe de invocação e os itens de configuração relacionados, consulte AI center.
Faturamento
Cada usuário recebe uma cota gratuita de 1 milhão de tokens no primeiro mês. O uso que exceder essa cota gratuita será cobrado às tarifas padrão.
|
Recurso |
Descrição |
|
Regras de faturamento |
As cobranças baseiam-se no uso de tokens dos modelos integrados. As regras variam conforme o modelo:
A taxa pelas chamadas ao modelo é calculada da seguinte forma: |
|
Cache de contexto |
Para modelos compatíveis com cache de contexto, os tokens de entrada com acerto no cache são cobrados pelo preço de acerto de cache, equivalente a 20% do preço de entrada na mesma região. Para verificar a compatibilidade com cache e os preços de cada modelo, consulte as tabelas de preços abaixo. |
|
Ciclo de faturamento |
O acerto das taxas ocorre por hora (UTC+8). Ao final de cada ciclo de faturamento, o sistema gera uma fatura e deduz os valores da sua conta. Os dados de faturamento podem apresentar atraso em relação ao uso real. Para mais detalhes, consulte Understand Alibaba Cloud bills. |
Preços
Para obter os preços mais recentes, consulte a página de compra do product.
Atualmente, a AI Function oferece suporte a inferência com os seguintes modelos integrados. Cada modelo tem cobrança separada para tokens de entrada e de saída.
qwen-plus
|
Região |
Faixa de tokens |
Preço de entrada ($/1 mil tokens) |
Preço de saída ($/1 mil tokens) |
|
0<T≤128K |
0,000138 |
0,000344 |
|
128K<T≤256K |
0,000414 |
0,003442 |
|
|
256K<T≤1M |
0,000827 |
0,008257 |
|
|
0<T≤256K |
0,000480 |
0,001440 |
|
256K<T≤1M |
0,001440 |
0,004320 |
qwen3.5-plus
|
Região |
Faixa de tokens |
Preço de entrada ($/1 mil tokens) |
Preço de saída ($/1 mil tokens) |
|
0<T≤128K |
0,000138 |
0,000826 |
|
128K<T≤256K |
0,000344 |
0,002064 |
|
|
256K<T≤1M |
0,000688 |
0,004128 |
|
|
0<T≤256K |
0,000480 |
0,002880 |
|
256K<T≤1M |
0,000600 |
0,003600 |
qwen3.6-plus
|
Região |
Faixa de tokens |
Preço de entrada ($/1 mil tokens) |
Preço de saída ($/1 mil tokens) |
|
0<T≤256K |
0,000331 |
0,001981 |
|
256K<T≤1M |
0,001321 |
0,007927 |
|
|
0<T≤256K |
0,000600 |
0,003600 |
|
256K<T≤1M |
0,002400 |
0,007200 |
qwen3.7-max
qwen3.7-plus
qwen3.6-flash
qwen3.8-max
qwen3.7-flash
glm-5.2
deepseek-v4-pro
kimi-k3
qwen-mt-plus
Modelos de embedding
|
Modelo |
Tipo de faturamento |
Região |
Preço de entrada ($/1 mil tokens) |
|
qwen3-vl-embedding |
image_embedding |
Regiões da China continental |
0,0003096 |
|
text-embedding-v4 |
context_embedding |
Regiões da China continental |
0,000086 |
|
text-embedding-v4 |
context_embedding |
Regiões internacionais |
0,000084 |
|
tongyi-embedding-vision-plus |
image_embedding |
Regiões internacionais |
0,000108 |
Exemplos de faturamento
Os exemplos a seguir demonstram como calcular as taxas da AI Function.
|
Condições de faturamento |
Taxa (USD) |
|
Taxa = Taxa de entrada + Taxa de saída = 0,000480 × 750/1000 + 0,001440 × 20/1000 = 0,000360 + 0,000029 = 0,000389 (USD) |