Configurações de privacidade

Aviso de privacidade e LGPD

A Nfero usa armazenamento essencial para preferências de idioma e controles de acesso às demonstrações. Com seu consentimento, o Google Analytics e eventos leves de uso ajudam a melhorar as demonstrações de modelos e os caminhos de assinatura externos. Prompts de demonstrações ao vivo podem ser enviados a endpoints de modelos configurados e hospedados pela Alibaba.

Qwen

Qwen3.8 Max Preview

Qwen3.8 Max Preview é um modelo Token Plan sempre ativo, projetado para raciocínio, compreensão visual e geração de texto. Nfero explica seu status de versão prévia, limitações e rota de acesso da Alibaba Cloud, sem indicar um preço público de pay-as-you-go nem uma demonstração ao vivo.

QwenChatRaciocínioLinguagem visualBeta
DisponibilidadeBeta
AcessoToken Plan
RegiãoSingapore-first

Demonstrações visuais

Exemplos de slots de mídia

Imagem

Pré-visualização interativa de exemplo

Mídia oficial pode ser adicionada conforme o acesso ao modelo e o uso de ativos são aprovados.

Qwen Image sample
Imagem

Exemplo de saída

Mídia oficial pode ser adicionada conforme o acesso ao modelo e o uso de ativos são aprovados.

Imagem

Exemplo de saída

Mídia oficial pode ser adicionada conforme o acesso ao modelo e o uso de ativos são aprovados.

Mídia oficial pode ser adicionada conforme o acesso ao modelo e o uso de ativos são aprovados.

Prompt ao vivo

Explorar este modelo

Pré-visualização apenas de exemplo

Explore configurações e estimativas enquanto o acesso ao vivo está sendo preparado.

Controles avançados

Use as configurações e estimativas para planejar este fluxo de trabalho do modelo.

Resposta do modelo

Resultado

Resposta do modelo
Sua resposta do modelo aparecerá aqui após a execução da demonstração.

Custo estimado

Estimativa apresentada; confirme os termos finais na Alibaba Cloud.

UsoConfirmar na Alibaba Cloud
Uso, acesso e limitesAplicam-se termos

Termos de uso

Aplicam-se termos. Confirme os termos de uso no acordo da Alibaba do cliente antes do lançamento em produção.

Acesso hospedado

O plano Individual documenta o qwen3.8-max-preview para raciocínio, compreensão visual e geração de texto. Trata-se de um modelo em versão prévia que sempre utiliza raciocínio e atualmente não é uma demonstração pública de Nfero.

Limites do modelo

Janela de entrada983.616
Limite de saída131.072
Implementação do desenvolvedorExemplos de API
curl
curl -X POST https://nfero.com/api/models/qwen3.8-max-preview/run \
  -H 'content-type: application/json' \
  -d '{"system_prompt":"Você é um assistente preciso e útil.","prompt":"Explique por que a inferência na região de Cingapura é importante para um demo público de IA.","temperature":0.7,"top_p":0.8,"max_tokens":512,"stream":false,"json_mode":false}'
JavaScript
await fetch('/api/models/qwen3.8-max-preview/run', {
  method: 'POST',
  headers: { 'content-type': 'application/json' },
  body: JSON.stringify({
  "system_prompt": "Você é um assistente preciso e útil.",
  "prompt": "Explique por que a inferência na região de Cingapura é importante para um demo público de IA.",
  "temperature": 0.7,
  "top_p": 0.8,
  "max_tokens": 512,
  "stream": false,
  "json_mode": false
})
});
Python
import requests
requests.post('https://nfero.com/api/models/qwen3.8-max-preview/run', json={
  "system_prompt": "Você é um assistente preciso e útil.",
  "prompt": "Explique por que a inferência na região de Cingapura é importante para um demo público de IA.",
  "temperature": 0.7,
  "top_p": 0.8,
  "max_tokens": 512,
  "stream": false,
  "json_mode": false
})