Qwen 2.5 VL AWQ 7B
O Qwen 2.5 VL AWQ 7B é um modelo de linguagem e visão que suporta 7 bilhões de parâmetros, oferecendo capacidades avançadas como análise visual, raciocínio de agente, compreensão de vídeo longo, localização visual e geração de saída estruturada.
O Qwen 2.5 VL AWQ 7B é um modelo de linguagem e visão que suporta 7 bilhões de parâmetros, oferecendo capacidades avançadas como análise visual, raciocínio de agente, compreensão de vídeo longo, localização visual e geração de saída estruturada.
Detalhes do modelo
| Categoria | Detalhes |
|---|---|
| Nome do modelo | Qwen2.5 VL |
| Versão | AWQ 7B |
| Categoria do modelo | VLM |
| Tamanho | 7B parâmetros |
| Modelo HuggingFace | Qwen/Qwen2.5-VL-7B-Instruct-AWQ |
| Endpoint compatível com a OpenAI | Chat API Overview |
| Licença | Apache 2.0 |
Capacidades
| Recurso | Detalhes |
|---|---|
| Tool Calling | ✅ |
| Tamanho do contexto | 32k tokens |
| Suporta LoRA | ✅ |
| Dados de entrada | Texto + Imagem |
Uso
Exemplo básico de chat completion
Este é um exemplo básico de uma requisição de chat completion usando este modelo:
| Propriedade | Tipo | Descrição |
|---|---|---|
stream | boolean | Indica se a resposta deve ser transmitida via stream. |
messages[] | array | Array de objetos de mensagem formando o histórico de conversa. |
messages[].role | string | O papel do remetente da mensagem. |
messages[].content | string | O conteúdo da mensagem. |
Exemplo de resposta:
| Propriedade | Tipo | Descrição |
|---|---|---|
id | string | Identificador único para a conclusão do chat. |
object | string | Tipo do objeto. |
created | number | Timestamp Unix de quando a resposta foi criada. |
model | string | Identificador do modelo que gerou a resposta. |
choices | array | Array contendo possíveis conclusões. |
choices[] | object | Primeira escolha retornada pelo modelo. |
choices[].index | number | Índice desta escolha na lista. |
choices[].message | object | O objeto de mensagem retornado como resposta. |
choices[].message.role | string | Papel do remetente da mensagem. |
choices[].message.reasoning_content | string | Campo para metadados de raciocínio. |
choices[].message.content | string | O conteúdo textual da resposta do assistente. |
choices[].message.tool_calls | array | Quaisquer chamadas de ferramenta feitas pelo assistente. |
choices[].logprobs | string | Detalhes de probabilidades logarítmicas. |
choices[].finish_reason | string | Razão pela qual a resposta foi concluída. |
choices[].stop_reason | string | Razão pela qual a resposta foi interrompida. |
usage | object | Estatísticas de uso de tokens para a requisição. |
usage.prompt_tokens | number | Número de tokens no prompt. |
usage.total_tokens | number | Total de tokens. |
usage.completion_tokens | number | Número de tokens na resposta do modelo. |
usage.prompt_tokens_details | string | Quebra opcional de tokens do prompt. |
prompt_logprobs | number | Probabilidades logarítmicas gerais para o prompt. |
Exemplo de Tool Calling
Este é um exemplo de uma requisição de Tool Calling usando este modelo:
| Propriedade | Tipo | Descrição |
|---|---|---|
stream | boolean | Se a resposta deve ser transmitida por stream. |
messages[] | array | Lista de mensagens na conversa. |
messages[].role | string | Papel do remetente da mensagem. |
messages[].content | string | O prompt do usuário. |
tools[] | array | Lista de ferramentas que o assistente pode usar. |
tools[].type | string | Tipo de ferramenta sendo registrada. |
tools[].function.name | string | Nome da função. |
tools[].function.description | string | Descrição da função. |
tools[].function.parameters | object | Esquema para os parâmetros da função. |
Exemplo de resposta:
| Propriedade | Tipo | Descrição |
|---|---|---|
id | string | Identificador único para a resposta. |
object | string | Tipo de objeto retornado. |
created | number | Timestamp Unix de quando a resposta foi criada. |
model | string | Nome do modelo usado para gerar a resposta. |
choices | array | Lista de escolhas de resposta retornadas pelo modelo. |
choices[].index | number | Índice desta escolha na lista retornada. |
choices[].message.role | string | Papel do remetente da mensagem. |
choices[].message.reasoning_content | string | Placeholder para conteúdo de raciocínio. |
choices[].message.content | string | Conteúdo textual principal da resposta do assistente. |
choices[].message.tool_calls[] | array | Lista de ferramentas/funções que o assistente pretende chamar. |
choices[].message.tool_calls[].id | string | Identificador único para esta chamada de ferramenta. |
choices[].message.tool_calls[].type | string | Tipo da ferramenta. |
choices[].message.tool_calls[].function.name | string | Nome da função a ser chamada. |
choices[].message.tool_calls[].function.arguments | string | String JSON com argumentos passados para a função. |
choices[].logprobs | string | Detalhes de probabilidades logarítmicas. |
choices[].finish_reason | string | Razão pela qual a resposta foi finalizada. |
choices[].stop_reason | string | Razão pela qual a resposta foi interrompida. |
usage.prompt_tokens | number | Número de tokens usados no prompt. |
usage.total_tokens | number | Tokens totais usados. |
usage.completion_tokens | number | Tokens usados na resposta do modelo. |
usage.prompt_tokens_details | string | Detalhes do uso de tokens do prompt. |
prompt_logprobs | number | Probabilidades logarítmicas para tokens do prompt. |
Exemplo multimodal (texto + imagem)
Este é um exemplo multimodal usando este modelo:
| Propriedade | Tipo | Descrição |
|---|---|---|
stream | boolean | Indica se a resposta deve ser transmitida por stream. |
messages[] | array | Array de mensagens na conversa. |
messages[].role | string | Papel do remetente da mensagem. |
messages[].content[] | array | Array de blocos de conteúdo. |
messages[].content[].type | string | Tipo do bloco de conteúdo. |
messages[].content[].text | string | O conteúdo textual real. |
messages[].content[].image_url | object | Objeto contendo a URL da imagem. |
messages[].content[].image_url.url | string | URL da imagem a ser analisada. |
A resposta será semelhante à do exemplo básico de conclusão de chat.