InternVL3
InternVL3 é um Multimodal Large Language Model avançado (MLLM) com capacidades para abranger tool calling, agentes GUI, análise de imagem industrial, percepção de visão 3D e mais.
InternVL3 é um Multimodal Large Language Model avançado (MLLM) com capacidades para abranger tool calling, agentes GUI, análise de imagem industrial, percepção de visão 3D e mais.
Detalhes do modelo
| Categoria | Detalhes |
|---|---|
| Nome do modelo | InternVL3 |
| Versão | Instruct 1B |
| Categoria do modelo | VLM |
| Tamanho | 1B parâmetros |
| Modelo HuggingFace | opengvlab-internvl3-1b-instruct |
| Endpoint compatível com a OpenAI | Chat API Overview |
| Licença | Apache 2.0 |
Capacidades
| Recurso | Detalhes |
|---|---|
| Tool Calling | ❌ |
| Tamanho do Contexto | 16k tokens |
| Suporta LoRA | ❌ |
| Dados de Entrada | Texto + Imagem |
Uso
Exemplo básico de chat completion
Este é um exemplo básico de chat completion usando este modelo:
| Propriedade | Tipo | Descrição |
|---|---|---|
stream | boolean | Indica se a resposta deve ser transmitida por stream. |
messages[] | array | Array de objetos de mensagem. |
messages[].role | string | O papel do remetente da mensagem. |
messages[].content | string | O conteúdo da mensagem. |
Exemplo multimodal (texto + imagem)
Este é um exemplo de requisição multimodal usando este modelo:
| Propriedade | Tipo | Descrição |
|---|---|---|
messages[] | array | Array contendo as mensagens enviadas. |
messages[].role | string | O papel do remetente da mensagem. |
messages[].content | string | O conteúdo da mensagem. |
messages[].content[].type | string | O tipo do item de conteúdo. |
messages[].content[].text | string | Conteúdo da mensagem (somente se type for "text"). |
messages[].content[].image_url | string | Conteúdo da mensagem (somente se type for "image_url"). |
messages[].content[].image_url.url | string | A URL real da imagem. |