🛡️
Session Flagged

Your session has been flagged for unusual activity.

You can try our app by searching for MultipleChat AI on Google and clicking the multiplechat.ai link to try it free.
Verificação rápida

Confirme que você é uma pessoa para continuar.


71 termos · atualizado em 2026

O Glossário de IA

Definições precisas e em linguagem simples de todos os termos de IA que importam em 2026 — escritas para quem realmente usa essas ferramentas no dia a dia, não apenas escreve sobre elas.

A

Adam (Otimizador)

Um algoritmo de otimização amplamente utilizado que ajusta a taxa de aprendizado de cada parâmetro individualmente, tornando o treinamento de redes neurais mais rápido e estável.

Agente de IA

Um sistema de IA que planeja e executa tarefas de várias etapas por conta própria — acionando ferramentas, analisando os resultados e decidindo o que fazer em seguida — em vez de apenas responder uma única vez.

Alinhamento

O trabalho de fazer o comportamento de um sistema de IA corresponder às intenções e valores humanos — a razão pela qual um modelo segue instruções de forma confiável e recusa pedidos prejudiciais.

API (Application Programming Interface)

Uma interface programática que permite que softwares se comuniquem diretamente com um modelo, sem passar pela interface de chat — retornando dados estruturados e cobrando por token.

Mecanismo de Atenção

A técnica que permite que um modelo pondere a importância de cada parte da entrada ao gerar cada parte da saída — a operação central de todo Transformer.

B

Backpropagation (Retropropagação)

O algoritmo que treina redes neurais propagando os erros de previsão para trás e ajustando cada peso — o motor por trás de quase todo o aprendizado profundo.

Benchmark

Um teste padronizado usado para medir e comparar modelos em tarefas como raciocínio, conhecimento ou programação — útil para gerar rankings, mas nunca um substituto completo para testar o modelo no seu próprio trabalho.

BLEU

Uma métrica automática consolidada para tradução automática, que avalia a saída pela sobreposição entre suas sequências de palavras e traduções de referência feitas por humanos.

C

Esquecimento Catastrófico

A tendência de uma rede neural perder habilidades aprendidas anteriormente ao ser treinada com novos dados — um desafio central para modelos atualizados continuamente.

ChatGPT

O assistente conversacional da OpenAI, lançado em novembro de 2022, que levou os grandes modelos de linguagem ajustados por instrução ao público em massa.

Claude

A família de grandes modelos de linguagem da Anthropic, conhecida pelo contexto extenso, pelo raciocínio sólido e por uma abordagem de segurança chamada IA Constitucional.

CNN (Convolutional Neural Network)

Uma arquitetura de rede neural que usa filtros aprendidos para detectar padrões espaciais, fundamental para a visão computacional moderna.

Janela de Contexto

A quantidade total de texto — medida em tokens — que um modelo consegue considerar em uma única chamada, incluindo o prompt de sistema, o histórico da conversa, os anexos e a resposta sendo gerada.

Veja: Visualizador de Janela de Contexto.

Similaridade de Cosseno

Uma medida de quão semelhantes dois vetores são, calculada pelo ângulo entre eles — a forma padrão de comparar embeddings em busca e RAG.

D

DALL-E

O modelo de geração de imagens a partir de texto da OpenAI, que cria imagens a partir de descrições em linguagem natural, popularizando a criação de imagens por meio de prompts.

Modelo de Difusão

Um modelo generativo que aprende a criar dados revertendo um processo gradual de adição de ruído — a tecnologia por trás da maioria dos geradores de imagem por IA atuais.

DPO (Direct Preference Optimization)

Um método de alinhamento que treina um modelo diretamente com pares de preferências humanas usando uma função de perda de classificação simples, dispensando o modelo de recompensa separado usado no RLHF.

Dropout

Uma técnica de regularização que desativa neurônios aleatoriamente durante o treinamento para evitar overfitting e melhorar a generalização.

E

Embedding

Uma lista de números que representa o significado de um trecho de texto, de modo que itens semanticamente parecidos fiquem próximos no espaço vetorial.

F

Fine-Tuning (Ajuste Fino)

Continuar o treinamento de um modelo pré-treinado com dados adicionais e especializados, para que ele se adapte a um domínio, tarefa ou estilo sem precisar ser construído do zero.

G

GAN (Generative Adversarial Network)

Uma arquitetura generativa que treina duas redes uma contra a outra — um gerador que cria dados falsos e um discriminador que tenta identificá-los.

Gemini

A família de modelos nativamente multimodais do Google DeepMind, construída para raciocinar em conjunto sobre texto, imagens, áudio e vídeo.

GPT (Generative Pre-trained Transformer)

Uma família de modelos Transformer somente de decodificador, pré-treinados para prever o próximo token em grandes corpora de texto e depois adaptados para tarefas específicas.

Grok

O grande modelo de linguagem e assistente da xAI, integrado à plataforma X e posicionado em torno de informações em tempo real e um estilo conversacional.

H

Alucinação

Quando um modelo de linguagem produz um texto fluente e confiante, mas factualmente incorreto ou sem respaldo em suas fontes.

I

Instruction Tuning (Ajuste por Instrução)

Ajustar um modelo com muitas tarefas formuladas como instruções em linguagem natural, para que ele siga bem novas instruções mesmo em tarefas que nunca viu durante o treinamento.

J

Jailbreak

Um prompt criado para contornar o treinamento de segurança de um modelo e fazê-lo produzir conteúdo que deveria recusar.

K

Destilação de Conhecimento

Treinar um modelo "aluno" menor para imitar um modelo "professor" maior, transferindo grande parte de sua capacidade para um modelo mais barato e rápido.

Grafo de Conhecimento

Uma rede estruturada de entidades e das relações entre elas, usada para armazenar fatos em um formato que máquinas conseguem consultar e sobre o qual conseguem raciocinar.

L

Latência

O atraso entre o envio de um prompt e o recebimento de uma resposta. Modelos maiores e contextos mais longos aumentam a latência — o principal trade-off de velocidade em produtos de IA.

Llama

A família de grandes modelos de linguagem de código aberto da Meta, influente por levar modelos robustos e executáveis localmente a pesquisadores e desenvolvedores.

LLM (Large Language Model)

Uma rede neural treinada com uma quantidade muito grande de texto para prever o próximo token, gerando compreensão e geração de linguagem de propósito geral.

LoRA (Low-Rank Adaptation)

Um método de fine-tuning eficiente em parâmetros que adapta um modelo grande treinando pequenas matrizes adicionais, mantendo os pesos originais congelados.

LSTM (Long Short-Term Memory)

Um design de rede neural recorrente com mecanismos de porta, capaz de reter informações por sequências longas — o principal modelo de sequência antes dos Transformers.

M

MCP (Model Context Protocol)

Um padrão aberto para conectar assistentes de IA a ferramentas e fontes de dados externas por meio de uma interface comum, de modo que as integrações sejam construídas uma vez e reutilizadas em diferentes modelos.

Model Card (Ficha do Modelo)

Um documento curto e padronizado que descreve o uso pretendido de um modelo, seu desempenho entre diferentes grupos e suas limitações — para incentivar um lançamento transparente e responsável.

Multimodal

Um modelo que funciona com mais de um tipo de dado — como texto, imagens, áudio ou vídeo — dentro do mesmo sistema.

N

Nucleus Sampling (Amostragem por Núcleo)

Um método de decodificação que sorteia o próximo token a partir do menor conjunto cujas probabilidades somam p, evitando tanto textos repetitivos quanto incoerentes.

P

Perplexidade

Uma medida intrínseca padrão da qualidade de um modelo de linguagem: o quanto ele se surpreende com um texto que não viu antes. Quanto menor a perplexidade, melhor o modelo prevê textos reais.

Prompt

O texto de entrada que você fornece a um modelo para obter uma resposta. A formulação, os exemplos e a estrutura influenciam fortemente a qualidade da saída.

Prompt Injection (Injeção de Prompt)

Um ataque que insere instruções maliciosas na entrada de um modelo — diretamente ou por meio de conteúdo recuperado — para sobrepor seu prompt de sistema ou sequestrar seu comportamento.

Q

Quantização

Armazenar os pesos de um modelo com menor precisão numérica para reduzir o uso de memória e acelerar a inferência, geralmente com pouca perda de qualidade.

R

RAG (Retrieval-Augmented Generation)

Uma técnica que recupera documentos relevantes no momento da consulta e os fornece a um modelo de linguagem, de modo que sua resposta seja baseada em fontes reais e não apenas na memória do modelo.

Red Teaming

Testar deliberadamente um modelo com entradas adversariais para encontrar comportamentos prejudiciais, inseguros ou que violem políticas antes do lançamento.

Reranking (Reordenação)

Uma segunda etapa de recuperação que reavalia um conjunto inicial de passagens candidatas com um modelo mais preciso, levando as mais relevantes para o topo.

ROUGE

Uma família de métricas automáticas para sumarização que mede a sobreposição entre o texto gerado e resumos de referência feitos por humanos.

S

Scaling Laws (Leis de Escala)

Relações empíricas que mostram como o desempenho de um modelo melhora de forma previsível com mais parâmetros, dados e poder computacional.

Self-Consistency (Autoconsistência)

Um método de raciocínio que gera várias cadeias de pensamento para a mesma pergunta e retorna a resposta na qual a maioria delas concorda.

Stable Diffusion

Um modelo aberto de difusão latente para geração de imagens a partir de texto, que tornou possível gerar imagens de alta qualidade em hardware doméstico.

Streaming

Enviar a resposta de um modelo token por token à medida que é gerada, em vez de esperar a resposta completa, fazendo o texto aparecer progressivamente.

Prompt de Sistema

Instruções ocultas e de alta prioridade que definem o papel, o tom e as regras de um modelo antes do início da conversa, moldando todas as respostas que vêm a seguir.

T

Temperatura

Uma configuração que controla a aleatoriedade da saída de um modelo: uma temperatura baixa gera respostas focadas e repetíveis; uma temperatura alta gera respostas mais variadas e criativas.

Token

A unidade que um modelo de linguagem efetivamente lê e escreve — geralmente um fragmento de subpalavra, não uma palavra inteira. Limites de contexto, preços e velocidade são todos medidos em tokens.

Veja: Contador de Tokens de IA.

Transformer

A arquitetura de rede neural por trás de praticamente todo grande modelo de linguagem moderno, construída sobre um mecanismo chamado self-attention (autoatenção), em vez de recorrência ou convolução.

Tree of Thoughts (Árvore de Pensamentos)

Um framework de raciocínio que permite a um modelo explorar múltiplos caminhos de solução ramificados, avaliá-los e retroceder — como uma busca deliberada, em vez de um único palpite.

V

VAE (Variational Autoencoder)

Um modelo generativo que aprende um espaço latente probabilístico, permitindo tanto comprimir dados quanto amostrar novos exemplos a partir dele.

Banco de Dados Vetorial

Um banco de dados que indexa e busca por similaridade de embeddings em vez de correspondência exata, conseguindo encontrar conteúdo semanticamente relacionado em milissegundos.

W

Watermarking (Marca d'Água)

Inserir um sinal oculto e estatisticamente detectável em textos gerados por IA, para que possam ser identificados posteriormente como produzidos por máquina.

Whisper

O modelo de reconhecimento de fala da OpenAI, treinado com um conjunto de dados de áudio muito grande e diverso para transcrever e traduzir fala com robustez em vários idiomas.

Z

Experimente todos em um só lugar

Ler sobre LLMs é uma coisa — rodar o mesmo prompt no ChatGPT, Claude, Gemini e Grok é outra bem diferente.

Experimente o MultipleChat Free

Continue learning

See paid plans