Bi-Encoder
Arquitetura de recuperação que codifica query e documento separadamente em vetores de tamanho fixo e calcula relevância por uma função simples, como produto escalar ou similaridade de cosseno. Os vetores dos documentos podem ser pré-computados e consultados por busca aproximada de vizinhos, o que permite recuperar candidatos em coleções grandes com baixa latência.
A separação reduz a interação fina entre os tokens da query e do documento. Por isso, o bi-encoder costuma ocupar o primeiro estágio de um pipeline: maximiza recall dentro do orçamento e entrega uma shortlist para reranking. A qualidade depende do treinamento do embedding, do domínio, dos negativos usados e da configuração do índice; velocidade sozinha não assegura que a evidência necessária foi recuperada.