> ## Documentation Index
> Fetch the complete documentation index at: https://clickhouse.com/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Vision

> Images en entrée et compréhension visuelle dans ClickHouse Agents

export const Image = ({img, alt, size = "lg"}) => {
  const normalizedSize = ["sm", "md", "lg"].includes(size) ? size : "lg";
  return <div className={`ch-image-${normalizedSize}`}>
      <Frame>
        <img src={img} alt={alt} />
      </Frame>
    </div>;
};

export const BetaBadge = ({link, galaxyTrack, galaxyEvent}) => {
  if (link) {
    return <a href={link} target="_blank" rel="noopener noreferrer" className="betaBadge" onClick={galaxyTrack && galaxyEvent ? galaxyOnClick(galaxyEvent) : undefined}>
                <Icon />
                <span>Beta</span>
            </a>;
  }
  return <div className="betaBadge">
            <Icon />
            <span>
                Fonctionnalité en bêta. 
                <u>
                    <a href="/docs/docs/beta-and-experimental-features#beta-features">
                        En savoir plus.
                    </a>
                </u>
            </span>
        </div>;
};

<BetaBadge />

Vision permet aux utilisateurs de téléverser des images afin qu’un agent les analyse. L’agent transmet l’image à un modèle compatible avec Vision, qui la décrit, la résume ou répond à des questions sur son contenu.

<div id="enable-it">
  ## Activer les fonctionnalités Vision
</div>

Vision fonctionne uniquement avec les modèles qui prennent en charge les images en entrée. Si le modèle sélectionné ne peut pas traiter d’images en entrée, le contrôle de téléversement dans le composeur de messages est désactivé. Basculez vers un modèle compatible avec Vision pour le réactiver.

<div id="use-it">
  ## Utiliser les fonctionnalités Vision
</div>

Cliquez sur l’icône en forme de trombone en bas à gauche du composeur de messages, puis choisissez **Téléverser vers le fournisseur** pour joindre une image — une capture d’écran, une photo, un graphique ou un diagramme. Posez ensuite n’importe quelle question qui nécessite de lire l’image : *« Qu’est-ce qui ne va pas avec ce plan de requête ? »*, *« Transcris le texte de cette capture d’écran »* ou *« Compare ce tableau de bord à celui de la semaine dernière. »*

<Image img="https://mintcdn.com/private-7c7dfe99/A68-kVUDkVcT2W3b/images/cloud/agent-builder/vision/vision.webp?fit=max&auto=format&n=A68-kVUDkVcT2W3b&q=85&s=78df6e1a2168ea4fda310d9f497366db" alt="Composeur de messages avec le menu du trombone ouvert, affichant les options Téléverser vers le fournisseur, Téléverser comme texte et Téléverser vers l’environnement de code" size="lg" width="3838" height="1936" data-path="images/cloud/agent-builder/vision/vision.webp" />

L’agent traite l’image comme faisant partie du contexte du message ; les questions de suivi dans le même échange peuvent donc faire référence à ce qu’il a vu sans avoir à la téléverser de nouveau.

<div id="combine-with-other-tools">
  ## Associer Vision à d'autres outils
</div>

Vision s'associe bien au [code interpreter](/docs/fr/products/cloud/features/ai-ml/agents/builder/code-interpreter) pour l'analyse d'images — par exemple, l'agent lit des chiffres sur une capture d'écran puis exécute Python pour calculer les totaux — ainsi qu'à la [web search](/docs/fr/products/cloud/features/ai-ml/agents/builder/web-search) lorsqu'une image fait référence à un élément que le modèle doit rechercher.
