> ## Documentation Index
> Fetch the complete documentation index at: https://clickhouse.com/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Vision

> Ввод изображений и визуальный анализ в ClickHouse Agents

export const Image = ({img, alt, size = "lg"}) => {
  const normalizedSize = ["sm", "md", "lg"].includes(size) ? size : "lg";
  return <div className={`ch-image-${normalizedSize}`}>
      <Frame>
        <img src={img} alt={alt} />
      </Frame>
    </div>;
};

export const BetaBadge = ({link, galaxyTrack, galaxyEvent}) => {
  if (link) {
    return <a href={link} target="_blank" rel="noopener noreferrer" className="betaBadge" onClick={galaxyTrack && galaxyEvent ? galaxyOnClick(galaxyEvent) : undefined}>
                <Icon />
                <span>Бета</span>
            </a>;
  }
  return <div className="betaBadge">
            <Icon />
            <span>
                Возможность в статусе бета. 
                <u>
                    <a href="/docs/docs/beta-and-experimental-features#beta-features">
                        Подробнее.
                    </a>
                </u>
            </span>
        </div>;
};

<BetaBadge />

Vision позволяет пользователям загружать изображения, чтобы агент мог их анализировать. Агент передает изображение модели с поддержкой Vision, которая описывает его, кратко излагает содержимое или отвечает на вопросы о том, что на нем изображено.

<div id="enable-it">
  ## Включите возможности Vision
</div>

Vision работает только с моделями, поддерживающими ввод изображений. Если выбранная модель не поддерживает ввод изображений, элемент загрузки в поле ввода сообщения будет недоступен.
Чтобы снова его включить, переключитесь на модель с поддержкой Vision.

<div id="use-it">
  ## Используйте возможности Vision
</div>

Нажмите значок скрепки в левом нижнем углу поля ввода сообщения и выберите **Upload to Provider**, чтобы прикрепить изображение — снимок экрана, фотографию, график или диаграмму. Затем задайте любой вопрос, для ответа на который нужно прочитать изображение: *«Что не так с этим планом выполнения запроса?»*, *«Распознай текст на этом снимке экрана»* или *«Сравни эту панель мониторинга с панелью за прошлую неделю.»*

<Image img="https://mintcdn.com/private-7c7dfe99/A68-kVUDkVcT2W3b/images/cloud/agent-builder/vision/vision.webp?fit=max&auto=format&n=A68-kVUDkVcT2W3b&q=85&s=78df6e1a2168ea4fda310d9f497366db" alt="Поле ввода сообщения с открытым меню скрепки, в котором показаны варианты Upload to Provider, Upload as Text и Upload to Code Environment" size="lg" width="3838" height="1936" data-path="images/cloud/agent-builder/vision/vision.webp" />

Агент воспринимает изображение как часть контекста сообщения, поэтому в последующих вопросах в рамках того же сообщения можно ссылаться на то, что он увидел, не загружая изображение повторно.

<div id="combine-with-other-tools">
  ## Использование Vision с другими инструментами
</div>

Vision хорошо сочетается с [code interpreter](/docs/ru/products/cloud/features/ai-ml/agents/builder/code-interpreter) для анализа изображений — например, агент считывает числа со скриншота, а затем запускает Python, чтобы вычислить итоговые значения, — а также с [Веб-поиском](/docs/ru/products/cloud/features/ai-ml/agents/builder/web-search), когда на изображении есть отсылка к чему-то, что модели нужно найти.
