Cohere объявила о выпуске Embed v4 — модели для преобразования материалов в векторные представления, используемые в поиске. В официальном журнале релизов компания описала обработку смешанного входа, где изображения и текст передаются вместе. Это позволяло искать не только текстовые фрагменты, но и визуальное содержимое документов.
Модель получила контекстное окно на 128 тысяч токенов и варианты размерности представлений: 256, 512, 1024 и 1536. Среди сценариев Cohere перечислила поиск текста по тексту, изображений по текстовому запросу и смешанных материалов, например PDF. На дату анонса Embed v4 была доступна на платформе Cohere, в AWS SageMaker и Azure AI Foundry. Возможности поиска описаны по документации разработчика.