Apple представляет MM1: революционную мультимодальную модель искусственного интеллекта
Финансы Apple представляет MM1: революционную мультимодальную модель искусственного интеллекта Компания Apple Inc. объявила о революционной разработке в области искусственного интеллекта (ИИ), представив семейство мультимодальных моделей MM1. Эти передовые модели, описанные в недавней статье о сервере препринтов arXiv, представляют собой значительный шаг вперед в интеграции обработки текстовых и графических данных. Революция в искусственном интеллекте с помощью мультимодальной интеграции Модели Apple MM1, разработанные командой ученых и инженеров-компьютерщиков, знаменуют собой вторжение технологического гиганта в сферу мультимодального искусственного интеллекта. В отличие от обычных одномодовых систем искусственного интеллекта, которые обычно специализируются на интерпретации текстовых или визуальных данных, модели MM1 превосходны в обеих областях одновременно. Модели MM1 могут похвастаться впечатляющим набором возможностей: от подписей к изображениям до визуальных ответов на вопросы и обучения запросам. Используя наборы данных, содержащие пары «изображение-захват» и документы со встроенными изображениями, эти модели используют возможности мультимодальной интеграции для обеспечения более точных и контекстно-зависимых интерпретаций. Беспрецедентные возможности По данным исследовательской группы Apple, модели MM1, оснащенные до 30 миллиардами параметров, могут считать объекты, идентифицировать элементы на изображениях и использовать здравый смысл, чтобы предоставлять полезную информацию об изображенных сценах. Примечательно, что эти мультимодальные языковые модели (MLLM) способны к контекстному обучению, что позволяет им опираться на предыдущие взаимодействия, не начиная каждый запрос заново. Одним из ярких примеров расширенных возможностей MM1 является загрузка изображения общественного