spot_img

Google представляет новую модель рассуждений Gemini 2.0 Flash Thinking, чтобы конкурировать с OpenAI.

Присоединяйтесь к нашим новостным рассылкам

Подписывайтесь на наши ежедневные и еженедельные рассылки, чтобы получать последние обновления и эксклюзивный контент о передовых AI-технологиях.

Что нового от Google?

Google объявил о запуске модели Gemini 2.0 Flash Thinking — многомодальной модели, способной решать сложные задачи быстро и прозрачно.

Генеральный директор Google Сундар Пичаи написал в социальной сети X, что это: “Наша самая продуманная модель на данный момент :)”

О характеристиках новой модели

  • Поддержка 32,000 токенов ввода (примерно 50-60 страниц текста).
  • Вывод до 8,000 токенов за один ответ.
  • Лучший для “многомодального понимания, рассуждения и кодирования”.

Детали о процессе обучения, архитектуре и лицензировании модели еще не опубликованы. Однако сейчас в Google AI Studio отсутствует стоимость за токен.

Прозрачность и доступность

В отличие от моделей конкурентов, Gemini 2.0 предлагает пользователям доступ к пошаговому процессу рассуждений через выпадающее меню, что позволяет лучше понять, как модель приходит к своим выводам.

Эта модель решает давние проблемы с “черным ящиком” в AI, предлагая прозрачность аналогично другим моделям с открытым исходным кодом.

Результаты первых тестов

  1. Модель быстро и правильно ответила на вопрос о количестве букв «R» в слове “Strawberry”.
  2. При сравнении чисел 9.9 и 9.11 модель разложила задачу на шаги — от анализа целых чисел до сравнения десятичных.

Эти результаты подтверждаются независимым анализом от LM Arena, который назвал Gemini 2.0 Flash Thinking лучшей моделью среди всех LLM-категорий.

Нативная поддержка изображений

В отличие от моделей OpenAI, модель Gemini 2.0 Flash Thinking изначально diseñada для обработки изображений.

Модель o1 сначала была текстовой, но позже добавила анализ изображений и файлов. На данный момент обе модели возвращают только текст.

Также Gemini 2.0 Flash Thinking пока не поддерживает интеграцию с Google Search и другими приложениями Google, согласно документации для разработчиков.

Потенциал многомодальной модели

Способность Gemini 2.0 Flash Thinking обрабатывать различные типы данных открывает множество приложений. Например, в одном из тестов модель успешно решила головоломку, анализируя текстовые и визуальные элементы.

Доступ для разработчиков

Разработчики могут использовать эти функции через Google AI Studio и Vertex AI, где модель доступна для экспериментов.

Заключение

С ростом конкуренции в сфере AI, Gemini 2.0 Flash Thinking может стать новой эпохой для моделей решения задач. Ее способности обрабатывать разнообразные данные, предлагать прозрачные рассуждения и работать в масштабах делают ее серьезным конкурентом в области AI, соперничающим с моделью o1 от OpenAI.

Подписка на новостные рассылки

Хотите произвести впечатление на своего начальника? Подпишитесь на VB Daily — мы расскажем вам о том, как компании используют генеративный AI на практике.

ОСТАВЬТЕ ОТВЕТ

Пожалуйста, введите ваш комментарий!
пожалуйста, введите ваше имя здесь

Основатель более 10 стартапов в области ИТ и ИИ. Серийный предприниматель. Профессиональный управленец.