Присоединяйтесь к нашим новостным рассылкам
Подписывайтесь на наши ежедневные и еженедельные рассылки, чтобы получать последние обновления и эксклюзивный контент о передовых AI-технологиях.
Что нового от Google?
Google объявил о запуске модели Gemini 2.0 Flash Thinking — многомодальной модели, способной решать сложные задачи быстро и прозрачно.
Генеральный директор Google Сундар Пичаи написал в социальной сети X, что это: “Наша самая продуманная модель на данный момент :)”
О характеристиках новой модели
- Поддержка 32,000 токенов ввода (примерно 50-60 страниц текста).
- Вывод до 8,000 токенов за один ответ.
- Лучший для “многомодального понимания, рассуждения и кодирования”.
Детали о процессе обучения, архитектуре и лицензировании модели еще не опубликованы. Однако сейчас в Google AI Studio отсутствует стоимость за токен.
Прозрачность и доступность
В отличие от моделей конкурентов, Gemini 2.0 предлагает пользователям доступ к пошаговому процессу рассуждений через выпадающее меню, что позволяет лучше понять, как модель приходит к своим выводам.
Эта модель решает давние проблемы с “черным ящиком” в AI, предлагая прозрачность аналогично другим моделям с открытым исходным кодом.
Результаты первых тестов
- Модель быстро и правильно ответила на вопрос о количестве букв «R» в слове “Strawberry”.
- При сравнении чисел 9.9 и 9.11 модель разложила задачу на шаги — от анализа целых чисел до сравнения десятичных.
Эти результаты подтверждаются независимым анализом от LM Arena, который назвал Gemini 2.0 Flash Thinking лучшей моделью среди всех LLM-категорий.
Нативная поддержка изображений
В отличие от моделей OpenAI, модель Gemini 2.0 Flash Thinking изначально diseñada для обработки изображений.
Модель o1 сначала была текстовой, но позже добавила анализ изображений и файлов. На данный момент обе модели возвращают только текст.
Также Gemini 2.0 Flash Thinking пока не поддерживает интеграцию с Google Search и другими приложениями Google, согласно документации для разработчиков.
Потенциал многомодальной модели
Способность Gemini 2.0 Flash Thinking обрабатывать различные типы данных открывает множество приложений. Например, в одном из тестов модель успешно решила головоломку, анализируя текстовые и визуальные элементы.
Доступ для разработчиков
Разработчики могут использовать эти функции через Google AI Studio и Vertex AI, где модель доступна для экспериментов.
Заключение
С ростом конкуренции в сфере AI, Gemini 2.0 Flash Thinking может стать новой эпохой для моделей решения задач. Ее способности обрабатывать разнообразные данные, предлагать прозрачные рассуждения и работать в масштабах делают ее серьезным конкурентом в области AI, соперничающим с моделью o1 от OpenAI.
Подписка на новостные рассылки
Хотите произвести впечатление на своего начальника? Подпишитесь на VB Daily — мы расскажем вам о том, как компании используют генеративный AI на практике.
