Главная / Блог

Блог

Vision-ввод помогает решать задачи по фотографиям

Тест с раскладом Имаджинариума показывает, как модель использует фото и текстовую подсказку для решения задачи.

Vision-ввод помогает решать задачи по фотографиям Vision-ввод помогает решать задачи по фотографиям Vision-ввод помогает решать задачи по фотографиям Vision-ввод помогает решать задачи по фотографиям

Пока мы занимались своими делами, OpenAI выпустил новую версию. Назовем её для простоты GPT-4 o1 preview (скоро догонят они китайцев по простоте нейминга).

Но пока про старую версию. Попробовал поиграть с нею в Имаджинариум – неплохо справляется.

Vision-ввод, когда на вход можно подать картинку – это магия. Фотографирую расклад карт, прописываю загадку ведущего, прошу помочь отгадать – и вот результат 👆.

#ИИ

Этот пост впервые вышел в Telegram-канале @zvasilchannel 15 сен 2024. На сайте — для архива и поиска.
Открыть в Telegram →

КОНТАКТЫ

Обсудим ИИ-трансформацию вашей компании.

Напишите через форму на сайте или напрямую в Telegram. Быстро поймём, где ИИ может дать эффект, какой формат подойдёт руководителю или команде и с чего начать.

Менторская консультация

60 000 ₽

  • Диагностика процессов и задач под ИИ
  • Выбор первых внедрений с понятным эффектом
  • Подбор инструментов: Искра, модели, сервисы и автоматизации
  • План действий на 30 / 60 / 90 дней
Записаться