Google DeepMind показали Vision Banana — и это уже новый уровень AI
Коротко:
• Это не просто генератор картинок, а универсальная vision-модель
• Работает с задачами вроде:
— сегментации (разделение объектов)
— глубины (понимание 3D сцены)
• Обучена на базе image-модели (Nano Banana Pro), но умеет анализировать, а не только генерить
Самое интересное:
• Обходит специализированные модели вроде SAM и Depth Anything
• Делает это без отдельного обучения под каждую задачу
• По сути — одна модель вместо десятков разных
ИИ начинает объединять генерацию и пониманиеи это может полностью изменить компьютерное зрение (arxiv.org)
Больше здесь -> WOAI - ИИ новости