Google повдига завесата над нови AI възможности часове преди събитието си
Часове преди началото на ежегодната конференция за разработчици Google I/O в социалната мрежа Х се появи видео с тийзър на една от изглежда предстоящите да бъдат анонсирани по-късно днес AI възможности на Gemini. Това е т.нар. мултимодален AI, който може да съчетава разпознаване на глас, аудио и образ и на база на това да води пълноценен диалог.
Въпросната нова функционалност (видеото под статията) е демонстрирана на смартфон, най-вероятно Pixel, чиято камера човек е насочил към изграждащата се в момента сцена за Google I/O.
Разговорът започва с въпроса “Хей, какво се случва тук?”, на което изкуственият интелект отговаря, че сякаш хората се подготвят за голямо събитие – конференция или презентация. Асистентът на свой ред пита “Има ли нещо конкретно, което привлече погледа ти?” и диалогът продължава с още въпроси и съвсем точни и адекватни отговори.
Предстои да разберем дали този тип дигитален AI помощник ще замени Google Assistant или ще бъде неговата нова версия, като детайлите за тази и всички останали нови софтуерни екстри от Google ще научим в 20 часа българско време. Тогава започва конференцията за разработчици Google I/O, а вие можете да я гледате на видеото по-горе.
One more day until #GoogleIO! We’re feeling ????. See you tomorrow for the latest news about AI, Search and more. pic.twitter.com/QiS1G8GBf9
— Google (@Google) May 13, 2024