Управление на европроекти управление на европроекти
Gemini

Gemini вече може да поръчва Uber и храна през приложения на телефона: как работи

След години на обещания за „асистенти, които вършат задачите вместо вас“, Google и Samsung отново поставят автоматизацията на мобилни действия във фокуса. Gemini вече може да управлява избрани приложения и да подготвя поръчки за транспорт и доставка на храна, като оставя финалното потвърждение на потребителя.

Демонстрациите включват Uber, Uber Eats, DoorDash и Grubhub, а се очаква по-широка поддръжка на приложения с идването на Android 17.

Какви задачи може да автоматизира Gemini

Новата функционалност позволява да кажете на Gemini какво искате с естествен език, а асистентът да отвори съответното приложение и да премине през нужните стъпки. Сред примерите са:

  • „Вземи ми Uber до летището“ – Gemini отваря Uber във виртуален прозорец и започва да попълва детайлите.
  • Поръчка на храна през Uber Eats, DoorDash или Grubhub – добавяне на артикули в количката и подготовка за финализиране.

Идеята е процесът да се изпълнява във фонов режим, като потребителят може да следи напредъка чрез активна нотификация. Ако липсва информация (например кое летище е целта в район с няколко основни летища), Gemini задава уточняващи въпроси.

Ключов детайл: Gemini не приключва поръчката вместо вас. При Uber, например, потребителят трябва да избере тип услуга (като UberX или UberXL), да потвърди цената и да натисне бутона за резервация.

-25% ОТСТЪПКА ОТ ХОСТИНГ jump.bg намаление

Примери: групова поръчка и пазаруване по списък

Sameer Samat, президент на Android Ecosystem в Google, описва автоматизациите като вид „дигитално пране“ – задачи, които трябва да се свършат, но не са приятни за изпълнение ръчно.

Сред по-сложните демонстрации е сценарий с групов чат: приятели обсъждат поръчка на пица от Pizza Hut преди вечер с настолни игри и споменават конкретни предпочитания. След команда към Gemini да „подреди поръчката“, асистентът използва контекста от екрана и организира желанията на участниците. След това, при команда да поръча през Grubhub за доставка до дома, Gemini отваря приложението, добавя избраните продукти и подготвя количката за потвърждение.

Gemini може да се сблъска с ограничения в приложенията (например лимит на големи пици в натоварен период) и да предложи алтернатива, като поиска потвърждение – например две средни вместо две големи.

Друг пример включва бележка в Google Keep със списък за RSVP за барбекю и отметки кой е веган. Gemini пресмята колко хотдога и хлебчета са нужни и след това добавя необходимите продукти в количка в Safeway през DoorDash.

Към момента може да се стартира само една автоматизация наведнъж.

Как Gemini „вижда“ и управлява приложенията

Според Sameer Samat, Gemini не разчита на предварително „научена карта“ на интерфейса на конкретно приложение. Вместо това използва разсъждение, създава план и навигира по екрана подобно на човек – през бутони, полета и менюта. Това е важно, защото при визуални промени в приложението Gemini би трябвало да може да се адаптира и да продължи задачата.

Има и различни технически пътища, по които Gemini може да изпълнява действия:

  • Model Context Protocol (MCP) интеграция – отворен код „универсален език“, който позволява на LLM да комуникира с приложения на трети страни и да изпълнява задачи във фонов режим.
  • App Functions – структурирани функции, които разработчиците могат да изградят, за да може Gemini да взаимодейства с приложението по по-предвидим начин.
  • Навигация през интерфейса – ако липсват MCP и App Functions, Gemini отваря приложението и извършва действията директно през UI елементи.

Достъпност и поверителност

Функцията е в ранен преглед и първоначално ще е налична в САЩ и Южна Корея. Започва с Galaxy S26, а по-късно се очаква и като софтуерен ъпдейт за серията Google Pixel 10.

Темата за поверителността е централна, защото за да автоматизира задачи, Gemini трябва да има достъп до съдържание и действия в приложенията. Samat посочва, че в първата вълна не са включени „прекалено чувствителни“ приложения, че данните не се използват за реклама и че потребителите ще могат да изтриват данните, които Gemini е „видял“. Акцентът е върху контрол и прозрачност за това какво прави системата.

Засега за завършване на задачите е нужен екранът на телефона, но визията е в бъдеще стартирането да става и през други устройства – например смарт очила, AI аксесоари или автомобил. Паралелно се разглеждат и варианти за финална автентикация на такива устройства, така че да се намали рискът някой друг да използва достъпа ви.

Какво означава това

  • По-реалистична мобилна автоматизация: Gemini може да подготви поръчка или резервация, без да изисква ръчно преминаване през всички екрани.
  • Потребителят запазва контрол: финалното потвърждение (поръчка/плащане) остава при вас.
  • По-добро използване на контекст: Gemini може да извлича информация от екрана (например чат или бележки) и да я превръща в конкретни действия.
  • Интеграциите ще са ключови: MCP и App Functions могат да направят автоматизацията по-надеждна, особено при промени в интерфейсите.
  • Поверителността ще определя темпото: ограничен старт и предпазлив подбор на приложения подсказват, че доверието и настройките за контрол ще са критични за масово приемане.

Back to top button