/https%3A%2F%2Fs3.eu-central-1.amazonaws.com%2Fmedia.my.ua%2Ffeed%2F434%2Fb51d3443b2a5216120fc935a8da126f5.jpg)
Gemini від Google має проблеми з брендингом
Google має рацію у своєму середушньому оголошенні про нові голосові функції Gemini Live, коли каже: «Вам не доведеться здогадуватися, чи потрібне завдання Spark, Daily Brief чи швидкий пошук у вхідних повідомленнях». Google має на увазі це як обіцянку — що оновлений додаток Gemini може обробляти різноманітні завдання за допомогою голосових команд. Але тут є абсурд: Google надав кожній функції штучного інтелекту Gemini власний брендинг, що підриває саме це повідомлення.
У додатку Gemini користувачі можуть перемикатися між чатом, Spark та Daily Brief — трьома окремими функціями, кожна з яких має власну іконку та місце в навігації додатка. Це захаращує те, що в іншому випадку могло б бути більш простим користувацьким інтерфейсом, і свідчить про те, що Gemini все ще намагається знайти вбивчу функцію.
Візьмемо, наприклад, «Щоденний огляд». Ця функція виглядає як щось розумне, що вважав би інженер зі штучного інтелекту, а не звичайний користувач. По суті, це порядок денний на базі штучного інтелекту, який пропонує «проактивні, персоналізовані оновлення» з використанням даних, отриманих із програм Google, таких як Gmail і Календар. Однак на практиці «Огляд» не може розрізнити термінову або дієву інформацію та небажані підказки до виконання інших завдань — наприклад, спонукання продовжити дослідження, розпочате в чат-боті, або, що ще гірше, повторне відображення ваших попередніх пошукових запитів у Google.
Ця друга частина не здається корисною, вона моторошною. То що, якби я шукав стипендії для коледжу чи порятунок тварин у Google? Це не означає, що я хочу, щоб ШІ потім поплескав мене по плечу з цього приводу.
У Spark протилежна проблема. Це один із найкорисніших аспектів програми Gemini — агент штучного інтелекту, який може діяти від вашого імені, — але Google представив його як окремий окремий бренд, чого не потрібно робити. Звичайно, внутрішньо інженери Google можуть захотіти бути в команді Spark, і це нормально, — але звичайному користувачеві програми штучного інтелекту точно не потрібно думати про те, на якій «стороні» програми штучного інтелекту йому потрібно бути для певного завдання. Він повинен просто мати можливість ввести свій запит, а штучний інтелект зрозуміє, як його обробити, запускаючи агента, якщо завдання цього вимагає.
Справедливості заради, проблема не обмежується лише Gemini. Індустрія штучного інтелекту загалом, схоже, розкриває свою внутрішню архітектуру безпосередньо споживачам, а не приховує її за простішим інтерфейсом.
Сьогодні людям доводиться думати про те, чи хочуть вони «спілкуватися» з Клодом з Anthropic, чи «по роботі» за його допомогою. ( До цього тижня ці два режими в додатку Claude навіть не мали спільної пам’яті про минулі розмови.) ChatGPT те саме, що вимагає перемикання між «Чатом» та «Роботою». Це такий інженерно-орієнтований дизайн, який робить взаємодію зі штучним інтелектом неприродною. Споживачів просять вивчити назви брендів того, що по суті є режимами або поверхнями взаємодії, що працюють на основі моделі штучного інтелекту компанії.
Цей самий принцип може пояснити зростання текстових сервісів штучного інтелекту, де користувачі просто надсилають повідомлення чат-боту — такому як Poke , Ollie , Lindy , Orchid , Lucas , Folk , Tomo , Instinct або іншим — і помічник просто виконує те, що від нього просять.
Текстові повідомлення — це чистий, простий та зрозумілий інтерфейс користувача, який не вимагає додаткових розумових зусиль, щоб зрозуміти, яку функцію чи продукт у більшому додатку вам слід використовувати.
Як нещодавно написала інвестиційна партнерка a16z Джастін Мур : «Люди не хочуть відкривати додаток щоразу, коли їм потрібна допомога — вони хочуть мати контакт, якому можна надсилати текстові повідомлення, як другу. І золотим стандартом є iMessage».