Raksts

Inteliģentais kursoris: nākotnes AI palīdzība ekrānā

Google DeepMind piedāvā inteliģentu kursoru ar Gemini, kas saprot, uz ko norādāt, un sniedz kontekstuālu palīdzību tieši ekrānā. Tas sola mazāk paskaidrojumu, mazāk pārslēgšanās starp lietotnēm un efektīvāku darba plūsmu.

Inteliģentais kursoris: nākotnes AI palīdzība ekrānā
Lasīšanas laiks: 3 Minūtes
Sekot Google

Viskaitinošākais, lietojot mākslīgo intelektu (MI) datorā, nav pats MI. Tas ir pastāvīgais novirzījums. Jūs pārtraucat uzdevumu, pārejat uz tērzētāju, izskaidrojat, kas redzams ekrānā, nokopējat atbildi un atgriežaties pie darba. Google DeepMind tagad vēlas mazināt šo berzi ar vienkāršu, šķietami radikālu ideju: padarīt kursoru inteliģentu.

Sērijā jaunu demonstrāciju un pētniecisko priekšskatījumu DeepMind parāda, kā ar Gemini darbināts rādītājs varētu saprast gan to, uz ko jūs mērķējat, gan to, kas atrodas zem tā. Tas pilnībā maina mijiedarbību. Tā vietā, lai rakstītu garu komandu, jūs norādāt uz objektu un pieprasāt vēlamo rezultātu. Sistēma pati nolasa apkārtējo vizuālo un semantisko kontekstu.

Šī pārmaiņa var šķist niecīga. Tā nav. Tā pārvērš datora rādītāju no pasīvā navigācijas rīka par aktīvu MI atbalsta slāni, kas atrodas tieši tur, kur jau vērsta jūsu uzmanība.

Iedomājieties, ka uzkavējaties pāri datu tabulai un pieprasāt sektordiagrammu. Vai norādāt uz recepti un sakāt, "dubultojiet šīs sastāvdaļas." PDF var pārvērst par sakārtotām punktētām norādēm, gatavām e-pastam. Apturiet ceļojumu video uz restorāna kadra, un sistēma var izvilkt rezervācijas saiti. Katrā gadījumā solījums ir vienāds: mazāk izskaidrošanas, mazāk pāriešanas starp lietotnēm, mazāk manuāla tīrīšanas.

DeepMind to raksturo kā soli pretī "dabiska īsraksta" izmantošanai. Šis izteiciens ir nozīmīgs. Gadu gaitā MI rīki prasīja, lai lietotāji kļūtu par prasmīgiem komandu rakstītājiem. Šī pieeja apgriež šo slogu. Dators veic vairāk interpretācijas darba, bet lietotājs vienkārši norāda un jautā.

Kursors vairs nav tikai rādītājs

Tas nav tikai laboratorijas līmenī. Google jau piedāvā divus tiešsaistes eksperimentus AI Studio, kas koncentrējas uz attēlu rediģēšanu un kartes meklēšanu, sniedzot agrīnu ieskatu, kā šis mijiedarbības modelis varētu darboties reālajā pasaulē. Plašāks plāns iet tālāk.

Google norāda, ka tehnoloģija tiek virzīta uz Chrome, kur lietotāji varēs izcelt vai norādīt uz saturu tīmekļa lapā un vaicāt Gemini par to, neierakstot pilnu izskaidrojumu atsevišķā logā. Tas ir dabisks AI funkciju paplašinājums, ko Google jau integrē savā pārlūkā. Piemēram, Auto Browse jau ļauj Gemini risināt daudzpakāpju uzdevumus tīmeklī.

Ir arī operētājsistēmas aspekts. Versija ar nosaukumu Magic Pointer paredzēta Googlebook, kompānijas nesen paziņotajai Gemini orientētajai klēpjdatoru līnijai. Ja šī ieviešana notiks kā prezentēts, koncepcija pārsniegs pārlūkprogrammas cilnes un iekļausies plašākā darbvirsmas pieredzē.

Tieši šeit tas sāk izskatīties nozīmīgāk nekā glīts demo. Sānu paneļi un tērzēšanas logi joprojām pieprasa, lai lietotāji pārtrauktu savu plūsmu. MI rādītājs dara pretējo. Tas saglabā palīdzību iegultu tieši tajā vietā, kur parādās jautājums.

Datora pele būtiski nemainās jau vairāk nekā pusgadsimtu. Tā joprojām klikšķina, velk, izvēlas un norāda gandrīz tāpat kā agrāk. DeepMind ideja ir pārliecinoša, jo tā nemēģina aizstāt ierasto uzvedību. Tā pievieno saprašanu kā papildu slāni.

Vai tas kļūs par standarta funkciju mūsdienu skaitļošanā, būs atkarīgs no izpildes. Kontekstu apzinīgs MI izklausās spēcīgi, taču tas arī raisa pazīstamus jautājumus par precizitāti, privātumu un to, cik ļoti lietotāji uzticēsies sistēmai, kas pastāvīgi interpretē to, kas redzams ekrānā. Neskatoties uz to, virziens ir grūti ignorējams. Ja tērzētāji bija pirmais liels interfeiss ģeneratīvā MI, tad rādītājs varētu būt nākamais, kas patiešām šķitīs dabisks pašā datorā.

Artūrs Ozoliņš

"IT speciālists un žurnālists. Es rakstu par kiberdrošību, blokķēdēm un digitālo transformāciju."

Atstāt komentāru

Komentāri

Vēl nav komentāru. Esiet pirmais.