我不怀疑,在被笼统冠以“AI”之名的众多技术中,至少有一种存在某种有价值的应用。遗憾的是,科技巨头们似乎一心想着重新发明轮子,并引入不必要的“智能体”式转折。一个典型例子是,Google DeepMind 的最新实验性演示试图为你那不起眼的鼠标光标增添一项 AI 增强功能。
“鼠标光标是一件被遗忘的东西,”Google DeepMind 研究人机交互的员工研究员 Adrien Baranes 如是说,“如果指针背后有一个像 Gemini 这样的 AI 模型,像另一个人那样试图理解我们所说的话,那会怎样?”
平心而论,这个演示确实让对着 Gemini 发号施令省去了把菜谱配料复制粘贴到购物清单这一繁琐的标准流程,省下了相当多的点击次数。我还有很多俏皮话要说——但这个光标演示的有趣之处还在于,它试图应对那些可能会难倒许多 AI 模型的上下文挑战。
说白了,这不是靠AI模型一直分清购物清单、食谱、食物大战和汉堡服装,而是利用光标手势加自然指令(比如“把这个挪到
我们正在用AI重新构想一个已有50年历史的界面——鼠标指针。️这些实验性演示展示了人们如何通过动作、语音和自然的简化指令来直观地引导屏幕上的Gemini完成任务 pic.twitter.com/p6fhgNcopz 2026年5月12日
在这些早期技术演示里,还有一个例子是观看一段“东京十大美食地点”的视频,把光标划过一家餐厅的招牌,然后Gemini像AI智能体一样带你搞定第二天晚上订位的流程。先抛开那些早被讨论过的让AI智能体访问你的电子邮件或其他重要数据的安全隐患不谈,我确实也好奇这项技术如何处理误点击——至少就餐厅这个例子而言,似乎有好几步,用户很容易就能撤销。
不过,我并不相信这个“50岁的界面”真的需要AI的重新赋能。且不说“没坏就别修”这个显而易见的道理,我觉得让Gemini把我的桌面看个遍,心里不踏实。
先说清楚,如果你在Gmail中开启智能功能并让Gemini整理你的收件箱,Google并不会因此去扫描你的电子邮件来训练它的人工智能。实际上,Gemini应用的官方支持文档说,你给AI的提示词所产生的“摘要、摘录、生成的媒体和推断”才会被当成训练数据用。
html
所以,如果这个光标演示真的普及开来,Gemini 大概率不会向 Google 打小报告你 SSD 里存了啥——不过,它倒是有可能告诉 Google 你整天在工位前都干了啥。对我来说,我宁愿没有人知道我老是把“embarassment”或“occassionally”拼错,更别说别的了。
喜欢这篇文章吗?想看更多类似内容的话,点一下本页顶部的 +关注 按钮,在 MSN 上关注我们吧。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.