问题不在于AI能为用户做什么,而在于怎么让用户愿意用起来。
我观察Chromium项目里浏览器与AI集成的代码,发现趋势是向“线索”发展——也就是在地址栏里弹出小巧的提示,主动邀请用户和AI互动。我好奇的是,到底哪些场景能真正带来实实在在的好处?
目前基本绕不开几个浏览器已经标配多年的功能:摘要、页面问答、翻译。在我看来,这些都太“大路货”了,我怀疑有多少人真的会经常用它们。
我觉得缺了一个关键拼图:结合用户当下工作脉络的“落地感”。我想要的不是单纯对着当前页面提问,而是能结合我过去几天搜索过什么、折腾过什么来给出信息。不是要一个干巴巴的页面摘要,而是摘要里直接点出“我为什么来到这儿”的那个答案。
技术上其实没什么高不可攀的。只要让模型能在更广的上下文里思考,完全可行。真正的坎儿多半在别处:一是隐私,因为要访问历史和搜索记录;二是计算成本。所以我特别想看看,本地模型在这条路上能走多远。
一个好的切入点,我觉得是表单填写。这类场景需要的上下文相对少,而大家花在表单上的时间又很多,AI确实能砍掉一大块重复劳动。
接着我会关注工作文档、邮件和聊天。这里的重点,更像是把浏览器能力与这些工具里已有的AI功能“焊”在一起。
不那么明显、但潜在更有意思的两个场景:一个是在复杂数据视图里玩转筛选,另一个是“帮我搜搜这个主题”式的请求。后者尤其值得玩味——因为它已经跨出了一步:从“AI回答问题”进化到“AI替你分担一部分调研活儿”。
说到底,我很好奇这些场景里到底哪些能真正跑通。光是“浏览器主动给用户递一个具体动作”这个入口本身,就已经打开了实验空间。也许,正是通过这些实验,我们最终得到的不是又一套“AI功能展示秀”,而是人们真心想用的工具。
如果你手头也有类似的想法或任务在进行中—— 欢迎进一步了解我, 或者 直接给我留言。 最不济,我们也算多了一个有意思的话题可以聊聊,然后各自回到自己的代码里。