作者:互联网 时间: 2026-07-29 07:42:57
在OpenAI发布GPT-4o、Google展现all-in AI气势之后,我写下了这个标题。原因并不是长时间与模型进行语音交互让我产生孤独感,而是自己曾经提出的许多设想,正随着一项项基于模型的功能发布逐步成为现实。
尽管我并不喜欢这种称呼,我们还是暂且顺应主流,把这些新功能称作:Agent。
基于模型的应用,在过去几个月中已经彻底改变了我自己的工作流与思考方式:
1、想要搜索时,只需拿出手机说一句‘Hey Google’,Gemini便会随时响应;
2、Gemini 1.5能够处理任何文档相关工作;
3、只要有提高英语的想法,就能随时在ChatGPT里通过对话完成设定:它不仅能纠正语法错误和一遍遍纠正发音,还可以随时随地创造所谓的环境;
4、补全代码、优化文章、修复bug……
5、以及其他任何你想得到、需要在数字世界完成的事情;
如今Microsoft又推出了Copilot+PC,也就是真正定义的AIPC。当然,其中的全部功能都符合自己的想象,游戏助手也包括在内。
去年讨论AI时代的人机交互将更多采用语音时,最常被提出的问题,是人们为何要接受这种方式。现在有了足够实时且足够人性化的语音交互体验,才发现这个问题涉及的不只是技术,还有情感:
1、或许原因只是孤独。一个孩子既不容易坚持长时间自学,也很难接受单向填鸭;但如果面对的是一个能够随时依照自己想法调整输出方式的模型呢?它既是老师,也是一种陪伴呢?其价值或许便远不止讲几道数学题,纠正几个语法错误或发音了……
2、我们在打游戏的时候,真的需要模型进行指导吗?也许真正需要的,只是一个贾维斯陪我们一边玩一边聊天……
3、面对报告写作,我们究竟更喜欢模型直接代为完成,还是希望通过互动共同完成?
4、我们确实很需要模型协助补全代码、修复bug,但也许更享受“创造”本身,以及在“创造”过程中随时涌现的分享欲;
……
也许,我们所需的仅仅是一个“同伴”。
再回到技术本身,它始终都在演进。无论迟迟等不到“GPT-5”让我们产生多少技术进步正在放缓的猜想,AI的渗透仍比预想快得多。真正缓慢的是我们的接受程度,是我们愿意让模型在多大范围内侵入生活和工作,以及侵入我们与人相处的方式……
每个人都只有24小时吗?当网上购物、点外卖和使用网约车服务变得随时随地都能完成时,这个前提其实已经改变,甚至改变得更早。不过我们每天只吃三餐,咖啡或下午茶也只喝若干次,从A点到B点的移动次数同样有限;网购虽然可能令人上瘾,终究仍受到许多物理限制……
然而,这些便捷也把我们的24小时切割得七零八落。我们一边需要他人的服务,一边又被他人需要;不断滑向“下一条”的背后,时间的主动权正在逐渐消失。
假如我们的“同伴”能够贡献自身算力,逐步把遭到侵占的时间归还给我们,
那么,当我们逐渐重新拥有完整的时间,又会选择去做些什么?
也许,我们只是尚未准备好重新取回属于自己的主导权。