马拉松比赛的最后五公里,一个跑者的腿抽筋了。他靠在路边的栏杆上,拉伸大腿后侧,表情痛苦。志愿者跑过来,递给他运动喷雾。他喷了一些,试着小跑。旁边其他跑者经过,有人喊了一声加油。他调整呼吸,重新回到赛道,速度比之前慢了很多。最终他过了终点线,时间比目标慢了十五分钟。
体育摄影师喜欢站在底线旁边,把相机举到网带高度。拍摄网球运动员的发球动作,关键是在球拍击到球的那一瞬间按下快门。高速连拍一天能用掉上万次快门,存储卡装了好几块。画面里,球员的身体扭成弓形,球被拍面挤压变形,背景因为虚化变成一片绿色。这些照片后来刊登在一本杂志的体育专栏里。
健身房角落里,一个年轻人在做硬拉。杠铃片加到了一百公斤,他握紧杆子,深吸一口气,把杠铃拉起来。动作不算流畅,腰背有些晃动。放下后,他靠在器械上喘气。旁边一个大叔走过来说,你腰太松了,先减重量。年轻人没吭声,把片卸下两块,又重新开始。大叔站在旁边看了一会儿,走了。
练习射箭的场地上,一个年轻人拉满弓,瞄准靶心。他的手指松开,箭矢飞出,钉在靶上,偏左了。他放下弓,走到靶前拔出箭,回到起射线。他又试了一次,偏右。他调整了站位,把脚微微向左转了半厘米。第三次,箭落在黄圈边缘。他呼出一口气,眉毛还皱着。
语音助手的理解能力还停留在单轮指令层面。问一句天气,再追问“明天呢”,多数助手不知道指代对象。上下文记忆的对话模型在实验室里表现不错,但部署到手机后受能耗限制。多轮对话需要把历史信息编码进模型,推理时间会翻倍。目前助手擅长设置闹钟、播放歌曲这一类固定任务,复杂交流容易答非所问。














