智能戒指看起来就像我喜欢的人工智能小工具
真正值得关注的不是这条新闻本身,而是它可能把「大模型」的竞争焦点推向能力、成本与开放生态的再平衡。
在过去的几个月里,我花了很多时间与电脑交谈。大语言模型革命的一个被低估的特点是各种听写技术的显着飞跃——即使是最快、最便宜的模型也变得非常善于理解和处理语音。我测试过很多这样的应用程序,从 WisprFlow 到 Monologue 到 Spokenly 到 Handy 等等,发现它们都是快速编写电子邮件、Slack 消息等的有用方法。他们有时会默认给所有内容都采用过于正式的格式,并且喜欢以句号结束短信(就像反社会者一样),但他们在这方面也做得越来越好。但没有什么比我最近从 Mina Fahmi 那里得到的演示更让我相信与计算机对话的未来了。
Fahmi 是 Sandbar 的首席执行官,该公司正在生产一款名为 Stream 的智能戒指,计划于今年晚些时候发货。当我坐在 Sandbar 纽约市办公室的会议室时,Fahmi 向我简要介绍了该设备的功能,包括最新的功能:对所有设备进行听写。他在 Apple Notes 中打开一条新笔记,将戒指举到嘴边,用拇指按下设备的触摸板,然后轻声自言自语了几秒钟。他说完后不久,便条中出现了两个完整且正确转录的句子。
[媒体:https://twitter.com/minafahmi/status/2077794603286044840] Stream本身基本上只是一个麦克风、一个电池和一个与手机的蓝牙连接。你可以用同样的方式描述很多人工智能小工具,现在似乎每个人都想向你推销一种记录对话和会议以提取摘要和行动项目的方法。
Plaud、Pocket、FoCase 和 Mobvoi 等公司都乐意向您出售这些便携式录音机——如果它能粘在您的手机上记录电话,那就更棒了。
Fahmi 和 Sandbar 正在尝试做一些不同的事情。
Stream 是一种更为内向的设备,专注于捕捉您的声音而不是其他人的声音。
(这枚戒指承诺的另一个功能是耳语模式——法赫米对这东西说话的声音非常小,我听不到他说的一个字,而信息流仍然完美地转录。或者至少法赫米说它做到了。)