T. / Journal

用上 Meta Muse 之后,我最喜欢的是能跟它聊着改

Meta MuseAI个人智能体使用体验
/back

Personal Notes

约 10 分钟阅读

第一次体验 Meta Muse:查票时实时看它操作浏览器,用聊天把快讯改成双语,再打开 Soul、Memory 和 Identity 看它如何记录偏好。最让我想继续用的,是这种自然、快速的“聊着改”。

刚刚排完 Meta Muse 的队,终于进去试了一下。

这次主要体验了它的聊天、查票、实时查看 computer use,还有记忆和动态内容的定制。算一篇中度测评吧,毕竟还没长期用,也没有把所有功能都跑一遍。但这一轮下来,已经有几个地方让我觉得挺有意思。

先说感受:它确实能帮我干活,查东西很快,小窗里看它操作也挺流畅。不过,最让我想继续用下去的,是它里面的一些内容可以直接通过聊天修改。看到哪里想调整,跟它说一下,很快就能看到变化。

这种“聊着改”的感觉,比我预想中顺手。

扣完钱,还得等一小会

进去之前有一个年龄验证,可以用信用卡,也可以通过 Instagram 或 Facebook 账号验证。

我走的是信用卡。页面写着会扣 1 美元,并在 5—7 个工作日内退回,所以这笔钱是年龄验证用的,不能当成订阅价格。

信用卡年龄验证页面

扣款之后也没有立刻进去,又等了一小会。页面提示“Your agent isn't ready”,下面说还没有为我的账号找到准备好的机器,让我稍后再来。

智能体尚未准备好

结合后面的介绍看,它有自己的电脑和浏览器,可以在用户离开之后继续工作。这个等待页应该和运行环境的准备有关,不过我没有进一步确认具体原因。

总之,如果你也走到这里,扣款成功后可能还要稍微等一下。我这次就是这样。

第一次进去,先认识一下彼此

进入之后,它会先介绍自己能做什么,再问怎么称呼你,也让你给它起名字。我让它用中文跟我交流,叫我 iuyup,之后给它选了 Marvel 这个名字。

它会引导连接 Gmail 和 Google 日历,提出可以帮忙管理邮件、安排日程,也可以从这些服务里了解我的偏好。

不过这两个软件我都不怎么用,所以我当时就直接跟它说了。

这个地方也让我感觉到,个人智能体能帮上多少忙,确实跟它能不能接触到你平时用的东西有关。如果生活和工作记录都不在这些应用里,刚开始的推荐就不一定特别贴合自己。

除了聊天,它还有动态、创意和目标这些页面。目标里能看到健康、人际关系、事业、兴趣等分类,想让你把一些长期的事情也交给它跟进。

目标页面

这些入口看起来挺丰富,但这次我更想知道的是:给它一个实际需求,它到底能不能动起来。

让它查一次票,确实能干活

我给它的任务是,找一下从深圳到北京最便宜的方案,后面又补充了明天出发。

它先给了一个结论:K106 普速列车的硬座,250 多块钱。还解释了为什么不推荐中转,提醒我注意出发站。

接着它问,要不要查一下实时余票。我回了一个“查”,它就打开了 12306。

这里我觉得做得挺好的:聊天里会出现一个浏览器小窗,可以实时看到它的 computer use。它打开网页、填车站、查询,整个过程能直接看见,也可以点进去打开浏览器。

实时查看 Muse 操作 12306

实际看着它操作,我的感觉是挺流畅的。查得也快,确实有在帮我把事情往下做,没有明显等很久的感觉。

最后它返回了不同席别的价格和余票情况,说硬座已经没票,可以候补,另外还有无座和卧铺选项。它也修正了前面提到的到达时间,说之前给的是旧时刻。

当次测试返回的查询结果

这是当次测试里 Muse 返回的结果,截图中的价格和余票不作为现在的出行参考。

这一段里,有帮上忙的地方,也有可以改进的地方。

它确实打开网站查了,并且在后面修正了前面的信息。不过一开始就说“最便宜的就是硬座”,还是有点早。既然我问的是明天出发的方案,有没有票也应该一起考虑。

但就操作体验来说,这一项我是认可的。尤其在手机上,你发出一个需求,就能看着它去浏览器里处理,最后再回到聊天里给结果,这个过程挺顺。

至于它后面说可以继续帮忙候补,或者操作到付款确认那一步,我这次没有继续验证,就先不算进实际完成的能力里了。

最好玩的,是快讯也能聊着改

这次让我印象最深的,其实是第二个页面里的动态内容。

晚上它给我出了一条 NASA 的快讯,在“Saturday evening”下面,原本是纯英文。我就跟它说,想要一个中英双语版。

然后它直接给改好了。

回到那个页面,标题和正文已经变成中英双语,中文在上,英文在下。原来的内容就在那个位置更新了,读起来很方便。

通过聊天修改后的双语快讯

这里主要展示内容格式的变化,快讯里的新闻事实我没有单独核验。

这就是我说的“所见即所改”。

看到一条内容,觉得它的呈现方式不太适合我,我直接跟 Muse 说想怎么改,它就帮我修改。整个过程不需要先研究设置在哪里,也不用自己把英文复制出去翻译。

而且速度很重要。它这次改得很快,没有什么明显的迟滞感,我说完需求,很快就能看到结果。

如果每次调整都要等半天,可能试过一次就懒得用了。但它反馈得足够快,我就会自然地想:那其他地方是不是也能跟它聊着改?

我当时甚至猜,是不是模型做了什么专门的优化。不过这个只是猜测,单凭使用感受判断不了。能确定的是,这次从提出要求到看到变化,体验确实很顺。

它还说,以后的快讯也会按这个方式写

后面我又问了一下这个快讯的机制。

按 Muse 自己的解释,这些内容会根据我的设定在后台生成,来源可以包括网络搜索、社交平台和连接的服务,再结合它对我的了解来编写。

我提出双语要求之后,它说后续的新快讯也会采用双语,标题也会一起调整。

Muse 对快讯生成机制的解释

这是 Muse 在对话里对机制的说明,还不能全部当成已经验证过的实际表现。

如果后续能持续做到,那这个功能就更有意思了。我在使用过程中随口提一个偏好,它就能影响之后的内容,不用每次重新交代。

不过它也说了,目前什么时候自动写、一次写几篇,由系统决定,用户不能直接调整这个定时。下拉刷新也只是加载已有内容,不会触发一篇新的快讯;想马上看新的,可以在聊天里让它现在写。

所以“整个 App 都能通过聊天改”,更像是我这次使用时形成的一种直观感受。具体能改到什么程度,还有边界。至少这次我已经试到,页面里的内容可以这样调整,它也声称会把要求延续到后面的生成里。

对我来说,这已经挺有吸引力了。

Soul、Memory 和 Identity,都可以打开看

另一个值得说的地方,是它把几个和个性、记忆有关的 Markdown 文件直接放出来了。

我目前看到了三个:SOUL.md、MEMORY.md 和 IDENTITY.md。前两个有单独的卡片入口,Identity 是点击 Edit 之后进去的。

SOUL.md 写的是它做事和交流的一些原则,比如少说客套话,有自己的判断,遇到事情先尝试解决,再来提问,以及谨慎对待访问用户信息的权限。

SOUL.md

MEMORY.md 记录关于用户的长期信息。它把内容分成事实、偏好和约定,我打开的时候,里面已经有了“用简体中文交流”这一条。

MEMORY.md

页面说明写着,它会在每次对话开始时读取这些记忆,并在夜间整理。用户可以直接修改,也可以让它忘记某件事。它还特意说明,这些内容代表它对用户的理解,可能会过时。

我觉得把这点写出来挺好的。偏好本来就可能变化,记错了也应该有地方改。

IDENTITY.md 则是名字、角色、风格和代表 emoji 这些内容。我之前选的 Marvel 已经写进去了,其他几项还留着模板提示。

IDENTITY.md

这些文件让我觉得比较实在。它在聊天里说“记住了”,我还能打开看一眼,知道它到底记成了什么。

当然,现在还不能说它以后一定能准确使用每一条记忆。长期记忆有没有帮助,还需要多用一段时间。但至少查看和修改的入口已经摆在那里了。

也有一些小问题

这次遇到过一次发送消息后一直加载,随后停住,没有输出的情况。

我手动暂停,再让它继续生成,就能恢复。对我来说影响还好,也有可能跟网络有关,暂时判断不了具体原因。它不是已经回答了一半突然断掉,而是在输出之前卡了一下。

另外,我这次看到的软件语言设置只跟随系统。聊天可以直接要求用中文,但界面语言是另一回事,中文界面里也还能看到一些英文状态文字。

还有隐私这部分。我问过它相关问题,它给了一段解释,不过智能体对自己政策的回答,我觉得还是不能直接当作完整承诺。尤其准备连接更多个人数据之前,实际的数据设置和政策还得另外看。这次没有做深入核验,就不展开下结论了。

我想继续用的原因

这一轮下来,我最认可的两个地方,一个是它确实能去做事,而且查票时操作很流畅;另一个就是定制起来很自然。

尤其是那条 NASA 快讯。我看到它是英文,想要双语,说了一句,它就直接在页面里改好了。这个小过程让我觉得,AI 软件往定制化、客制化的方向走,确实有意思。

每个人想看的内容、习惯的表达方式、需要的详细程度都不一样。能在使用过程中随时说出这些需求,再很快看到变化,我会更愿意慢慢把它调整成适合自己的样子。

目前还只是刚开始用,自动快讯能不能一直合口味,记忆能不能越用越准确,长一点的任务能不能稳定完成,都还得继续看。

不过至少这次,我已经找到了愿意继续用它的理由。

讨论