欢迎光临
我们一直在努力

微信支付AI工具箱2.0来了,但Mermaid图才是真亮点

我前几天在想一个问题。

微信支付发了AI工具箱1.0,让AI帮你接支付。逻辑很顺,你告诉AI「我要接小程序支付」,AI读文档、写代码、调通接口,你不用碰文档。

但等等,AI怎么读文档?

微信支付的文档里有很多时序图、状态图,都是图片或者HTML渲染的图表。大多数模型,尤其是那些没有多模态能力的模型,根本看不懂。它们看到的不是「图」,是一堆alt标签或者乱码。

所以1.0的实际体验是,AI能读文字,但读不懂图。涉及状态流转、回调时序这些核心逻辑的地方,AI大概率会猜,猜错了你还得自己看文档。

然后今天,微信支付发了2.0。

我仔细看了一眼升级点,发现有一个改动特别小、但特别聪明的,把文档里所有时序图和状态图全部转成了Mermaid格式。

这个改动,比它听起来重要得多。

先说Mermaid是什么。它是一种用代码画图的格式,长这样

图片

任何模型都能读懂这段代码,因为它就是文本。不需要多模态能力,不需要看图,直接按行读就行了。

原来的HTML图表呢?对模型来说是一团节点嵌套,它要先把HTML渲染成「图」这个概念,才能理解时序关系。没有多模态能力的模型,这一步就卡住了。

转成Mermaid之后,整体Token消耗比原始HTML降低50%。两个原因,Mermaid格式本身比HTML精简得多,模型理解Mermaid需要的Token也比理解一张图片少得多。

嗯,这个设计思路其实挺反直觉的。大多数人做AI友好文档,第一反应是「加多模态支持,让模型能看图」。微信支付选了另一条路,把图变成文本,让所有模型都能读。

说回正题,这个改动解决了1.0时代一个很真实的问题。你有了一个Skill,Skill能读文档,但文档里的关键逻辑藏在图里,模型读不懂,Skill的输出就只能靠猜。猜错了,你还是得自己看文档。

2.0把这个问题在源头上解决了。

赞(0)
未经允许不得转载:171主机测评 » 微信支付AI工具箱2.0来了,但Mermaid图才是真亮点
分享到: 更多 (0)

评论 抢沙发

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址