大家好,这个教程是完全对于小龙虾源码的分析手册,让大家知其然,更知所以然,上一次帖子阅读不友好 从0到1做出一个小龙虾-3 https://wx.zsxq.com/mweb/views/topicdetail/topicdetail.ht...
同时知识星球也不怎么支持文件插入.html网页,为了让大家更好的阅读,我做成了飞书版本
https://my.feishu.cn/docx/RaSmdmqasoGSmLx3gpccjTaYnGe
直接用Claude Code 写了一个小程序,把html转成飞书文档
下面说说我对于小龙虾的看法,小龙虾本质是对Claude Code的封装,它把多个入口统一成一个入口,这样使用起来更方便,更友好。
但是目前的AI远远没有达到非常智能的水平,还是基于规则来进行执行,AI它不懂人类语言。
在春晚赵本山的小品 《不差钱》小品,赵本山问小沈阳,澳龙你们有没有?我们都能够听懂这句话的字面意思,因为这是人类语言。
那么如果你把问小沈阳的问题丢给AI,AI就宕机了,它是不清楚澳龙是澳州龙虾,也不清楚要回复有还是没有,人类的眼神信息,肢体信息没办法传递给AI,
美国心理学家阿尔伯特·麦拉宾(Albert Mehrabian)研究了非语言沟通,并提出了一个经典的公式:
55% 来自肢体语言(如表情、手势、姿势等)
38% 来自语调和声音(如语速、高低起伏、情绪等)
7% 来自语言内容本身(字面上的意思)
这意味着,在人际沟通中,听者更容易受到说话者的语气、表情和肢体动作影响,而不仅仅是语言本身的意思。
那么AI是怎么理解澳龙的呢?
澳龙一个词组,编成一个token,你们一个词组,编成一个token,有一个词组,编成一个token,没有一个词组,编成一个token。
也就是说,AI从来也不知道你在说啥,它只是看到了被编码放在一起的这堆token的id组合。
然后它怎么做呢?它看历史上同类情况下,人家是怎么回答的。
基于概率,给出它认为的最优解。
如果它学习的数据模型下,同类情况都回答有,它就倾向于有,反之就倾向于没有。
而你看小沈阳的回答。
大爷,这个真没有,这个可以有.......吗........
小沈阳是在回答有没有么?不是,他在看本山大叔的眼色,微表情这些。
因为这事儿很复杂,还牵涉到本山大叔要请客的对象的现场反应,还有很多很多作为店小二,他待人接物过程中要考虑的旁的因素。
这些察言观色,有没有办法都输入到电脑里,作为背景让AI去学习?
没有。
因为实际情况太多太复杂了。
那你说小沈阳是怎么学会的?
很简单,他在待人接物的过程中,耳濡目染,渐渐心领神会。
你注意这个词儿,心领神会。
人类能心领神会,你指望AI能心领神会?答案是目前还真做不到
AI学习的这个算法的底层逻辑,它需要什么?
它需要明说。
它需要拿到足够的数据库,才能根据概率,推测出问题的那堆token id对应的答案的token id是什么。
现实中,能明说么?
当然不能嘛。
因此不要想着AI万能的,不是所有事都能用AI来替代。
信息传递不一定是在台上的信息,不是明规则,有些是潜规则,既然是潜规则那么也就不方便当面说,目前做不到每个人的大脑上面装个电极,强迫人类像三体一样,心里想什么,一律上传互联网给AI训练用。
同时,既然是潜规则,既然不能说,那么AI就得不到训练数据,那么在基于潜规则这个领域,AI就SB了,
一些信息是靠眼神的,一个眼神,你就能听懂人家没说出口的话,你就能推测出几千万个token,你才能往上走。
你让AI怎么基于眼神学习?
它需要一切都被搬到台面上,变成题库,它才能基于概率算法进行训练。
因此AI也就只能止步于此了,说一说另一个问题,那就是token消耗的问题。
大多数人对于小龙虾的底层一无所知,有用的没用的,都用上,在软件行业有句话,20%的关键代码是80%的核心业务,只能知道小龙虾底层逻辑,你才能更好的合理的消耗token。
因此这次分享的这个飞书文档,让对小龙虾底层逻辑感兴趣的生财圈友可以看一看,飞书文档很长,可以慢慢看,但是请相信,只有这样沉得下心,耐得住寂寞,在后续跑SOP的时候,你才能省下一大笔钱,如果你跑的是定时任务。
当然了,每个人追求不同的,停留表面,不知道小龙虾底层原理的好处是大量浪费token,快速迭代,更快的给自己提效,这个前提是花更多的钱。
以上是我个人的观点,说得也不一定对,如果你有自己不同的见解,欢迎留下你精彩的评论。