找回密码
 立即注册
搜索
查看: 3292|回复: 26

[讨论杂谈] AI当前最大的问题还是记忆吧

[复制链接]
成绩
2
7
30
主题
帖子
积分

进度

一尾狐

资源
尾巴毛 : 24 根
狐火 : 62 团

发表于 2026-1-19 18:20:41 | 显示全部楼层 |阅读模式
RT,受Transformer的工作方式的影响,上下文只要过多就一定会出现遗忘或者幻觉,感觉这问题不解决的话在游戏行业还是很难推广,之前自己试着手搓了一个基于LLM的类era系统,结果只要经过天数一多就一定会开始各种神回,毫无体验...


目前市场上的主流解决方案都是想办法节省token,本质是缩短上下文,但感觉这个核心问题要是不解决,终究会是个巨大的挡路石..
成绩
272
2385
5127
主题
帖子
积分

进度

五尾狐

资源
尾巴毛 : 4052 根
狐火 : 8574 团

荷取芙兰咲夜玛丽女苑


Lv:100
发表于 2026-1-19 19:41:48 | 显示全部楼层
这跟transformer有啥关系……上文越多token越多,你来什么架构也算不过来啊
沙发 2026-1-19 19:41:48 收起回复
Atumr回复zhuzz 2026-1-22 21:14
回复 举报
简单来说,transformer是模型架构,AR/diffusion是利用这个架构进行训练/生成的方式

我看了下你上面提到的论文,2.2节第一句话就说了”LLaDA employs a Transformer [7] as the mask predictor, similar to existing LLMs.“
zhuzz回复Atumr 2026-1-22 12:47
回复 举报
transformer这种从左到右的才是自回归吧,不太确定你说的层级是指什么层级,不过从生成逻辑来讲的话,确实不同。
zhuzz回复steve 2026-1-22 12:34
回复 举报
https://arxiv.org/abs/2502.09992
这是论文链接,并不难理解,transformer是以字词为单位转换为向量进行计算,而diffusion model则是将整页的文字转为向量进行计算,当生成时,本质是在潜在空间中通过去噪,把随机的高斯噪声逐步还原为符合整页文本语义特征的视觉或向量表征。你说的根本逻辑是什么逻辑?从结果来看,都是在做文字生成,而且diffusion模型的确节省了大量的token,有什么问题吗?
Atumr回复zhuzz 2026-1-21 20:48
回复 举报
diffusion llm吗?那玩意对标的应该是自回归,和transformer不是一个层级的吧
steve回复zhuzz 2026-1-21 19:43
回复 举报
我是理解不了怎么用diffusion做大语言模型
从根本逻辑上就不是一个东西啊
还有 1 条回复, 点击查看
成绩
0
24
2727
主题
帖子
积分

进度

四尾狐

资源
尾巴毛 : 2722 根
狐火 : 73 团

大妖精

发表于 2026-1-19 22:25:23 | 显示全部楼层
人类的记忆往往间歇性总结重要事件,抛弃不重要的小细节……不知道什么时候会有这种能自动整理记忆碎片的AI
现在这种AI语言模型会把上下文中每一个字都完整带进去算,实在是太浪费算力和上下文了
板凳 2026-1-19 22:25:23 回复 收起回复
成绩
101
2142
3950
主题
帖子
积分

进度

四尾狐

资源
尾巴毛 : 3299 根
狐火 : 1831 团

红美铃玛丽紫苑女苑


风妖精 Lv:100
发表于 2026-1-20 00:10:59 | 显示全部楼层
哈基米有段时间倒是能五十万上文的感觉。现在远远不行了。3.0注意力太拉了只能等正式版看看会不会提升吧
地板 2026-1-20 00:10:59 回复 收起回复
成绩
11
133
2266
主题
帖子
积分

进度

四尾狐

资源
尾巴毛 : 2215 根
狐火 : 400 团

大妖精红美铃


大狼犬 Lv:38
发表于 2026-1-20 01:12:31 | 显示全部楼层
我认为这个问题其实不是单纯的记忆力问题。应该是总结能力和模糊记忆能力。除了目前人类认为患有“超常记忆综合征”的患者,普通的动物基本都是依靠模糊联想能力来保持记忆的。怎么总结归纳,才能用极少的字符命令调动庞大的数据库,可能是解决问题的办法。
5# 2026-1-20 01:12:31 回复 收起回复
成绩
86
1242
3288
主题
帖子
积分

进度

四尾狐

资源
尾巴毛 : 2850 根
狐火 : 4301 团

玛丽红美铃大妖精女苑


跳跳猪 Lv:13
发表于 2026-1-20 13:18:59 | 显示全部楼层
感觉现在各方面都差点,不光是记忆或者上下文,不知道还得几年才能玩到真正像游戏一样的AIrp
6# 2026-1-20 13:18:59 回复 收起回复
成绩
13
323
888
主题
帖子
积分

进度

三尾狐

资源
尾巴毛 : 795 根
狐火 : 2975 团

红美铃

发表于 2026-1-20 16:57:18 | 显示全部楼层
所以依靠上下文窗口进行记忆是十分困难的,要做到完美必须通过前端辅助记忆总结(比如外置角色卡和状态栏)
7# 2026-1-20 16:57:18 回复 收起回复
成绩
0
22
442
主题
帖子
积分

进度

二尾狐

资源
尾巴毛 : 438 根
狐火 : 26 团

大妖精紫苑

发表于 2026-1-20 17:16:28 | 显示全部楼层
我记得不是有记忆压缩方向的研究么? 可以用很短的一组向量压缩一大段记忆.

不过目前流行的似乎还是分段召回那一套.
8# 2026-1-20 17:16:28 回复 收起回复
成绩
0
24
769
主题
帖子
积分

进度

三尾狐

资源
尾巴毛 : 764 根
狐火 : 161 团

发表于 2026-1-21 11:40:02 | 显示全部楼层
可以看一下meta去年的研究,https://arxiv.org/pdf/2509.01092
9# 2026-1-21 11:40:02 收起回复
RATXU回复zhuzz 2026-1-22 11:17
回复 举报
另外我感觉要解决你的问题,可能需要agent根据背景去做推理,langGraph还挺好用的。
RATXU回复steve 2026-1-22 11:13
回复 举报
因为在看arxiiv的时候到论坛了()
steve 2026-1-21 20:40
回复 举报
为什么到论坛了还能看见arxiv()
zhuzz 2026-1-21 11:59
回复 举报
感谢指路!
成绩
0
4
63
主题
帖子
积分

进度

一尾狐

资源
尾巴毛 : 62 根
狐火 : 9 团

发表于 2026-1-21 20:15:33 | 显示全部楼层
感觉还得发展很长时间
10# 2026-1-21 20:15:33 回复 收起回复
请思考你是否真的想要回复本帖,▶你真的想要谢谢楼主吗?那就请回复有意义的内容
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|Kitsune Jinja |每日参拜

GMT+8, 2026-9-3 18:01 , Processed in 0.051148 second(s), 95 queries .

Powered by Discuz! X3.5

© 2001-2025 Discuz! Team.

快速回复 返回顶部 返回列表