TGFC俱乐部>>完全数码讨论区>>
- 翻页: ##1 ##2 > (1/2页)
- 刷新/显图/登录/注册/WEB
标题:以后确实内存越大越好,没上限
时间:26-06-17 16:52
作者:随便走走

posted by wap, platform: Firefox
什么16G够用,24G舒服都过时了,就是越大越好,哪怕不是做开发的

最近和chatgpt聊天,聊一会就给我干到10G左右,出词都一卡一卡的,想想这个估计也没办法解决,未来趋势AI就是一个人工大脑,什么都要存在内存里最快,不可能思考过程还要读硬盘

普通人哪怕只用线上模型,未来的上下文窗口也是海量的,日积月累,这种体验很好,记忆的时间和内容越多越好,都是内存





回复列表 (52)
#2 爱猫咪的薛定谔 2026-6-17 17:08
posted by wap, platform: Android
上下文为啥要占用很大内存?

而且你用chargpt为啥要用本地内存?

本帖最后由 爱猫咪的薛定谔 于 2026-6-17 09:08 通过手机版编辑

===================
#3 dzgxg 2026-6-17 17:11
posted by wap, platform: MAC OS X
网页版的chatgpt确实卡,尤其是富媒体内容多了之后

===================
#4 hqqttjiang 2026-6-17 17:13
果然 负激骚 是有意义的

===================
#5 爱猫咪的薛定谔 2026-6-17 17:15
posted by wap, platform: Android
原帖由 @dzgxg 于 2026-6-17 09:11 发表
网页版的chatgpt确实卡,尤其是富媒体内容多了之后
为啥会占用本地内存?

===================
#6 dzgxg 2026-6-17 17:23
posted by wap, platform: MAC OS X
原帖由 @爱猫咪的薛定谔 于 2026-6-17 17:15 发表
为啥会占用本地内存?
网页占用啊,可以看到内存占用的,不管是gemini还是本地部署的openwebui,对话长了,占用的内存都会显著上升,gemini算优化比较好的,我最多用到过3g,然后切换到空对话闲置一段时间会降低回到几百m。所以网页使用ai比较适合用pwa方式,可以单独退出ai占用不影响其他页面



===================
#7 爱猫咪的薛定谔 2026-6-17 17:33
posted by wap, platform: Android
原帖由 @dzgxg 于 2026-6-17 09:23 发表
网页占用啊,可以看到内存占用的,不管是gemini还是本地部署的openwebui,对话长了,占用的内存都会显著上升,gemini算优化比较好的,我最多用到过3g,然后切换到空对话闲置一段时间会降低回到几百m。所以网页使用ai比较适合用pwa方式,可以单独退出ai占用不影响其他页面
原理是什么?我想不出有什么内容会占用内存,手机版一样用,也没说对配置有要求啊

===================
#8 sigmaxion 2026-6-17 17:37
posted by wap, platform: VIVO
也就是以后的大宗消费不再是房车而是内存了么,人均100PB走起,祖宗十八代的陈谷子烂芝麻破事都要记得牢牢的

===================
#9 爱猫咪的薛定谔 2026-6-17 17:44
posted by wap, platform: Android
原帖由 @sigmaxion 于 2026-6-17 09:37 发表
也就是以后的大宗消费不再是房车而是内存了么,人均100PB走起,祖宗十八代的陈谷子烂芝麻破事都要记得牢牢的
现在商用的模型最大上下文也就百万token,存了也用不了

===================
#10 查理王 2026-6-17 17:49
posted by wap, platform: iPhone
我现在用的64G,确实用不完,开几个虚拟机也还剩很多

===================
#11 随便走走 2026-6-17 17:57
posted by wap, platform: iPhone
原帖由 @爱猫咪的薛定谔 于 2026-6-17 17:08 发表
上下文为啥要占用很大内存?

而且你用chargpt为啥要用本地内存?

本帖最后由 爱猫咪的薛定谔 于 2026617 09:08 通过手机版编辑
你用过客户端吗,没用就杠?至于为什么,你去问OpenAI啊

===================
#12 爱猫咪的薛定谔 2026-6-17 18:05
posted by wap, platform: Android
原帖由 @随便走走 于 2026-6-17 09:57 发表
你用过客户端吗,没用就杠?至于为什么,你去问OpenAI啊
你说说看啊,为啥会占用内存,那用网页版会怎么样

===================
#13 爱猫咪的薛定谔 2026-6-17 18:05
posted by wap, platform: Android
原帖由 @随便走走 于 2026-6-17 09:57 发表
你用过客户端吗,没用就杠?至于为什么,你去问OpenAI啊
你说说看啊,为啥会占用内存,那用网页版会怎么样

===================
#14 bsseven 2026-6-17 18:09
posted by wap, platform: Android
确实,我云游戏,一开光追,立马爆内存了,估计那光线太多,网速不够传输

===================
#15 随便走走 2026-6-17 18:10
posted by wap, platform: iPhone
原帖由 @爱猫咪的薛定谔 于 2026-6-17 18:05 发表
你说说看啊,为啥会占用内存,那用网页版会怎么样
网页版我很久没用了,客户端原理很简单,一个对话session的全部聊天都在内存里,因为每一轮对话模型实际上都会根据历史对话形成上下文输入,所以全部对话都在内存里,你关掉重开就没有了,我最多一次都20多g了,都是最新版本。

===================
#16 爱猫咪的薛定谔 2026-6-17 18:17
posted by wap, platform: Android
原帖由 @随便走走 于 2026-6-17 10:10 发表
网页版我很久没用了,客户端原理很简单,一个对话session的全部聊天都在内存里,因为每一轮对话模型实际上都会根据历史对话形成上下文输入,所以全部对话都在内存里,你关掉重开就没有了,我最多一次都20多g了,都是最新版本。
上下文最多才百万token,而且在服务器端,本地要这数据没有用处,实在看不出占用g内存的理由

===================
#17 ginaamix 2026-6-17 18:37
posted by wap, platform: Chrome
就是codex优化不行

===================
#18 随便走走 2026-6-17 19:02
posted by wap, platform: Firefox
原帖由 @爱猫咪的薛定谔 于 2026-6-17 18:17 发表
上下文最多才百万token,而且在服务器端,本地要这数据没有用处,实在看不出占用g内存的理由
token是token,缓存是缓存,token不会平白无故产生,其实还是来着缓存, 这是很明显也很好理解的

而且随着智能体上下文空间越来越大,记忆内容肯定也越来越多,缓存必然也会相应膨胀

===================
#19 随便走走 2026-6-17 19:05
posted by wap, platform: Firefox
原帖由 @ginaamix 于 2026-6-17 18:37 发表
就是codex优化不行
你告诉我哪个agent或harness不占内存的,我现在就去换

===================
#20 yfl2 2026-6-17 19:22
原帖由 随便走走 于 2026-6-17 19:02 发表
posted by wap, platform: Firefox
token是token,缓存是缓存,token不会平白无故产生,其实还是来着缓存, 这是很明显也很好理解的

而且随着智能体上下文空间越来越大,记忆内容肯定也越来越多,缓存必然也会相应 ...

缓存在服务端,本地缓存有啥用?
而且缓存是为了再次命中,缓存大只会加快速度(如果命中就不需要重新算了),怎么会越来越慢?

===================
#21 yfl2 2026-6-17 19:24
原帖由 随便走走 于 2026-6-17 19:05 发表
posted by wap, platform: Firefox
你告诉我哪个agent或harness不占内存的,我现在就去换

llm不占用啊,比如豆包...



===================
#22 yfl2 2026-6-17 19:34
长对话卡顿的核心原因在于网页 DOM 节点过多。随着消息气泡、代码块、公式、图片及交互按钮的累积,浏览器在重排版、样式计算和内存管理上的压力显著增加。尤其是超过 30 至 50 轮的对话,离屏消息仍占用大量节点,导致交互性能下降。


喷了,和大模型上下文和缓存都没关系,就是页面太大了

===================
#23 pocketmom 2026-6-17 19:37
posted by wap, platform: Android
1t内存的路过,跑本地deepseek模型只有18tokens

===================
#24 随便走走 2026-6-17 19:54
posted by wap, platform: iPhone
原帖由 @爱猫咪的薛定谔 于 2026-6-17 18:05 发表
你说说看啊,为啥会占用内存,那用网页版会怎么样
网页版我很久没用了,客户端原理很简单,一个对话session的全部聊天都在内存里,因为每一轮对话模型实际上都会根据历史对话形成上下文输入,所以全部对话都在内存里,你关掉重开就没有了,我最多一次都20多g了,都是最新版本。

===================
#25 ginaamix 2026-6-17 20:06
posted by wap, platform: Chrome
cc和codex的聊天记录默认都是存在本地jsonl文件里,一个session撑死100MB不到,又不是本地跑LLM存kv cache哪里要这么多内存
codex肯定是有不少内存泄漏bug,随便一搜都是内存被吃满的例子
https://www.reddit.com/r/codex/comments/1tyiz7g/possible_codex_memory_leak_42gb_ram_usage_on_m4/

===================
#26 随便走走 2026-6-17 20:14
posted by wap, platform: iPhone
原帖由 @yfl2 于 2026-6-17 19:34 发表
长对话卡顿的核心原因在于网页 DOM 节点过多。随着消息气泡、代码块、公式、图片及交互按钮的累积,浏览器在重排版、样式计算和内存管理上的压力显著增加。尤其是超过 30 至 50 轮的对话,离屏消息仍占用大量节点,导致交互性能下降。


喷了,和大模型上下文和缓存都没关系,就是页面太大了
那为什么要留这些页面在内存里呢,你要不要再多问问ai

===================
#27 dreamlost 2026-6-17 20:18
posted by wap, platform: Firefox
这种模型在远程 本地还占用那么多内存的话 肯定是有内存泄漏了

===================
#28 yfl2 2026-6-17 20:27
原帖由 随便走走 于 2026-6-17 20:14 发表
posted by wap, platform: iPhone
那为什么要留这些页面在内存里呢,你要不要再多问问ai

你看看别人说的就知道了
你说的缓存什么都不在本地,和上下文也没有关系

这个程序不在意你本地的内存,它又不像微信只显示少部分内容,其他随着滚动再读取,所以导致当前页面不断膨胀,实际上,上下文早就不在了

[ 本帖最后由 yfl2 于 2026-6-17 20:28 编辑 ]

===================
#29 随便走走 2026-6-17 22:53
posted by wap, platform: Firefox
原帖由 @yfl2 于 2026-6-17 20:27 发表
你看看别人说的就知道了
你说的缓存什么都不在本地,和上下文也没有关系

这个程序不在意你本地的内存,它又不像微信只显示少部分内容,其他随着滚动再读取,所以导致当前页面不断膨胀,实际上,上下文早就不在了

上下文其实就是模型的记忆,记忆也分长期记忆和短期记忆,最终的上下文和长期记忆在云端没问题,但短期记忆很可能还是依赖本地,我试过切换一下设备,同账号比如从桌面端到手机端,模型对刚刚提到的内容都健忘失忆了

因此本地缓存和短期记忆还是有关的,不会完全不参与模型交互

===================
#30 yfl2 2026-6-17 23:06
原帖由 随便走走 于 2026-6-17 22:53 发表
posted by wap, platform: Firefox
上下文其实就是模型的记忆,记忆也分长期记忆和短期记忆,最终的上下文和长期记忆在云端没问题,但短期记忆很可能还是依赖本地,我试过切换一下设备,同账号比如从桌面端到手机端, ...

本地没有记忆,因为不参与计算,只是让你看聊天历史而已,存硬盘上也不影响

你切换设备失去上下文,是因为服务方就是这么设置的,同一设备新开一个窗口,上下文都能清空

你想想看,你本地10g“短期记忆”,给openai处理吗?233

[ 本帖最后由 yfl2 于 2026-6-17 23:08 编辑 ]

===================
#31 焚岚 2026-6-17 23:50
posted by wap, platform: iPhone
鸡同鸭讲。

===================
#32 richiter 2026-6-18 06:47
posted by wap, platform: Android
内存有没有上限不知道,有些没下限是真的,233

===================
#33 shoukon 2026-6-18 07:20
posted by wap, platform: iPhone
笑死,我 16G 内存的 Mac mini M4,使
用 Codex 做本地Vibe Coding开发,整个系统做好并且部署上服务器了,也一点都不卡
你和 ChatGPT 聊天聊点什么能够聊到 10 个 G

===================
#34 dragong 2026-6-18 08:19
手机都能用,怎么可能对电脑内存有要求

===================
#35 jidatui 2026-6-18 08:53
posted by wap, platform: Android
我用的64g内存,就是上网和看片

===================
#36 cc0128 2026-6-18 15:31
posted by wap, platform: iPhone
原帖由 @爱猫咪的薛定谔 于 2026-6-17 18:17 发表
上下文最多才百万token,而且在服务器端,本地要这数据没有用处,实在看不出占用g内存的理由
服务器存的是kv cache,本地的harness提供的context非常重要。

===================
#37 yfl2 2026-6-18 15:42
原帖由 cc0128 于 2026-6-18 15:31 发表
posted by wap, platform: iPhone
服务器存的是kv cache,本地的harness提供的context非常重要。

看不懂,楼主用的是chatgpt的客户端,也没有用agent,所以你说的harness是干嘛的,而且这也不占用什么内存啊

===================
#38 Adriatico 2026-6-18 20:54
posted by wap, platform: Samsung
确实,现在ue5游戏内存爆的比显存还快

===================
#39 Lucifer6E 2026-6-19 11:42
posted by wap, platform: iPhone
这贴让我想起存片了,好久没见他了

===================
#40 lvcha 2026-6-19 15:32
posted by wap, platform: Firefox
扯淡呢。

===================
#41 haihai6 2026-6-30 15:19
posted by wap, platform: Chrome
网页版chatgpt确实,页面长了就卡,优化十分垃圾。 但是我感觉跟本地内存大小没关系,我48g内存,占不满也很卡。开新的对话就不卡了



===================
#42 香蕉一号 2026-6-30 17:00
posted by wap, platform: Chrome
原帖由 @Lucifer6E 于 2026-6-19 11:42 发表
这贴让我想起存片了,好久没见他了
疫情前永封了。

===================
#43 taishen001 2026-6-30 17:35
posted by wap, platform: Android
道理都懂,问题是钱包允许不?

===================
#44 sceic 2026-6-30 17:48
原帖由 shoukon 于 2026-6-18 07:20 发表
posted by wap, platform: iPhone
笑死,我 16G 内存的 Mac mini M4,使
用 Codex 做本地Vibe Coding开发,整个系统做好并且部署上服务器了,也一点都不卡
你和 ChatGPT 聊天聊点什么能够聊到 10 个 G


这个比喻不合理,相当于有钱老板说钱雇人搞定一切,他一条内存都不买。

[ 本帖最后由 sceic 于 2026-6-30 18:18 编辑 ]

===================
#45 wifi王道 2026-6-30 20:15
银行存款也是越多越好

===================
#46 盖茨比兄贵 2026-7-9 13:44
posted by wap, platform: iPhone
三种可能:
1. ChatGPT这个AI设计的太low逼
2. ChatGPT这个AI的客户端太low逼
3. 楼主是内存贩子

排名不分先后

===================
#47 cyxss 2026-7-10 16:43
其实我理解楼主,我也遇到过,用edge和gemini聊天,在同一个session里,每天都有新问题追问,大概有个3、4天吧,那个session就明显卡顿了,新开个session就不卡了。
然后还有用可画canva也是,理论上各种运算都是在云端啊,都不用高级功能,就是简单的涂层拖拽都明显的卡顿。
我那个Y9000P+3070ti+32g再弱鸡,也不至于这样才对,一只不知道为啥:泥鹅满地打滚:

===================
#48 dzgxg 2026-7-10 16:58
posted by wap, platform: MAC OS X
原帖由 @cyxss 于 2026-7-10 16:43 发表
其实我理解楼主,我也遇到过,用edge和gemini聊天,在同一个session里,每天都有新问题追问,大概有个3、4天吧,那个session就明显卡顿了,新开个session就不卡了。
然后还有用可画canva也是,理论上各种运算都是在云端啊,都不用高级功能,就是简单的涂层拖拽都明显的卡顿。
我那个Y9000P+3070ti+32g再弱鸡,也不至于这样才对,一只不知道为啥:泥鹅满地打滚:
页面渲染占用的系统资源,markdwon、富媒体这些都占用很多内存,同样的对话量,放cli里会好很多很多,但不方便,而且很多对话也必须需要渲染才能有清晰格式显示

===================
#49 cyxss 2026-7-17 14:33
原帖由 dzgxg 于 2026-7-10 16:58 发表
posted by wap, platform: MAC OS X
页面渲染占用的系统资源,markdwon、富媒体这些都占用很多内存,同样的对话量,放cli里会好很多很多,但不方便,而且很多对话也必须需要渲染才能有清晰格式显示


但是我当时看,内存也并没有吃满,可能占用在16g左右吧,一直很奇怪
还是谢谢回答。

===================
#50 realsquall 2026-7-18 10:26
所以现在笔记本加了一根32G内存,目前64G内存 12G 5070ti,勉强够用了

===================

1/2页 ##1 ##2 下页


[登录后才可回复]