https://linux.do 论坛的话题更新通知频道。
@Redwind 在 感觉目前harness对模型性能的影响还是太大了 中发帖
最近买了一年grok heavy,中等强度在grok build和cursor里蹬,偶尔用下omp。
体感上grok build的体验和codex sol差不太多,但是cursor和omp里就偶发性流口水
打算接下来有意识地收集一下流口水的session,后面集中分析一下
996 在 Qwen3.8-flash-next 成功本地部署4bit量化!仅单卡RTX3090 24G,128K上下文,27t/s,无MTP 中发帖
[image]
我的配置:RTX3090 24G +DDR5 32G + 2T固态硬盘
使用的模型: Qwen3.8-Flash-Next-AD-3.84bpw-IQ4_XS-M64
这个模型有很大一部分占空间的是 n-gram 表。
我用24G显存+32G内存放下了 45.8G,其他的39.1GB都放在了SSD里,上下文128K,
目前还没有MTP支持,速度在27t/s。
[image]
[image]
我现在更期待社区MTP草稿模型的更新,以及破限的4bit模型!
启动参数:
~/llama.cpp/build/bin/llama-server \
-m /root/models/AtomicChat/Qwen3.8-Flash-Next-AD-3.84bpw-IQ4_XS-M64-00001-of-00028.gguf \
-...
@sicko 在 这种宽带,算不算免费资源再售卖? 中发帖
由于近期宽带到期,原先的单宽带套餐已消失,淘宝上深圳有 399¥/1000M 一年单宽带
[PixPin_2026-08-27_14-10-55]
预约了上门安装,希望没有坑,给人感觉就是送的免费宽带 到我手上租用
Embroider7737 在 公司培训外部讲师推荐做ppt用库库ai 中发帖
就是百度文库的库库ai,创意模式,看了讲师演示生成的ppt 效果确实很顶,看论坛都没人讨论这个工具,就是需要付费,而且下载下来也可以编辑。
tristannn 在 求中转站推荐 中发帖
之前一直用的中转站最近涨价到0.5倍率了有点贵,然后这段时间也一直在找好的中转站,找了两个测了一下juice值,gpt5.6sol测出来是768,朋友说有点假960才是正常的,希望佬友们推荐一下好用稳定价格稍微便宜一点的中转站,感谢
小詹亡命天涯 (@NewDjangoZ) 在 锤子TNT 如果碰上AI时代 中发帖
看到有些佬友觉得打字和Agent进行交互有些浪费时间,我就联想到了锤子TNT这款当时被全网嘲讽的产品,当时罗永浩在发布会上用语音控制操作excel然后失误的名场面仍历历在目
理性讨论,锤子TNT是否有些生不逢时,如果这款产品诞生于近些年,用语音与AI agent进行交互,会不会成为一款爆品
[屏幕截图 2026-08-27 140036]
[屏幕截图 2026-08-27 140048]
ikuiros 在 GPT plus 5 小时限额漏网之鱼 中发帖
[image]
我的另一个号都出现五小时限额了。唯一的区别是,出现限额的号提前用了重置卡,这个号在5小时限额推广后还有重置卡。用了之后也没有5小时限额
ltx 在 GPT代充 session 安全问题 中发帖
各位佬友,我看代充都要发session,那他们会拿这个session直接去转换成例如sub2api的格式来刷我的额度吗?我看grok给我说甚至能不用密码直接登录?
[image]
有懂的佬友可以给解答一下吗?
汉堡特工 (@rikkely) 在 福建归属的联通大王卡,想更换一个大流量套餐有没有佬能办的 中发帖
[a683607121115e9612e6639315ffb582]
这是我现在的套餐和订购的业务,之前发携号转网挽留我给我加了个维A系的包,流量不够用想换个套餐,29-39都能接受 通用流量要100G左右吧 有没有能直接在这个号码上换套餐的
hud (@hudi) 在 关于菲区pro 20x套play和pay的退款问题 中发帖
想问问各位大佬,我打算开一个菲区的 Pro。
但我听说 Google Play 能够退款,而 Google Pay 好像退不了款,请问一下是这样的吗?
还有就是,如果要用 Google Play 的话,想开非区的 Pro,该怎么弄呢
LLMcoder (@kevin210) 在 Ollma Cloud 也上glm-5.3-flash了,量给的还可以。 中发帖
ollama cloud今天上的glm-5.3-flash, 测试了一下,速度没问题,用量还可以,默认思考强度的时候5h用量能到2000次请求, 后来开了max强度之后,5h也能到1300次请求。 我的平均上下文长度在60k左右。但是统计用量的时候发现ollama cloud可能是不带cache的,所以每次提交上下文长度要控制住,这是提升ollama用量的关键。
[image]
[image]
Arvin.zhang 在 IPhone17 IOS26.6 微信视频电话发烫问题 中发帖
IPhone17国行版 IOS26.6 每次微信视频电话必发烫,佬友们是否有同样的情况,是我买到翻新机了吗?怎么解决?
浅风 (@QianFuv) 在 神人 chatgpt app 中发帖
昨天引入的bug,今天修了,但是是全量重建,也没人告诉我他要复制半小时啊
[image]
附上昨天的诊断报告
chatgpt-app-codex-cli-msix-copy-failure-repair-guide.zip (11.8 KB)