https://linux.do 论坛的话题更新通知频道。
Miao (@SmartZZZ) 在 本地模型跑鹈鹕,效果还不错 中发帖
今天试了一下本地部署的Qwen3.8-27B-FP8,跑了一下鹈鹕,看着还可以啊
[image]
接到Pi里跑了大概十多分钟出来的
顺道问一下各位佬部署这块还有没有优化方案:
两张4090 24G配合VLLM部署,原生FP8,262K上下文,mtp开到2。速度大概32token/s
要换SGLang吗?还是换个其他量化版本? :tieba_001:
lucas (@lucasli) 在 有台空闲的3090可以拿来干什么呢 中发帖
我现在的工作环境是这样的 我平时在学校工位和在家都会办公,二者距离也很近,一台macbook 一台3090台式机,平时都是macbook ssh到集群,然后在集群里写代码,coding和提交训练,所有下载存储等活动都在集群,现在我想将家里负责打游戏的3090也搬到工位,不打游戏了,佬们认为我的3090应该装什么系统,可以拿来做什么呢在我的开发环境中应该占据什么位置呢,感觉有点对于都想把这台电脑卖了
mini小奥 (@minixiaoao) 在 gemini “我只是一个语言模型,不具备这方面的信息或能力,因此没法帮到你。” 中发帖
最近一段Gemini 总是这样的 有佬遇到过么 有的时候直接就回复这个 有的时候是回答内容已经跳了半天最后反馈个这个回复 然后再次输入让它回复正确的答复 它又能正常
求助一下各位佬 有什么办法 能让它正常么
[image]
@silkwa 在 cline的免费模型怎么添加到newapi里使用? 中发帖
[image]
[image]
如题,api地址填了https://api.cline.bot/api,模型填了glm-5.3-flash,请求头覆盖也填了{
“http-referer”: “https://cline.bot”,
“x-client-version”: “4.1.16”,
“x-platform”: “vscode”,
“x-client-type”: “cline-vscode”,
“x-platform-version”: “1.106.0”,
“user-agent”: “Cline/4.1.16”,
“x-title”: “Cline”,
“x-core-version”: “4.1.16”
},同样的配置在ccswitch里可以在codex里调用,newapi就是失败。
tom zhang (@tsshujing) 在 Atria Dawn Preview 最新模型,送1亿token欢迎来登 中发帖
Atria Dawn Preview 最新模型,送1亿token欢迎来登
[image]
泽阳 (@xuzeyang) 在 刚好看到有个减肥建议的贴,那我来立个flag 中发帖
由于这几年毕业上班了,各种胡吃海喝,从140直接彪到200左右了,从7月底开始意识到要开始减肥了,去了健身房,从7月底到现在9月16号,从197减到182了,立一个flag,希望元旦前,掉下160!!! 😶
Water21 在 [cc自动压缩]求助一下佬们 cc自动压缩的逻辑是啥呀 中发帖
最近用公司的api 用的cc的1M模型 之前都能正常用到700 800K上下文 最近经常在200 300k就自动压缩了 有佬遇到过这种情况吗
yuyucos 在 相同的提示词发现豆包生成PPT优于codex(加了PPT生成skill) 中发帖
相同的提示词发现豆包生成PPT优于codex(加了PPT生成skill)
感觉豆包生成PPT还是有一手的
Neptune (@Neptune1) 在 问下佬友们,codex首字速度和任务难度有关系吗? 中发帖
是不是因为我上一小时任务比较大不确定性高,所以首字慢,刚才问了个简单问题首字又是开始很快 ,还是刚才被风控,现在又好了。我看有不少佬直接503,我一直没有哎。
[image]
heymeow 在 野榜一万多票了 astra还是稳居第一 中发帖
[Screenshot_2026-09-16-17-13-58-22_40deb401b9ffe8e1df2f1cc5ba480b12]
阿斯特拉大人真强吧,六边形战士
Eureka001 在 GPT6 最逆天的降智测试 中发帖
提示词:
在html中用svg画一个骑穿着中世纪铠甲的北极熊的普通夜鹭背着一个骑着黑色涂蜡的氧化的铜制自行车的橘色嘴巴里面刁了只大肥鱼的鹈鹕在梵高的发生了超新星爆发产生的陨石砸中了地面的一个脑袋上有只巨型竹节虫正在发射原子弹的恐龙的星空的背景下飞翔被后面的一个秦始皇站在一架挂载了霹雳12的f14的机翼上面在拿着被锯短的独头弹猎枪追逐时撞到了天上的一个悬空的上面瘫坐了个奥特曼的黄金椅子,画面尽量精美
GPT6 Astra Max:
[image]
ocarol 在 你们用的GPT是自己花钱,还是公司花钱? 中发帖
我们是小公司,目前自费控制在每月200元左右,完全不够用,又不想花更多的钱…
看到你们很多人订阅使用GPT Pro 20X 好羡慕~都这么舍得花钱吗?
@jcc 在 openai可能发现,降智虽然能在降智用户那里省算力,但是不降智的人也整天画鹈鹕,反而负载更大了 中发帖
现在他们可能研究出来了新的省算力的手法
没风控的号保证不降智,风控的号直接报错不让用了
这样,在风控的用户那里能省算力,暂时没有被风控的用户,也不用担惊受怕,每小时画一次鹈鹕了