https://linux.do 论坛的话题更新通知频道。
DT (@DT2025)DGX Spark 单机部署 Qwen3.8-27B:NVFP4 量化 + DSpark 投机解码实践 中发帖

最近手里搞到一台DGX Spark,上周看见Qwen3.8-27B出来了就顺手部署了一个,一开始直接用vllm跑了一下,感觉性能太差,decode只有个位数,就用ds调了几天,现在感觉差不多了,拿出来给大家分享下配置,有更好方案的佬友也可以给点建议 
1. 核心配置

镜像: lmsysorg/sglang:qwen38-27b
主模型: Qwen3.8-27B-NVFP4
draft 模型: RadixArk/Qwen3.8-27B-DSpark
投机算法: DSPARK,block size 7
KV cache: fp8_e4m3 · dtype: bfloat16 · 上下文: 262,144
注意力: flashinfer · prefill: chunked 8192
内存: mem-fraction 0.88

2. 测试结果
周末部署完成后又去找了几个官方测试用例,跑了一晚...
@yfeng_fly各位的giffgaff还能发短信吗? 中发帖

RT 各位的giffgaff还能发短信吗?刚刚试了发不出
念头通达 (@wangmg)关于帅API的使用问题 中发帖

上次看到帅API发邀请码,688一个邀请码,狠心买了发现买了之后还要自己充值LDC,又充值了150LDC,最后发现基本没法用,跑2句就报错/重连,连续试了一个周,发现基本用不了,800多LDC打水漂,倾家荡产了已经,现在用的是基元律动deepseek-v4-flash,奉劝大家买激活码的时候,一定慎重考虑! 
[image]
另外,之前还买了enjoytoken,花了130LDC,也是用不了,申请退款还被拒绝了,难绷…
[image]
在最后,还是要感谢K API,充了500LDC,一直用到现在还剩很多,而且比较稳定
[image]
duxiaoxiongdeepseek涨价,换别的模型用,还有必要用dsh吗 中发帖

手头上能用的套餐有codex、glm和opencode go,想和各位佬友讨论一下。前段时间一直在用pi,最近在用dsh。 
其实问题就是,非deepseek模型用dsh还有优势吗?
@ConstGPT-5.6 PRO 号池额度换一些 Kimi K3、GLM 5.3 额度 中发帖

如题,公司开了 GPT 号池给了一些额度用不完,想要换其他模型使用。 
如果有 Claude Opus 更好了
fakerVSbinopencode 的 dsv4f开始胡言乱语了 中发帖

我寻思我也妹问什么奇奇怪怪的东西啊? 😅 
[24df8a8950fd272c965082d8e169c456]
[323460ff78e12a4e028a3c37b7a02338]
大木博士 (@bahe)关于krill退款,如未退款的慎重 中发帖

按他们的退款来说,之前的活动赠金,即便你已经使用了,在最后的余额转化退款里,仍要扣除。就拿我的举例,在套餐未转化余额的时候,还剩下6块(也就是他们站内显示的6刀,这里算是赠金,没问题,确实是之前余额用剩的),后来周卡套餐转成余额后,总余额63.xx忘记了。实际退款到账15.74. 也是第一次见能追回历史赠金的 
[d04b5afcdbc4dbb2a51dd572082f8d40]
[image]
红框的是刚刚我刚刚问完后补上的,没退款的可以参考下,没什么必要退了
@jccGrok Bot是什么东西?是独立的额度池吗?还是和cursor或者grok build共用周限? 中发帖

好像开了grok heavy之后,送的这个东西 
要是独立额度池的话,感觉可以玩玩。。。要是和其他的共享的话,那就算了。。。
派大星 (@Patrick-Star)大佬们 有没有推荐公司用的AI 套餐和厂商 中发帖

大佬们 有没有推荐公司用的AI 套餐和厂商
NekoEcho让 ChatGPT 帮我排查 IDEA 卡顿,最后发现是 ChatGPT 把 IDEA 卡住了 中发帖

最近 Mac 上的 IntelliJ IDEA 频繁卡死,让ChatGPT分析日志排查了半天都没解决问题。 
后来发现把ChatGPT关掉就好了 🥲
问题与 ChatGPT 最近新增的 Computer History(计算机历史记录)功能有关。Computer History 会通过 macOS 的无障碍接口监听前台应用,而 VCS Log 的无障碍实现开销比较大,Git 历史较多时问题会更加明显。
[image]
目前解决方法:

关闭 Computer History,或者把 IntelliJ IDEA 排除在记录范围外。
在 IDEA 的自定义 VM Options 中加入:

-Dsun.awt.mac.a11y.enabled=false
teknosChatGPT 订阅账号可以使用 5.6-Sol 1M 上下文了 中发帖

[PixPin_2026-08-17_11-49-34] 
[PixPin_2026-08-17_11-49-58]

感觉和之前这篇帖子有关系,当时这个支持 1M 的回复下,很多人提醒他只有 API 可以用
[PixPin_2026-08-17_11-53-28]

这两天也有不少人回复他,订阅额度有问题,只是这老小子还在装傻
Leif Yang如何权衡公益站中的LDC流转 中发帖

本帖所述在于交易行为而非道德观念,已隐去相关站点名。 

—————————————————————————————————————————
个人不会用什么公益站该不该收LDC来做公益站的区分,实际上,收不收是无所谓的一件事,但好像很少有佬友意识到这点。
LDC不是钱,但它有所价值,并在L站中具有通用价值,那么,当我们使用它时,你需要意识到
我们正在做一种交易。
我以个人Hyper的小额交易账号为例:
[image]
对于交易,没有人能够确保未来的走向,但是我们能确保自身的投入是可以接受的范畴。
这里说一下个人对于公益站的理解:
对个人来说,早期的公益站和现今的一些公益站(如简直、企鹅……太多了不一一列举),就是典型的不对等交易,这类公益站,往往是站长所付出的,远大于成员所投入的,为此,一些夸赞可以说是再微不足道的一种代偿形式。
现今喧起的公益站与LDC之分,在于这种...
@orion2026严肃脸 , 17ai.xyz 能用来做什么 中发帖

刚才问过,画风跑偏了。(不是~ 
国内服务商买的,有实名认证,不考虑偏门,计划好好搞,需要考虑国内合规
gpt老师的意见:
[image]
cxuan (@cxuanAI)一招教你在 Codex 中开启 1M 上下文,但最好别用了还是 。。。 中发帖

今天早上,我看 tibo 发了一条推文。 
他告诉大家,现在你可以使用 1M 上下文窗口了,并且给出了两种设置方式。
[image-20260817092031686]
我相信不少小伙伴看到这个都爽飞了。1M 上下文拿到现在的大模型环境中,那还叫个事儿?但是放在 Codex 中,还是挺坎坷的。
不过我得泼点冷水,我自己研究了一圈,我发现这 1M 其实就是一个深坑。

我们先来说一下直接一次性设置的方式。
现在,你可以直接用在 Codex CLI 中通过下面这行命令直接设置 1M 上下文了,一次性说的是你这个 session 退出之后,1M 上下文就结束了。
codex -m gpt-5.6-sol \
-c model_context_window=1000000 \
-c model_auto_compact_token_limit=900000

可以看下,当前窗口...
@jrerrq美国豆包现在是纯摆烂注册机都不管了? 中发帖

咸鱼几块钱买个url点下就18个月pro了。gpt的羊毛可从来薅不到。
nanbloom001请问自部署的 qwen3.8 27B 可以有哪些用途 中发帖

我打算在4*A10 上部署一个 qwen3.8,请问佬友们能想到有哪些应用的场景?(第一次部署本地模型)目前想到: 
1.接入自己的个人网站,当一个讲解员。
2.轻量的编程任务(纯玩具)
3.Role Play(不知道上下文够不够)
有没有什么其他有趣的玩法
@yhe国产动画电影《牛来》票房突破 1000 万元,制作过于粗糙引发观看热潮 中发帖

[3741.png] 
8 月 17 日消息,据灯塔专业版实时数据,截至 8 月 17 日 11 时 6 分,国产动画电影《牛来》票房突破 1,000 万。
@winston321X上我喜欢收藏的帖子入口没了吗? 中发帖

[image] 
x网页版 是改版了吗 还是怎么? 我喜欢的入口没了?收藏了很多帖子 找不到入口了
@ywcaoai 订阅方案 中发帖

公司不提供ai,但是又要ai提效,有什么好的订阅方案最好吗,性价比高的
半口小希 (@aphoba)求推荐好用的Claude code skills 中发帖

目前就装了这几个 
frontend-design
superpowers
web-design-guidelines
ui-ux-pro-max
各位佬,还有推荐的嘛