https://linux.do 论坛的话题更新通知频道。
liango (@hhl) 在 求助,sub2api对接上游,TTFT首字总多上1至10秒 中发帖
[ScreenShot_2026-09-03_104921_954]
[ScreenShot_2026-09-03_104901_653]
各位佬们,请教下,我和上游都是sub2api,同个请求,我面板上比首字慢很多,大部分是1-2秒,20%的情况是大4-10秒。
我的服务器性能cpu30% 内存7% 应该不是性能问题
我的服务器在韩国、上游在加拿大,通过somkePing监测,ping值非常稳定132ms,0丢包。
我面板在开启安全审查之前,就有这个情况了,所以应该也不是因为前置审查。
各位佬,求助…提供点解题思路
@kekeup 在 【板块申请】1818黄金眼 中发帖
板块简介:个人感情、职场琐事。
申请理由:人类对吃瓜有着非常旺盛的需求,最近关于感情问题的好多,引发帖子质量争议,屏蔽的话搞七捻三、纯水担心会误伤一些有趣帖子,所以申请此板块。
ambu5h 在 国产Flash模型最近也出了一波了,目前哪个性价比最合适 中发帖
自打deepseek-v4-flash发布之后,各家国产模型也都跟进了一波自家的flash档模型。
目测看起来都蛮有性价比的,而且实际的效果看起来也都比早期的低端模型强很多,最起码能干活了。(之前用claude-haiku和gemini-flash的时候感觉跟旗舰模型差的太多了)
但是随着近段时间各家的订阅都在加价不加量,还有coding plan变成token plan等种种情况。以前那种闭眼随便用的安心感就消失了。
故在此想请教下佬友们,根据大家的了解,有什么推荐的flash档模型和性价比渠道推荐吗
(目前我了解到的主要就 qwen-3.8-flash/glm-5.3-flash/deepseek-v4-flash/gpt-5.6-luna/gemini-3.8-flash
阿里的qwen-3.8-flash看着风评还不错,但千问的plan经常在站里看到避雷贴
字节的方舟t...
@xixiv5 在 论"帖子质量差"及我的解决方法 中发帖
从 帖子质量越来越差 继续讨论
按照我的理解,L站是一个“社区”,而且是“理想型社区”,而不是“技术社区”
作为“社区”就会有各种各样的声音。以前社区的人以技术极客居多,但随着社区慢慢壮大,形形色色的人都来到了这里,不同的声音也越来越多。
我也能理解佬友们喜欢在L站发非技术贴的心情,现在的互联网风气太糟糕了,有些情感贴如果是发到小红书/微博我都不敢想评论区会有多精彩,但在L站,佬友最多只是调侃调侃,甚至会给很多真正有用的建议。
我觉得,真正的问题不是L站变了,而是过滤机制并不完整 —— 帖子只能进行简单的过滤,人多了,声音多了,但不是所有佬友都想听各种各样的声音。
我的解决方法是做了个高级过滤器。至少对我来说,很有用。我能高亮置顶到我想要的所有开源项目帖,不管它属于搞七捻三还是开发调优;我也能过滤所有情感类的帖子,如果我真的想看,也能到已过滤的列表里一个个浏览。
有意义的是这个...
Frank Cheung (@Frank33) 在 提醒一下各位佬,腾讯云周年庆,续费真的很划算 中发帖
1年前不懂事,用券续费两年花了差不多 1800
没想到周年庆 189 一年,拼团还可以多送 3 个月
[4a73edcf0b888be4ec69f225540aedf1]
[df47e233609920fe601aed897b7edd97]
腾讯云客服小姐姐发过来的链接
叫我杰克马 (@jack_cui) 在 luna-max是现在综合能力-性价比之后最好用的模型吗? 中发帖
sol实在顶不住用量,最近一周都在用luna-max,体感上觉得产出的代码也没什么问题。
所以考虑一下看是否可以用能力接近的国模能直接平替替代了。
结果搜寻一番佬们的帖子,发现国模貌似在能力上比luna差点,价格相比也不便宜?
所以说完全没有用国模替代的必要?
🐟 (@stevessr) 在 五角大楼发布关于强制性部队睾酮检测的指导意见 中发帖
[!quote]+
五角大楼今天发布了详细的指导意见,针对 30 岁及以上的现役和预备役军人制定了一项新的强制性睾酮缺乏症筛查政策,这是对国防部长皮特·赫格塞斯 7 月份宣布的后续行动。
该指导方针立即生效,为男性和女性建立了标准化的筛查和治疗途径。五角大楼表示,此举旨在通过识别和管理激素和能量可用性问题来提高军事战备水平。
一直倡导使用睾酮的赫格塞斯上个月宣布了这项强制令,引发了专家们对该政策是否有科学依据的质疑。美国食品药品监督管理局计划在9月中旬召开专家会议,讨论睾酮的医疗用途。
根据该指南,30 岁及以上的男性将接受强制性睾酮血液检查,而年轻男性只有在提出要求或临床医生发现警告信号时才会接受检查。
对于女性而言,该指南并未强制要求进行常规睾酮血液检查,但要求筛查疲劳和月经周期紊乱,这些症状可能与激素失调以及运动中所谓的低能量可用性和相对能量不足有关。
该文件列出了...
🐟 (@stevessr) 在 谷歌击败美国强制出售广告技术的努力 中发帖
https://www.bloomberg.com/news/articles/2026-09-02/google-avoids-ad-exchange-sale-as-judge-orders-tech-integration
🐟 (@stevessr) 在 高通即将推出的高端芯片配备了Adreno“神经融合”GPU 中发帖
[!quote]+
继高通详细介绍了将应用于下一代旗舰骁龙芯片的**核心 Oryon CPU**之后,这家芯片制造商又发布了其下一代 Adreno 神经融合 GPU。
高通的下一代SoC将是首款在图形处理流程中配备专用AI GPU核心的芯片组。这些所谓的“矩阵核心”紧密地嵌入到全新Adreno GPU的三个1.45GHz GPU芯片中。高通表示,它们作为专用的本地硬件,“直接在图形处理流程中运行高级AI模型”。
骁龙芯片的Adreno GPU还将配备一个专用的18MB HPM(高性能内存)缓存。这个容量听起来不大,但高通表示,其HPM“可直接向GPU提供大容量、低延迟的内存,从而实现基于图块的渲染”。
帧缓冲区和计算工作负载将保持在图形子系统本地。”
新核心架构中的这两个组件共同构成了完整的 Adreno 神经融合 GPU。对于最终用户而言,启用该技术后,功耗可降低 40%...
Paranoia Gu 在 为什么我用llama.cpp部署的Qwen3.8-27B,思考链里面全是英文 中发帖
我尝试用系统提示词让模型全部用中文,也没有用。
但是用阿里云官网的就没有问题,妥妥的中文。
难道真的和部署有关?
对了我是用的:unsloth/Qwen3.8-27B-GGUF
难道和量化有关?