https://linux.do 论坛的话题更新通知频道。
Atyue分享一个巴西PP 中发帖

给大家分享一个手工注册的巴西PP,提链用的是站里的佬分享的。未接码。有需要的自取: 
PuleraMero80@outlook.com----u9ZSQsLnr3OL----9e5f94bc-e8a4-4e73-b8be-63364c29d753----M.C546_BL2.0.U.-ClmdPyqaD4YsAZfrVlVlo4a!9FyQvV42iNUWNWmqTeKu44zGjYmvmta6!!2h2um9IE5hQZjKEA85RehSsPbK!jjwN0QypeDy6!VBWngogqZU3sOClEJqQiJGZOvHkaI7EfPsnH0l1tyCMEqeHrsiOvhijOo7n93DlCpqj169oV!bS7TYs1wXRozr1envbIOt1tpHpUTznS2chUZVmMXgFdYKFcrdvghvmagoyP4CLhINL6A0nOehdUkVgMgs07oEu...
璞梵 (@pufanasa)A/越来越不当人了,接下来中转的价格估计也要起飞了 中发帖

说实话,小弟使用了这么多模型,在编程上还是A/模型能打,但是总封号,中转又掺水,不知道接下来何去何从呀
Youbiao He (@hybtalented)本地 V100 跑模型,LMDeploy 和 llama.cpp 怎么选?求建议 中发帖

目前在 V100 上做本地模型推理,主要试了 LMDeploy 和 llama.cpp,各有优劣,有点纠结,想听听大家的经验。 
LMDeploy:推理速度确实快,性能优势明显,但 Hugging Face 原生支持的模型格式偏少,很多模型需要额外转换或适配,遇到非主流模型会比较折腾。
llama.cpp:兼容性很强,GGUF 格式基本通吃,社区模型资源丰富。但 prefill 阶段速度明显偏慢,而且并发上来后显存压力很大,为了不爆显存,只能压缩每个会话的上下文长度,这又影响了长文本场景的体验。
目前卡在“速度”和“兼容性”之间取舍,想请教大家:


有没有办法在 llama.cpp 里优化 prefill 速度或显存占用?


或者 LMDeploy 有没有办法扩展更多模型格式的支持?


还是说这个场景下有其他更合适的推理框架推荐?


先谢谢各位大佬了!🙏
walkmansk写小说或者写文章比较好的模型是什么 中发帖

如题,想问一下各位佬,写小说或者写文章,比较好的模型是什么。 
背景是这样的
用gpt经常看不懂他在说啥,就去查了查
[6efbd38bb7310ba12cf45a916c01eeae]
这种不透明推理导致我不能直接用gpt出来的结果去写文章
还得调提示词
想问问各位佬,有没有直出的比较说人话的模型
joyful_1314各位佬友请教下积分支付点击提示正在跳转支付然后就报错了。。 中发帖

[image] 
[image]
[image]
[image]

{"error_msg":"record not found","data":null}

是我哪个流程操作错了吗 ?谢谢各位佬友 🙏
@huoxicaigmail邮箱从哪里可以获得有价格比较合理的渠道吗 中发帖

gmail邮箱从哪里可以获得有价格比较合理的渠道吗
wendyfe求推荐:跨设备远距离文件传输web端 中发帖

如题,求问各位大佬,最近需要在异地进行两台设备之间的文件的传输,文件不是很大,有没有网页平台可以实现的?我现在的方法是用登录QQ进行传输,但是太不方便了。然后在那个谷歌上也找了一些项目,但是那些项目可以上传,却不能在另一个设备上进行下载。
Cheng (@iquanzhan)48team英国车,子号掉了,统计一下情况 中发帖

7.1的英国11英镑车今早发现子号被封了。 
主要是放到sub2api反代,新账号,未接码,使用的令牌登录。
周限额50%左右。
母号在一样的环境现在还没掉。
@ranyong_lar小学加减乘除算术题生成器V3.5版 中发帖

先看图




最新升级的3.5版本,新增“中括号”功能,界面重新排版,修正了部分错误。



[image]
下载地址:

密码:6k0t下载地址:

密码:6k0t
ArispexPlasma One 还能上车吗 中发帖

尝试了大陆的身份证或者护照 kyc 都提示“This document type is not accepted for verification in this country. The accepted documents for this country include:”
@zhiqing量化模型说话暂停,辫子抽都不动 中发帖

这种情况是不是量化算法的问题。把qwen3.6 27b转成int8 autoround,上下文一长,每次就说一句话,这种情况是量化参数的问题吗?怎么样是最优解,求各位佬解答
lengyuesky满100天了,记录一下 中发帖

100天连续访问,记录一下😊 
[paste_1783143457835.png]
AAAAAAAAAAAA (@AAAAAAAAA)逆天Codex一直在自我复制企图占领我的磁盘 中发帖

标题党了,其实不完全是自我复制。更像是更新后依旧留着旧版app。🤡 
macOS 26
Codex 在 /private/var/folders/.../X/*.code_sign_clone里,从5.30开始,从26.527.31326 到 26.623.30605,总共22个版本、27份,还有几个版本有2、3份。占了我41G 🤡
这是孤例吗,还是大家都这样?
[image]
liunian这opus 4.8怎么了到底是??? 中发帖

有没有佬知道咋回事,这是幻觉么?怎么自己捏造回复呢?昨天就出现了,我这是订阅max20不是中转啊 🤔 
[image]
noups (@wushang)智能体怎么都要下架了 中发帖

看豆包和阿里千问都说要下架智能体,有啥说法吗?
酒寄彩叶 (@Iroha)论坛的浏览器通知bug 中发帖

前几天关注了一个佬,然后现在那个佬的一个帖子反复在浏览器通知里弹出来,几秒钟到几分钟就弹一次,我已经看过那个帖子了,那个帖子也没有新内容,但就是反复的在浏览器通知弹出来,无论那个帖子设置成勿扰还是其他的,好奇怪
你这是违法行为 (@Anano)华为「韬定律」V2版论文发布:Kirin 2026数据首次公开,补充工程细节与实测数据 中发帖

华为半导体负责人何庭波于 7 月 3 日在中国科学院科技论文预发布平台 ChinaXiv 发布《面向多层级电子系统的时间缩微理论》(韬定律)V2 版论文。相比 5 月 25 日发布的 V1 版,新版在理论框架基础上补充了大量工程落地细节与实测量化数据,形成 8 章完整论述体系,并新增了覆盖 τ 分层时空模型、LogicFolding 架构、键合界面截面、Unified Bus 互连架构、Hi-ONE 光引擎等核心技术的原理与实物示意图。 
在工程落地层面,V2 版深度阐释了 LogicFolding 的「齿比」概念:当混合键合间距接近顶层金属布线尺寸时,3D 设计空间从传统的「宏块级离散优化」转向「单元级连续优化」,可实现全局最优的垂直逻辑划分,突破了传统 3D 堆叠仅能按功能块分层的局限。V2 版还首次给出量产实测数据表,明确列出 Kirin 2026 与基准 Kirin 9030 Pr...
噜噜 (@taishang123)想问一下姥友程序员成长之路。 中发帖

想了解一下姥友们的成长之路,怎么精进的,可以交流学习一下,丰富一下我的未来的职业规划道路以及对未来人生的思考。 
我先来抛砖引玉,我是感觉我在学校里面是一直在倒退的,从小学的全校前5(乡村学校就两三个班)到初中的全班15(进城了),然后考上了双非民办二本。学习了软件工程。
我很庆幸能进入这个社区论坛,这两天为了升3刷了很多评论,不知道大家在现实是怎么样的但在这个论坛上都是友善,乐于助人的。上了大学之前在朋友的陪伴下很快就过去了,没有学什么专业知识但很快乐就完了,现在毕业应届生没有什么方向,现在准备学comfyUI(主要觉得挺好玩的)和aicg方向(工作流,agent等),然后再次感谢姥友们的无私分享。
@wangyujie求佬们救助如何正确使用CC Switch与codex 中发帖

在站内经常看到佬们分享各种免费的api,还有各种公益站的福利。其中一部分可以使用CC Switch轻松驾驭。 
[image]
像这种就直接填写就好了。
但是有一些确无法流畅的使用,像这样:
[image]
可是我也有看到有站内的佬在愉快使用。我意识到这可能是我的使用技巧太过于粗浅的,所以希望向佬们请教。如果有佬们看到的好的教程,不知可不可以分享一下。感激不尽!!!!!!