https://linux.do 论坛的话题更新通知频道。
拾雨 (@c519127)阿里云百炼宣布 GLM-5.2 Fast mode 模式降价 20%,7 月 15 日生效 中发帖

IT之家 7 月 14 日消息,今日,阿里云宣布,大模型服务平台百炼将于北京时间 2026 年 7 月 15 日 00:00:00 起,对 GLM-5.2 模型的 Fast mode 模式计费单价进行下调调整,下调幅度 20%。 
[021856bf-c07c-4f2d-b9ba-2e1d0c2956c8]
据阿里云介绍,快速模式(Fast mode)可以为业务中对输出速度敏感的场景提供更高的 TPS,适用场景如 AI 流式编程助手、Agent 多步推理、实时对话等。当前为 preview 阶段,能力与规格可能随版本调整。
IT之家注意到,快速模式具备以下关键特性:


高速输出:TPS 提升至标准 API 的 1.5~2 倍,达 80~100 TPS;


按 token 计费:计费逻辑与标准 API 一致,按输入与输出 token 计费,具体价格见模型调用计费。


特殊限...
@yaooldsix自建中转站生图报错,求解答。 中发帖

各位佬大家好。 
我最近搭了一个自己的api中转站,搞了个K12账号进去,想要调用gpt-Image-2来生成图片用。但是调用的时候报了

API request failed (500): codex channel: endpoint not supported (request id: 202607141208426033408228268d9d6QP8Qq4IP)

在Codex调用其他的5.6模型是没有问题的。
这个是我的模型配置
[image]
请求地址是 :
POST https://****/v1/images/generations
完整curl
curl.exe “https://****/v1/images/generations” -X POST -H “Authorization: Bearer 你的API密钥” -H “Content-Type...
@adnogpugrok2api Chat格式无法用tool Response格式没缓存 中发帖

如题grok2api Chat格式无法用tool Response格式没缓存 
如果我用Chat Completions格式请求就提示
[0e6fe28e-17cd-4738-9dca-b814fda3714a]
我换Response的话又没缓存
[image]
见别人说可以套newapi 但是 依旧没缓存
[image]
求各位佬帮忙解决一下
加麻加辣 (@kehaomaba)探讨一下GPT‑Live 中发帖

有没有佬体验过GPT‑Live,感觉怎么样?
Token (@guanglilin)Codex/Claudecode远程进度 中发帖

各位佬,记得之前火过一段可以查看codex/claude code进度的工具, 
例如我挂了一个plan,下楼健身遛弯了,可以在手机或者其他方式查看到进度
或者更好的可能是可以查看和管理多台设备的工具,本地电脑,开发机,服务器各种对话管理的工具也很需要。
想看看各位佬有没有什么推荐
Rune (@luen)Claude Fable 5和GPT 5.6 Sol哪个更强? 中发帖

从你自己说使用体验来说你觉得Claude Fable 5和ChatGPT 5.6 Sol哪个更强? 
投票
Elvis Z (@zrn)5.6贼慢,有中转兄弟 newapi 连接 sub2api 吗 中发帖

我的情况是 newapi的rpm 才300多,但是sub2api的并发500多,这几天5.6出来才会这样,按正常来说都是sub2api 的并发小于rpm的,有没有中转的兄弟遇到过,什么问题导致的啊,是否有可能是5.6 偶然相应首字几分钟导致连接一直连着占用并发了啊
林 (@LinCode888)求助:使用站里大佬的注册机注册的grok,请求报403 中发帖

如题,有大佬遇到过吗,怎么解决? 
报错:Please run /login · API Error: 403 {"code":"permission-denied","error":"Access to the chat endpoint is denied. Please ensure you're using the correct credentials. If you believe this is a mistake, please log into console.x.ai and update the permissions, or contact support."}
logandd如何兼顾5.5的速度和5.6的智商 中发帖

看大家都在吐槽gpt-5.6的速度,想用点聪明的模型,结果速度奇慢。我之前也是这样,但是最近不是5h额度放开了嘛,多搞了几个日抛号,用不完浪费了,于是就把紫色的极高推理和1.5倍速打开了,结果发现打开了新世界,速度体验和5.5超高一样,同时又兼顾了新模型的智商。大家可以试一试,这样就不会几十分钟一直卡着。不得不说钞能力还是强啊。
@sysz【实测】兴业寰宇人生借记卡汇款:iFast被拒 + 转投Wise(DBS港币) 中发帖

时间:2026年7月14日,上海兴业银行 
先汇英镑到iFast,输入Swift自动填入了iFast银行真实地址(含"iFAST Global Bank Limited"字样,无法修改),结果被拒,提示"请提供汇款用途证明材料",猜测是iFast作为数字银行风控较严,且"因私旅游"这个用途本身没有标准证明材料,没能解决。
转而汇港币到Wise,其港币账户实际挂在DBS Bank (Hong Kong)名下(真实持牌银行,SWIFT: DHBKHKHH),换成这条路线后顺利通过,没再被要求补材料,整个2 个小时就到账了。
费用方面,这次选了OUR(汇款人承担,被另外预扣200人民币,本以为能全额到账):

兴业回单:汇款8,644.58 HKD,手续费/电报费均为0
Wise实收:8,389.58 HKD(中间损耗255 HKD,问Wise客服说看不到具体是哪个中转行扣的)
Wise手...
@Ghostilia有点累了,每天要应付几个朋友和暧昧对象的聊天 中发帖

现在自己把聊天记录导入然后做个agent,参考回复的模式成熟了吗?看了看之前爆火的前任skill,貌似更接近于赛博对话机,我想实现的功能是根据不同的对象发来的新消息,扔进这个智能体里给我一个语气合适的参考答复,这样的好实现吗
@errnil最了解Grok的还是Grok自己 中发帖

下午在小鸡上开Grok的注册机,小机性能不行注册的比较慢,一下午注册600多个。然后用刚注册的几百个号的FREE配额让Grok在注册机上添加边注册边测活。 
Grok还是很听得懂人话上去就干。完成后我在小机上测试一下就把我下午注册的600多个给删掉500多个死号… 😂
LOVE (@ZMoon)继4波GPT+2波grok后进入贤者模式 中发帖

这两天发了一些gpt和grok的福利 各种渠道都用 库存基本都招出来了 彻底没号了 
已经……一点……都没有了……
AAAAAAAAAAAA (@AAAAAAAAA)发现站内5.6 sol的讨论真的很两极分化啊 中发帖

如题,真的很两极分化,在一个帖子下有人说是最强的模型,甚至还有人说不如opus 4.8。 
大家是怎么觉得的呢。我感觉是效果很好,但是慢到天怒人怨了
Elizabeth Grant (@2664023249)关于GPT5.6 sub2api联网检索失效的问题,更新到最新版本之后只需要在请求的url后面加一个/v1就可以了🤭 中发帖

关于GPT5.6 sub2api联网检索失效的问题,更新到最新版本之后只需要在请求的url后面加一个/v1就可以了🤭 
[15199]
🐟 (@stevessr)一加手机可能退出美欧市场 中发帖

根据WinFuture的一份报告的机器翻译版本,一加及其母公司 Oppo 计划在未来几天内宣布,一加品牌将退出美国和欧洲市场。
pry周内在 (@prya)啥?GPT没有豆包热情有趣? 中发帖

有个朋友跟我吐槽说,GPT虽然比豆包那些聪明,但是没有豆包有趣热情 
我给他调的设置be like :
[Screenshot_20260714_200916]
我自己实际上用的设置be like :
[Screenshot_20260714_200933]
😅说的我都不知道哪个好了
RL (@gunrose26)我的CLAUDE又被封了,我用的海外VPS+ANT BROSWER+固定VPN,这是咋回事? 中发帖

我的CLAUDE又被封了,我用的海外VPS+ANT BROSWER+固定VPN,这是咋回事?我VPS和VPN用的一个机房IP,而且是固定的,我用GMAIL登录的,GMAIL是新号。我感觉我没问题啊?有没有佬给我分析分析这是咋回事? 
[image]
拾雨 (@c519127)挑战英伟达主导细分市场:消息称谷歌向 Neocloud 推销 TPU 中发帖

IT之家 7 月 14 日消息,据外媒 The Information 当地时间 13 日报道,Google(谷歌)正向 Neocloud(IT之家注:主营 AI 相关业务的新兴云服务供应商)推销其自有 TPU AI 芯片。 
[66e46c7f-b3ab-4e79-a16d-8994e7244fa2]
Neocloud 企业通常主要甚至仅仅提供基于 NVIDIA(英伟达)GPU 的云算力。这是因为英伟达拥有成熟的数据中心解决方案,降低了系统部署复杂度;同时英伟达 GPU 算力可满足更大比例的市场需求;此外,英伟达很多情况下也是 Neocloud 的财务合作伙伴。
报道指出,谷歌曾与多家 Neocloud 企业就部署 TPU 一事进行了讨论,还提议回租 TPU 云服务。
Neocloud 企业 Nscale 发言人表示,其所有已签约的集群和正在进行的讨论均由 GPU 支持,英伟达并...