https://linux.do 论坛的话题更新通知频道。
李成蹊 (@davy) 在 deepseek v4 flash 0731分数(就是Luna平替) 中发帖
一句话,就是Luna平替。Agent分数比Luna稍高。
[image]
[image]
[image]
Dean (@Morm) 在 佬们。用codex gpt-5.3-codex-spark 这个模型的时候出现这个错误怎么解决 中发帖
Unsupported parameter: ‘reasoning.summary’ is not supported with the ‘gpt-5.3-codex-spark’ model.
[image]
知识荒野 (@magicempire) 在 我觉得 DS4 Flash 和 GPT5.6Luna 的价格策略为未来 AI 应用提供了真正可以落地的“基座”” 中发帖
在应用层面物美价廉,性价比高。这点毋庸置疑。
但是我感觉更主要的是,他们为 AI 开发应用提供了一个非常好的基座模型。
之前我们开发 AI 驱动的软件,为用户提供 BYOK让用户自己申请 API 接入模型。或者内部提供订阅。存在使用门槛高或者运营费用过高的问题。但是以这两个模型的定位和定价,我感觉完全可以把它们两个作为基座模型。让用户可以轻易上手,而且入门的费用也可以大幅度降低。这对AI 软件开发者来说今天确实是一个好日子。
@Astralyn 在 AA 榜单中 DS V4 Flash 计费疑似出错 中发帖
众所周知,DeepSeek API 是不收取缓存创建费用的,但是 Artificial Analysis 刚刚更新的对 DeepSeek V4 Flash 0731 的基准测试计费中,意外地出现了高额缓存写入费用(如图)
[image]
而预览版 V4 Pro 则没有这个错误
[image]
这直接影响到了性价比坐标图,下图箭头终点是修正后理应存在的位置
[image]
ai567ai 在 问下大佬们 [【enjoytoken】公益站上线 我注册了 但是我在ccwitch中使用的是提示apikey无效 中发帖
unexpected status 403 Forbidden: Just a moment…*{box-sizing:border-box;margin:0;padding:0}html{line-height:1.15;-webkit-text-size-adjust:100%;color:#313131;font…, url: https://new.ambition.qzz.io/v1/responses, cf-ray: a23b110b2b3947f7-NRT
放到 codex 中使用 提示这个 ai 了一下说是 cf拦截了 我想问下 这个时候我要怎么做
还有就是ccswitch 提示apikey 不可用或者无权限 也是因为这个吗云烟成雨 (@xyr) 在 WorkBuddy里的Kimi-K3掺水严重 中发帖
我在workbuddy里模型选的Kimi-K3,问他kimi-k3跟GPT哪款模型能力最接近,他回答4o,我心想不可能这么弱吧,然后换了其他几个ai问,得到的答案基本都是跟GPT-5.5接近甚至超越,然后我继续追问,为什么其他ai给的答案是5.5,他居然跟我说GPT-5.5是虚构的模型,不存在?!这水掺的不是一般的深啊。然后我发现他对于k3的上下文长度说的也是错的,简直拉完了,不知道从哪儿搞的模型,掺水就算了,积分消耗倍率还最高!!
下面是截图:
[1]
[2]
野菜团 (@wildman) 在 最近在研究中转站,看到有国内备案的,这样真的没事吗? 中发帖
rt,最近想研究下中转站的盈利模式;也确实有点想做的冲动,看到好几个cn域名备案的中转站,其中有个人的也有企业备案的;这样真的不会进去吗?
@murray_lg 在 飞咯!!!! 中发帖
[bfa45252-46ef-489b-b273-9dfb84a7242d]
之前不知道新开链接不算浏览话题,一直新开页面看帖子,发现一直不动弹,才知道不能新开,终于要三级咯
@xqc 在 有什么蒸馏自己的好办法呢 中发帖
现在虽然用codex和hermes基本上把日常开发任务、领导汇报和同事沟通这些日常场景覆盖了(因为我本来工作内容也不复杂),目前差不多每天半小时就把一天的活儿干完了,所以想极端一点进一步完整的蒸馏自己,感觉这种点到点的蒸馏应该拓展出一个真正的产品,想看看大家有没有好的方案
chitaibao 在 慢讯:详细对比了一下智谱套餐的前后变化 中发帖
[图片]
智谱自从出了GLM 5.2之后,身价就一路大涨。
[图片]
之前我订过一个月的coding plan v1,但那时候还没出5.2。所以我没有续订,我承认我后悔了 🫠今天在社区里看到一个智谱 plan v1的老账号在二手市场能炒到6万。
从 v1 到 v2,我理解智谱的操作:
限购:大量用户疯狂涌入,智谱算力有限,要保证服务正常就必须学会“拒绝”。
缩减额度:plan v1 的用量确实量大管饱,和做慈善没什么两样。v1 原本的定价就是建立在智谱模型不行,急需用户数据的前提下设计的。GLM 5.2性能大涨,自然不用再跪着做买卖。
而且我也支持智谱的行为,毕竟国模不容易。
但现在从 plan v2 到 plan v3 ,我只想到那段名言:国货很难的。不要乱说,哪里贵了?有时候要找找自己的的原因。
先看实际数据对比吧。
一、Coding Plan V3 概况
智谱 C...