https://linux.do 论坛的话题更新通知频道。
Bunn (@BunnHack) 在 英美联合评估:月之暗面Kimi K3网络攻击能力低于美国顶尖模型,但安全防护存在缺口 中发帖
英国人工智能安全研究所(UK AISI)与美国人工智能标准与创新中心(CAISI)近日联合发布评估报告,对月之暗面(Moonshot AI)旗下最新模型Kimi K3(于2026年7月16日发布,计划于7月27日前开放权重)的网络安全能力进行了系统性测试。
评估结果显示,Kimi K3在漏洞利用开发及模拟企业网络攻击两项核心测试中,均显著低于美国当前最前沿的网络能力模型。
[17848512363953078912742293677915]
漏洞利用开发(ExploitBench):Kimi K3得分为32.2%,而美国顶尖模型平均得分达76.2%,差距悬殊。
模拟企业网络攻击(“The Last Ones”,TLO):在这一涵盖4个子网、约20台主机、共32步攻击路径的模拟企业网络测试中,Kimi K3平均完成第17步,而美国最强网络能力模型平均可达28.5步。
尽管与美国顶...
L站吴彦祖 (@jielade12) 在 Claude 新的语音模型 中发帖
试了一下克劳德新的语音模型,比以前好用一点。你直接说话,它就会直接上传下去,然后回复你。但是真人感还是比 GPT 的模型要差一点。并且切换不同的语调和语言,还不能做到让它自动切。
宇宙宙长 (@WWZ) 在 求一个英区节点,只下载一个apk 中发帖
沃达丰UK这个软件从哪里下载呀
没有英国节点,没法从Google play下载,也没找到能用的镜像站,镜像站下载的后缀是apkm,然后看到有教程说下载一个apk install mirror,但是…下载的apk install mirror,后缀也是apkm
这死循环了呀,完全没法安装呀
Limit (@1183747933) 在 有关grok4.5降智的幽默跨时代搞笑测试,大家都来试试看 中发帖
[image]
本人为supergrok heavy用户。
以上结果出自grok build 内的grok4.5 high模型,完全的gpt4水平。
《震惊瘫坐,grok4.5已大幅度超越旗舰gpt模型!》
跨时代提示词:“创建一个HTML,内容是SVG绘制一个鹈鹕骑自行车的2D动画。”
@lushy 在 Oracle Cloud Free申请(记录ing) 中发帖
一开始没懂佬友说的ABC,直到我信用卡五次扣款成功和五次失败的提醒.
我才注意到 😆
[image]
于是我点了右边的
[image]
然后我回复了
Dear Support, I am unable to complete my Oracle Cloud account registration. The error message cites incomplete/incorrect information, location/identity obscuring, or multiple accounts – but I have double-checked all details and am using a residential IP without proxies. I have also cleared cache and tried incognito ...
@Joe668 在 刚注册20个grok号,给佬们试试水 中发帖
之前在坛里拿了很多佬的grok账号和资料,一直想着有机会回馈佬。这两天倒腾了grok注册机,注册了20个grok账号给佬试试水
CPA.zip (21.8 KB)
,后续用着稳定就继续再补。 🫠
RL (@gunrose26) 在 CODEX的额度重置没有了吗? 中发帖
刚充了CODEX PLUS,之前一直看帖子说CODEX额度重置,等我用的时候一看,没有额度重置了。。。请问佬哪还有能搞到重置?
[image]
@GodKing 在 team“被”超拉和客服对线能赢吗 中发帖
之前买的outlook邮箱疑似被黑心商家一号多卖
今天刚使用csv批量导入之前自己注册好的gpt账号,没过五分钟席位直接干到了5个,billing已经显示 3/5 并且邮件通知后一小时不到就成功扣费出账单了,五分钟没看空间已经进了10个小黑,立即开始清理小黑,并把邀请里挂起的账号全部撤回,好在席位没继续增加
[image]
[image]
[image]
mmp 这种一号多卖的奸商真该414 😤
这个帖子后面会更新和客服对线的最新进展
wjhere 在 番茄畅听免费时长保存在哪?如何不看广告增加时长 中发帖
最近迷上用番茄畅听听小说,发现退出账号或者重新安装,获取的免费时长还在,看来和账户并没有绑定,不知道它保存在哪里,哪位佬友研究过啊?
超大杯 (@measur) 在 gpt思考过长,好像是因为不太懂业务退化 中发帖
举个例子,假如一个接口会并发修改某个值
gpt是无论如何都会想办法让他真正的并发, 但现实是根本不存在真正的并行,
但 gpt 无法理解 “那我把它串行化” 这件事情,因为给的要求是并发,或者你描述成了并行,内部串行化在一开始就被否决了,这个导致了长期 coding 下结构的崩坏。
gpt 开始了雷霆大代码,用几千行代码为了解决一个小的串行问题,但这个雷霆代码无法根本的解决问题,引入无数的状态和情况,造成无数的 隐藏 bug。
一时半会还没有什么好的解决办法,除非对内部代码非常熟悉,或者让 gpt 注意力放在目标上,不然 gpt 这种做法带来的就是一个轻量问题,随着多次 debug,变成远超原始目标的重量级屎山。
noah (@noah_zhang) 在 刚刚自己注册的50个grok,分享给佬们试试 中发帖
搞了一晚上,算是能注册成功导入到CPA了,这是第一波,佬友们,尝尝咸淡
auths.7z (23.5 KB)
[image]