https://linux.do 论坛的话题更新通知频道。
马克MkSaMa (@markskz) 在 L站大模型主观排行榜网站算法求助 中发帖
从 关于给佬友们用的大模型投票排行榜的民意征集 继续讨论:
目前网站已经搭建完毕,马上就可以开放给大家使用了,但是我意识到一个问题。
初期方案是让大家使用1-10来对每个模型进行打分,然后我这边再根据平均数公式来排行。
那么大家肯定会给现在最好用的gpt-5.5打9分甚至10分,那么如果有gpt-5.6出现,或者更好的模型出现了呢?怎么样才能和原来的最优模型拉开差距。
对于上面的问题,我提出了以下解决方案:
给每个人的评分加上时效性,越久远的评分所占的权重更低
在用户投票新模型的时候,弹出窗口显示之前的模型投票情况,并选择是否重新投票
换成和arena一致的天梯模式,通过ELO算法来进行匹配,并通过用户的选择进行排行(需要数据量)
但是对于上面的三个方案,我认为都各有缺陷,想问下各位佬友股东们有什么建议吗?
NPC (@dodo666) 在 搞了个zed-sftp扩展 中发帖
vscode目前已经作为看代码
然后ftp上传到服务器,内存占用不小
zed-sftp目前的插件只有sftp,不支持ftp,
于是搞了个支持ftp的插件(功能参考vscode的sftp插件 😀),已经进入zed扩展的审核流程了。
下面是扩展文件,有需要的佬请下载,
zed-sftp-v0.1.0.zip (94.4 KB)
使用步骤:
1.在扩展面板右上角点击 Install Dev Extension
2.选择刚解压出来的 zed-sftp/ 文件夹
3.安装完成后,在项目根目录创建 .zed/sftp.json(配置示例见 CONFIGURATION.md)
首次启动注意: 扩展会自动从 github 拉取一个 20KB 的运行时(sync-server)。请确保能访问 github
错觉 (@0nini) 在 完了,我的free号没了 中发帖
我很多free号之前不用add phone,现在 “额度获取失败:401 Your authentication token has been invalidated. Please try signing in again.”重新登录都要add phone了,现在只有很久很久之前的号不需要了
技术总奸 (@ShaBi) 在 发现了一个极品免费域名站 中发帖
localhost.cc 免费域名申请(一年一申)
包括 888.moe 和 localhost.cc 域名
我已经薅了 node.localhost.cc 了
[image]
不知道啥时候开的 看他域名不错就推荐一下吧
@mooorse 在 大家都用什么工具查aigc率? 中发帖
目前我是在写简历,官方没说会不会查aigc率,因此也没有指定网站,但还是觉得查一下比较保险,大家一般都用什么工具来查aigc率?最好比较通用的,我看很多工具都是查论文的aigc率的
WOQ 在 Gemini 3.1 Flash-Lite 使用体验 with CC-Switch 中发帖
平台: Zenmux Subscription
工具: Claude Code / CC-Switch
场景: Python / TS
快/贵
快
(注:后台看V4F跟3.1FL差不多 但体感是3.1快很多 出字就是整屏刷下来)
指标
gemini-3.1-flash-lite
deepseek-v4-flash
deepseek-v4-pro
平均延迟
1879 ms
1781 ms
3599 ms
平均吞吐量
62.17 tokens/s
61.56 tokens/s
24.21 tokens/s
最快响应
1879 ms
1781 ms
3599 ms
最慢响应
1879 ms
1781 ms
3599 ms
最高吞吐量
62.17 tokens/s
61.56 tokens/s
24.21 tokens/s
最低吞吐量
62.17 to...
This is a good thing (@Asdee) 在 求助!codex 总是 Reconnecting... 怎么办? 中发帖
[image]
也开了tun模式了
也配置.env了
[image]
一点用没有
是本地CPA代理,用ccSwitch管理
该配置的都配置了,一点辙没有
AAAI 在 吃货实验室之玩转空气炸锅 中发帖
最近入坑了空气炸锅赛道,也可能是太懒了不愿意开火做饭,搞了很多黑暗料理出来。
想起号一个专栏:吃货实验室。今天的主题是玩转空气炸锅。
说说你用过性价比高或者体验比拉满的空气炸锅吧,或者分享下你用空气炸锅做过的美食
萌新欻無 (@NewbieXvwu) 在 可能是能反映AI在真实环境下情商的一道题?居然只有豆包完全答对了 中发帖
提示词:解释这张图片的深意
[image]
需要模型理解的核心点是将高考说成平日限时训练的温柔感
线索:标准的高考时间,“完成限时小测不讲评,考完直接回家”的说法(显然指的是高考本身,而不是什么日常测验)
唯一且几乎完美的回答居然是Seed 2.0 Pro的:
[image]
其它模型几乎都牛头不对马嘴:
至少发现这是在祝福高考的模型:
Gemini 3.5 Flash:
[image]
Claude Opus 4.6:
[image]
完全胡言乱语的模型:
Gemini 3.1 Pro:
[image]
GLM 5V Turbo:
[image]
Qwen 3.7 Plus:
[image]
GPT 5.5:
[image]
Kimi K2.6:
[image]
比奇堡乐园 (@hxbbpn2473736584) 在 L站可太棒了!!!! 中发帖
感觉L站的佬们很热情,也没有认识的人,是一个很好的空间倾诉自己的一些想法,每天逛逛L站心情极大舒畅
顺便询问,最近刷手机也刷的很无聊,实在是太无聊了,想看些书,昨晚看以日为鉴,感觉还挺有意思的,讲述一段日本现代史吧,然后特别想看看中国的现代史,就是从改革开放到现在,重点是互联网时代兴起的那一节历史,有没有佬给推荐一下
欣欣|林可欣 (@StellaFortuna) 在 哈基米3.5的搜索热情还是挺高的 中发帖
他调用tavily一次只搜一个关键词,结果一直搜,花了1分半,搜了一堆
[Screenshot20260523143350]
🫠
最后回答还不是很完美
这种事情还是交给官网谷歌搜索或者直接上豆包 🫠
Pine 在 求各位佬们有没有好的解决方法 中发帖
vue3前端打包发布之后,用户如果不刷新网页,请求的静态资源还是上一个版本的,怎么处理
gitlab如果部署在机房,研发拉取和push代码的速度可能有影响,是否存在两个gitlab同步的机制,在本地推拉代码,服务器自动同步,做cicd
kent (@kentgao) 在 咨询一下有佬友今天还能搓plus账号没? 中发帖
昨天1000多个号全炸完了。现在就剩team但是因为项目累计上下文导致数据量很大,不敢换模型接手只能硬着头皮上官方。中转公益收费的都试过上下文太大都炸了,只能自己搓号了。想知道一下这个还能搓吗?弄几个把项目问题改完,难受死了。