https://linux.do 论坛的话题更新通知频道。
Nectivelle 在 ARC-AGI-3 基准测试发布 中发帖
Arc Price 发布了 ARC-AGI-3 基准测试。
[image]
ARC-AGI-3 是目前全球唯一尚未饱和的智能体(Agentic)基准测试,旨在考查 AI “如何学习”而非“已知什么”。它通过 135 个完全陌生的无指令游戏环境,要求 AI 仅靠核心知识先验进行自主探索、假设与规划。目前人类能轻松获得 100% 满分,而包括 Gemini 3.1 Pro (0.37%) 在内的顶级 AI 得分均不足 1%。这种极大的表现鸿沟精准量化了当前模型在技能获取效率上与真正 AGI 的本质差距。
部分前沿模型分数:
Provider
Model
Score
Gemini 3.1 Pro Preview
0.37%
OpenAI
GPT 5.4 (High)
0.26%
Anthropic
Opus 4.6 (Max)
0.25%
xA...
RWDai 在 求助,佬们有没有好用的 clash/mihomo 的节点测试工具 中发帖
clash/mihomo 的节点测试工具,希望能测试各种服务解锁的,测速等的。github 搜了一下,要么就是已经不维护了,要么就是 star非常少。想问一下各位佬是用什么测试节点质量的?
@shaozid 在 请佬们推荐个给老人用的家用视频摄像头。 中发帖
大家好啊 !家里老人年纪大了,最近想装个视频对讲摄像头,搜了些资料感觉还是很困难,还请大家大力推荐啊!
需求如下:
1、连接现有网络或者商家包年4G无线流量的都可以。
2、可以双向视频呼叫,手机呼叫摄像头最好直接接通不用老人操作。
3、有实体一键呼叫按键。
4、有语音呼叫功能,最好能自定义触发关键词,例如儿女的名字。
5、有移动跟踪功能。
6、有摔倒检测报警功能。
7、以上功能可让多个儿女同时使用。
主要是能及时掌握老人情况,或者老人能随时通过它联系儿女,存储功能非必须有了更好没有也行。不知道有没有这样的产品。先谢谢大家看到这里!多谢!
凌岐峰 (@lingqifeng0) 在 opilot 的 Opus 4.6 居然可以选 high ,medium,low 了 中发帖
[bd403abcc9f8a45b1e6575db058bd97c]
copilo
@wonan 在 claude在逆向方面还是不行呀 中发帖
这两天分析一个app,本来打算,全部交给claude来分析,
但是claude也就道德感低点,不用哄,让干什么就干什么,
具体到分析和模拟这个过程,就感觉确实不行了。
开头就告诉claude,本机已经安装adb和frida了,
路径也都给了,但是他就是不会好好利用。
举个例子,之前用gpt的时候,他可以全自动利用adb,frida在手机里面找到对应app,去重启,刷新,关闭碍事的弹窗这些操作,编写hook脚本之后,还会主动注入进去抓取数据,全自动操作。
但是claude就明显不行了,自己编写个frida hook脚本,还得停下来,告诉我:现在你手动刷新一下app,告诉我,我去抓取一下hook到的数据。
然后就是编写模拟代码这方面,让claude调半天,来回开了几个session,都不行。
最后把代码交给gpt,一轮就给搞定了。
所以,让claude开个头还行,毕竟道德感比...
天行健 (@sinecelia) 在 【持续更新-2026.3.27】codex的subagents配置文件 中发帖
最近在使用codex+superpowers,由于superpowers会使用worktree和subagents,所以配置了一下。配置文件如下:
config.toml
root@VM-0-16-ubuntu:~/.codex# cat config.toml
model_provider = "OpenAI"
model = "gpt-5.4"
review_model = "gpt-5.4"
model_reasoning_effort = "xhigh"
disable_response_storage = true
network_access = "enabled"
windows_wsl_setup_acknowledged = true
model_context_window = 1000000
model_auto_compact_token_limit = 90...
🐟 (@stevessr) 在 Anthropic起诉白宫迎阶段性胜利:政府涉嫌违宪,Claude禁令被叫停 中发帖
[!quote]+
旧金山的一位联邦法官批准了Anthropic对特朗普政府诉讼中的初步禁令请求。
法官丽塔·林于周四作出裁决,距这家人工智能初创公司的律师和美国政府的律师出庭听证两天。Anthropic起诉政府,试图推翻五角大楼的黑名单和特朗普总统禁止联邦机构使用其Claude模型的指令。
Anthropic请求暂停这些行动,以防止案件进一步的金钱和声誉损害。该命令禁止特朗普政府执行、执行总统的指令,并阻碍五角大楼将Anthropic定性为美国国家安全威胁的努力。
骐骥驰骋 (@pepecoin) 在 prompts的计算问题 中发帖
def agent_loop(messages: list):
while True:
response = client.messages.create(
model=MODEL, system=SYSTEM, messages=messages,
tools=TOOLS, max_tokens=8000,
)
messages.append({"role": "assistant", "content": response.content})
if response.stop_reason != "tool_use":
return
results = []
for block in response.conte...
xin (@Butterflies) 在 一种错误的AI使用示例 中发帖
自从发现了AI好用,指好像万物都可AI。
然后发现了Paperclip,一个也是主打一人公司的开源项目,可以利用本机的CLI来多利用ISSUE进行状态流转来完成任务的项目。
好,开始折腾。比如想写个自动AI小说的公司,开始还想需要什么样的角色,怎么流转。后来异响AI可以弄啊,于是让AI设计。
AI设计好了,开始要粘贴,好麻烦。有导入接口,AI来生成zip包吧。
导入zip包还要手动,你给我直接导入…
原来项目导入接口有点问题不支持?调用不通?
源码下下来,再搞个维护代码的agent,不支持你就加…
就这样
我成了好几个agent的传话筒
好的,准了,ok,行,按你推荐的来…
我成了一个辣鸡agent,没别的输出,只会说以上这些了
再后来,我甚至也失去了阅读提示词的耐心,就想让ai判定,判定好坏,判定输出的好坏
结果就是:公司成了糨糊,协调乱得一塌糊涂
所以,在我的...