https://linux.do 论坛的话题更新通知频道。
可口可乐 (@user2076) 在 在cc里用sonnet opus 4.5或者4.6,有佬对比过中转和官方直接购买的差异吗? 中发帖
一直没找到特别稳定的中转,甚至一些中转还没公益稳定。想直接买一个月的官方的max试试水。
佬们有对比过中转/公益和官方的差异吗?给个建议吧
@darstib 在 晒晒:自己刚学炒的菜/“薯“片/”财“火 中发帖
刚回家前几天父母在外工作,自己一个人在家学炒菜:
[b28430f6f5d8d0a4b35ac09db501e16c] [092ef44e3d3c800473849e9ae52ae395] [c1d896c828d6bc90313990189fa09e0a]
我觉得卖相还行,味道刚好能吃hh
红薯切片晒干/烘干得到的小零食,正宗“薯”片:
[红薯切片晒干/烘干得到的小零食,正宗“薯”片]
最后祝大家“财旺福旺运道旺”!
[a0d5f7fa9950cfa1f796de4f4c3f3aec]
不会起名字啊 (@KEEPMOVE) 在 Anthropic 官方研究:Claude Code 到底能挂机多久? 中发帖
原址:https://www.anthropic.com/research/measuring-agent-autonomy
Anthropic 昨天刚发了篇名为 “Measuring AI agent autonomy in practice” 的研究报告。里面提到,开发者在使用 Claude Code 时,它的自主连续工作时间已经翻倍,最长甚至能无干预运行 45 分钟以上。
AI省流版本:
Anthropic刚刚发布了一份关于AI智能体在实际部署中自主性表现的调研报告。以下是核心结论的要点总结:
第一,智能体单次连续工作时间大幅延长。 过去三个月里,Claude Code单次免干预的最长运行时间几乎翻倍,从不到25分钟飙升至超过45分钟。这不单是因为模型自身能力的提升,更主要的原因是用户逐渐建立了信任,愿意把更庞杂的任务放权交给AI处理。这表明现有AI的潜在自主能力,远比目前受...
小麽朵 (@jiangliyuxue) 在 春节快乐哦~佬友们~ 中发帖
[990066FF1A6E5CA9F9FE723417C78E6A]
[F65CA3D3DBEF23B38170516C9EC7EA71]
陪家人出门散散心,赏梅吃梅花糕~ 😄
不会起名字啊 (@KEEPMOVE) 在 英国 AI 安全研究所 (AISI) 发布大模型安全评测工具 ControlArena 中发帖
大模型安全和评测这块,之前出的 Inspect 框架的英国 AI 安全研究所 (AISI) 。最近他们又开源了新工具 ControlArena。
这玩意主要用来在受控的沙盒环境里,自动化评估大模型 Agent 的自主性边界和潜在危险能力。
官网:
项目:
Cris (@CrisXie) 在 如何批量导入codex账号到CLI PROXY API 中发帖
如何批量导入codex账号到CLI PROXY API,注册了几千个账号,但是不会批量导入,求助佬友们
小鸟壁纸 (@xnbz) 在 你们的gemini-3-pro-preview现在能用吗 中发帖
一直报503
你是什么模型
▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄▄
✕ [API Error: {“error”:{“message”:“{\n "error": {\n "code": 503,\n "message": "This model is currently experiencing high
demand. Spikes in demand are usually temporary. Please try again later.",\n "status": "UNAVAILABLE"\n
}\n}\...
alan1020456 在 新年快乐!!!放烟花 中发帖
[6cf298268932e47d0e65f989e130ae20]
[76af09aa15ae25414992a28222d24991]
(这烟花特别小)