https://linux.do 论坛的话题更新通知频道。
@stevessr 在 Meta 签署了一项价值数十亿美元的协议,租用谷歌 TPU 中发帖
https://www.reuters.com/business/google-signs-multibillion-dollar-ai-chip-deal-with-meta-information-reports-2026-02-26/
[!quote]+
2 月 26 日(路透社)——据《The Information》周四援引一位参与谈判的人士报道,Meta Platforms(META.O)已签署一项数十亿美元的协议,将从谷歌(GOOGL.O)租用人工智能芯片,以开发新的人工智能模型。
这份多年期协议的报道出炉之际,各公司正斥资数十亿美元用于芯片和人工智能基础设施,以满足市场对人工智能的需求 。
erer (@h147369000) 在 今天发来个邮件,codex在Windows也有应用了? 中发帖
[image]
Codex - Windows官方下载 | 微软应用商店 | Microsoft Store
ruiw 在 有没有海外远程开发机推荐 中发帖
有没有国外的价格低的机器适合用来做开发机,现在基本都是vibe coding,可以开个终端就开干,摸鱼的时候写我自己的项目,网络回国质量无所谓,可以挂梯子
@stevessr 在 Doc-to-LoRA 中发帖
[!abstract]+
长输入序列对于大型语言模型 (LLM) 的上下文学习、文档理解和多步推理至关重要。然而,Transformer 的二次注意力成本使得推理过程耗费大量内存且速度缓慢。虽然上下文蒸馏 (CD) 可以将信息转化为模型参数,但由于训练成本和延迟,逐提示蒸馏并不实用。为了解决这些限制,我们提出了 Doc-to-LoRA (D2L),这是一个轻量级超网络,它通过元学习在单次前向传播中执行近似 CD。给定一个未见过的提示,D2L 会为目标 LLM 生成一个 LoRA 适配器,使得后续查询无需重新消耗原始上下文即可回答,从而降低目标 LLM 推理过程中的延迟和键值缓存内存消耗。在一个长上下文的大海捞针任务中,D2L 成功地学习将上下文映射到存储“针”信息的适配器,在序列长度超过目标 LLM 原生上下文窗口 4 倍以上的情况下,实现了近乎完美的零样本准确率。在计算资源...
linuxdddddo 在 【号外】谷歌云API密钥曝严重漏洞:Gemini启用后旧密钥静默获敏感访问权 中发帖
漏洞本质:
当一个Google Cloud项目(GCP project)启用Gemini API(即Generative Language API)后,该项目中所有已存在的API密钥(包括多年以前创建、公开嵌入前端代码的AIza…格式密钥)会自动、静默地获得对Gemini相关敏感端点的访问权限。
佬们自己有谷歌项目的注意下,貌似这个漏洞还没有完全修复 之前公开的非敏感key还是会导致gemini的访问 而且如果上述成立的其他的非敏感key 也可以无限白嫖gemini了。(直接无限CPA????)
[image]
@fang7 在 langgraph 如何实际的应用到自己的后台网站上? 中发帖
目前在自学 langchain 和 langgraph,在思考跟业务结合的整体流程是什么?
我目前的理解是:langgraph 是用来做 ai 后端的,那得和前端或者说以什么方式展现出来给人用,这样才是一个完整的可以使用的 ai agent.
那怎么能在现有的公司的网站上使用呢? 我看他们有 chat ui,把这个 chat ui 加到自己网站上,然后前端全部去请求业务的网关,网关转请求到后端 python 服务?
或者你们现在用什么写agent,最近在积极学习agent开发,llm开发是做不了了,退而求其次搞搞agent或者工作流开发
抹了油的猪 (@twohourslater) 在 求助帖,ccs端点测速功能是删除了? 中发帖
早上更新了ccs到3.11,然后发现端点测速功能没有了,查更新log也没提到这个,还是新版本隐藏了需要手动开启?有佬知道吗?
@momo_wqy 在 新人报道,顺便问一下现在开发项目最好用的AI工具是哪个?Copilot, Cursor, Codex, Claude Code, Openclaw ... 中发帖
如题,本人有Copilot学生会员,Cursor pro会员,和一些中转站的API,应该是可以用到最先进的模型,之前一直用的是cursor,其他的几个刚了解,不知道现在的这几个工具哪个更好用一些~ 而且中转站的api好像不能接 Openclaw,想玩一下openclaw有什么适合小白,成本比较低的,一键部署的方法~ 希望佬友解答