https://linux.do 论坛的话题更新通知频道。
穆罕默德.哆啦A梦 (@xthons) 在 感觉deepseek已经变聪明了,新版本发布了这是? 中发帖
接着上次佬儿的测试问题,已经可以迎刃而解了
[Screenshot_20260211_194924_DeepSeek]
@Tony32 在 DeepSeek新模型上下文小探(网页端) 中发帖
用GPT-5 tokenizer的结果
[image]
用DeepSeek-V3.1 tokenizer的结果
[image]
两个文件上传后提示截断到76%
[image]
用3.1 tokenizer计算的话,上下文约864.4K;
用GPT-5 tokenizer计算的话,上下文约1051K
是换tokenizer了还是留了更多输出token
Moonie 在 神经网络与大语言模型初步 - 第一章 神经网络 3 中发帖
最近实在是忙,面试、research什么的全部堆在一起了,所以更新速度有所降低,还请见谅。
(不得不提一嘴,腾讯的HR面试太奇妙了,流程走到HR面试几天没约面,年前恐怕难oc了😂
上一期我们讲了非线性的神经网络,这期我们讲 神经网络的效果评估。
至于其他更复杂结构的神经网络,比如CNN、RNN、LSTM,我在想是否需要讲。主要的考虑是:这些内容篇幅较长,且并不是理解LLM机理的必要条件,如果写这些,可能会让真正LLM部分出现地更晚,怕消磨了佬友们的注意力和耐心;不讲的话,又感觉对不起标题中的“神经网络”。佬友们有什么建议吗,欢迎评论区提出。
1.3 神经网络的评估
评估其实很简单,就是做题,以做题结果来评判模型效果。
1.3.1 数据集划分
评估是做题得到的,而做的题是从数据集中得到的,数据集划分是确定哪些数据用于训练、哪些用于评估(具体的评估指标放在1.3.2讲)
一般把...
Rana Pathan 在 ChatGPT Plus 礼赠 (免费 1 个月) 中发帖
这个假期,向一位好友或家人分享专属邀请链接,即可免费向他们赠送一个月的 ChatGPT Plus 试用期。
我收到邮箱,提示这个,根据这个原理,市面上会不会出现大量低价 plus 一个月的账户 🤣
bbbb (@ls2024) 在 原来已经用了kimi这么久了 中发帖
[image]
——————————————
[image]
nb,大概率是大量代码复制粘贴重新提问
——————————————
[image]
花了4000W
[image]
scvxzf (@xuzimo) 在 如何在wsl2当中永久性挂载物理磁盘保持写入权限 中发帖
我在Windows11(10.0.26200)当中安装了最新版本的wsl2(Ubuntu24.04).
尝试挂载我系统中ext4格式的硬盘分区(Ubuntu传下来的)
使用命令
wsl --mount \.\PHYSICALDRIVE0 --bare
wsl --mount \.\PHYSICALDRIVE1 --bare
wsl --mount \.\PHYSICALDRIVE2 --bare
成功让我wsl2的Ubuntu24.04读取到这四块硬盘。
问题是每次关闭wsl2都会在wsl2当中丢失这四块磁盘的写入权限“只读”
需要在启动前wsl --mount才可以,有没有方法让他不丢失或者自动挂载呢?
@VrianCao 在 DeepSeek新模型网页端有效上下文约为88.5K Tokens 中发帖
[image]
[image]
这应该是真实有效的上下文大小了
测试文本为全新生成的一份随机单词TXT,正在进行大海捞针测试
文件预览:
[image]
@tumi 在 IOS 免越狱、免证书 远程控制硬件终于开发完了 中发帖
主要功能如下:
配合快捷指令实现充电自动启停,保护电池
配合上位机应用实现远程控制
主要开发工作:
原理图和PCB
编写和调试固件
制定网络控制协议
逆向投屏应用
编写和调试上位机应用
演示视频:
https://feishu.doubao.com/drive/file/UjG4bKZegoYwYAxxSsAcOVcinKg
硬件图片:
[微信图片_20260211182726]
固件界面:
[微信图片_20260211193654]
控制界面:
[微信图片_20260211182834]
[微信图片_20260211182915]
[微信图片_20260211183041]
阿钖 (@aayang) 在 Deepseek App上新模型了。 中发帖
[Screenshot_20260211_185852]
知识库更新到2025/5,正好我就拿2025/6的高考题考考祂。
[Screenshot_20260211_190010]
经过683秒的思考,作答如下:
[Screenshot_2026_0211_191812]
请我们的哈基米3Pro老师来批改一下:
[Screenshot_2026_0211_192330]
拿到了满分好成绩。
再看看opus4.6think老师呢?
[Screenshot_2026_0211_192907]
同样满分!
作为对比,我们来测试一下调用成本相近的哈基米3flash,看看祂能得几分?
[Screenshot_2026_0211_193614]
3Pro老师同样给到满分。但是我在第一次调用时答案是错误的。祂答到一半自己发现,然后就截断了。很诡异。同时,哈基米3flash的答...
@HCPTangHY 在 DeepSeek-V4-Lite-285B临时捞针结果 中发帖
[image]
DSA神力能保证在256K原生中保持100%,256以外稳定降低到60%,应该是DSA+拓展注意力
不过,本捞针已经被DSA作弊了,在V3.1和V3.2中都能256K满分,但实际用起来效果不佳。结果仅供参考哈
正在缓冲99% (@huanchong) 在 GLM领航员权益是否优于coding Max? 中发帖
GLM领航员权益
群内官方公示表彰,成为社区榜样
产品新功能优先体验资格
官方周边 / 定制礼品奖励
优先进入核心用户反馈通道,与产品 / 技术团队直接交流
[mmexport1770809525259]
那领航员的这个产品新功能优先体验资格。它是和codex Max同等级的还是优于coding Max的?
另外GLM-5开放内测了,但是不是对coding Max全部开放的,当时购买包年的Max的一大原因就是新功能抢先体验,那他这个内测完了是再放给Max,然后再给pro再全量开放吗?那还是说 内测完了就直接全量开放?
那我coding Max的新功能抢先体验权益有啥用?