https://linux.do 论坛的话题更新通知频道。
清蕴 (@197) 在 commandcode报错400 中发帖
commandcode报错400: {“message”:“{“error”:{“message”:“No available providers match the ‘only’ filter: deepseek. Available providers are: alibaba, azure, baseten, deepinfra, digitalocean, fireworks, gmicloud, novita, wafer”,“type”:“invalid_request_error”,“param”:{“modelId”:“deepseek/deepseek-v4-flash”}}}”,“type”:“invalid_request_error”}
这是怎么了,有人知道吗summer88 在 gpt 用不了啊,一直 slected model 中发帖
不是,你们都能用gpt吗?我的号放在自己用的cpa上,从早上还是就是 selected model,然后就是 503.中午睡醒干了十分钟活,又开始了。
二手iPhone贩子 (@lurenjia) 在 iPhone 18 系列发布了,要换机的可以过来问问行情了。 中发帖
iPhone 18 系列已经发布了, 全线涨价 1000, 想换机的可以过来问问行情。
此贴只分享二手手机行情!!!
enged (@q807738511) 在 求gemini pro 18个月 激活码使用教程 中发帖
如题 求gemini pro 18个月激活码使用教程,自用有注册12年的google邮箱(纯国内信息) 买的时候有的买家会写需要新的邮箱有的又不需要新账号说是直接激活兑换即可.然后再是我使用的agent是hermes 怎么将订阅转换成可用的API格式 听大佬们说要反代反重力 但是容易封那么针对上面邮箱的情况好处理吗: 谢谢各位大佬回答
雷雷雷雷雷 (@RaymondLei) 在 DeepSeek V4.1Flash:全新模型结构!更大参数,非对称结构,552B-A8B/16B 中发帖
[6ec26b3efa0ea430516d169c52b723c4]
lseraph 在 【讨论】DeepSeek V4.1 Flash 出了,大家体感咋样?希望这次能支棱起来 中发帖
今天 DeepSeek 发了 V4.1 Flash,Harness 也跟到了 v0.1.5。先问问佬友们:有没有已经用上的,体感如何?
主要是之前 4.0 那波感觉没太亮眼,挺希望这次它能真正支棱起来。加上这次价格降得不少,如果理想的话能当主力用。
欢迎佬友们聊聊真实体感🐦
CaiGbro (@1612632430) 在 Deepseek 下架Pro,我举双手赞成,以后最好也别上,除非算力充足 中发帖
作为 Deepseek 的忠实用户,对于 Deepseek 下架 Pro,我举双手赞成,以后最好也别上,除非算力充足。
Pro 所需要的算力是 flash 的好几倍,且不说Pro的实际质量与flash区别很小,更关键的是flash干活是真的够了。
想v4flash出来的那一会,价格极低,负载极大,即使是那样大的负载,体感上也只是在少量时段有所卡顿,如果把pro的算力全加给flash,我想即使负载再加两倍也能轻松应对。
pro可用可不用,但flash是真离不开啊,所以我宁愿 pro 不要,也要换 flash 的流畅和廉价。
我认为flash有两个根本的优点:
1.下限极高,智力稳定。遇到搞不定的问题,人来把控一下方向,摸索一下总能解决,几乎不出现乱搞的情况,最多搞不定。
2.快是真的快,不管是首字符响应还是吐字,那是真的快,这点真是天下无敌,体感极好。
对于2,我只在deeps...
DR.Cat (@o_cat) 在 deepseek v4.1正式推出~encoder-decoder架构文艺复兴引人注目 中发帖
DeepSeek V4.1 Flash:更强、更快、更普惠
分数
[0d68fbc08fd083f59581b433440d10e1]
[compressed_1789019798126]
模型开源链接:https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash论文链接:https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek_V41_Tech_Report.pdf
架构解读
[6d3935cb7a46bad1e50402bf954fd46d]
这次用上的encoder-decoder是一个亮点
现在大语言模型基本上都decoder-only 上一个encoder-decoder的佳作还是Google T5(广泛作为文生图/视频模型的文本...
@yuyapeng 在 两周限时折扣,体验 DeepSeek V4.1 Flash 中发帖
刚刚,DeepSeek V4.1 Flash 正式发布。
作为国内官方合作伙伴,CodeBuddy 国内版已经第一时间全面接入 DeepSeek V4.1 Flash,并提供为期两周的限时折扣优惠。
同时,CodeBuddy NPC 也 Day0 接入 DeepSeek V4.1 Flash。
DeepSeek V4.1 Flash 是一款文本与 Agent 性能全面提升、兼具原生多模态视觉理解能力的综合模型,拥有较小的参数规模和更低的成本,在性能、费用、速度、总用时等各项指标上全面超越 DeepSeek-V4-Pro 等更大尺寸的旗舰模型。
[b9f2f70f334659bb896dc5addd0b0be8]
LPK (@lpk3215) 在 codebuddy已经上线DeepSeek V4.1 Flash,也很耐用 中发帖
[b9f2f70f334659bb896dc5addd0b0be8]
体验了一下,速度很快啊,希望能力不弱吧,最近我也是经常使用国产模型,
riverxorange 在 我要给Gemini说对不起。 中发帖
话说最近在做市场研究,采集到了万余条数据,信誓蛋蛋拿我觉得巨强无比的Astra进行数据分析,结果出来的效果和5.6Sol时代差不多,分析不深入,还经常把prompt写图表上。然后整体没有什么逻辑,感觉在梦游。而且巨巨巨慢!!!一个修改指令要等它墨迹半小时。
于是楼主等待时间下回来反重力!然后把给Astra的Prompt复制给了3.8Flash,结果谷歌2分钟给我拉出来了!!!而且分析巨专业!巨丰富!像人话!还发现了我自己都没发现的数据关联,我一开始还以为它流口水编的。
现在正准备让Astra抄Gemini作业。
看来fast rock还是work的。
由于结果涉密,就不给大家呈现了。仅截取部分片段。
[image]
[image]