现在的DeepSeek V4.1 Flash 很像 GPT5.4 的时候,根本不知道在说些什么, 总会造一些不存在的词, 经常使用不常用且特殊的语法,输出内容繁杂。
感觉只适合用来做调用工具完成一次性工作, 不适合项目规划、分析代码和解读文档这类工作。
例如逆向一个嵌入式固件、安装 ASR 模型来本地语音识别都完成得很好。
只要任务的最终产出不是文字就好用, 一旦产出的内容是文字需要人去看时就很痛苦。
现在的DeepSeek V4.1 Flash 很像 GPT5.4 的时候,根本不知道在说些什么, 总会造一些不存在的词, 经常使用不常用且特殊的语法,输出内容繁杂。
感觉只适合用来做调用工具完成一次性工作, 不适合项目规划、分析代码和解读文档这类工作。
例如逆向一个嵌入式固件、安装 ASR 模型来本地语音识别都完成得很好。
只要任务的最终产出不是文字就好用, 一旦产出的内容是文字需要人去看时就很痛苦。
1
yidinghe PRO DeepSeek 蒸馏出来之后应该修改一下措辞方式。GPT 他们是为了节省输出 token 而这么做的。
|
2
maolon 10h 19m ago |
3
strobber16 9h 57m ago
这是好事。说明 AI 开始抛弃自然语言的劣势,开始改良出自己的语言了。很快 LLM 就会发明只有 LLM 能看懂的语言
|
5
mosfet 9h 49m ago
是的,比如让我调试时注意 3 个变量,他是这么表述
“上车时重点看三个量” 它给的优化思路和 gpt 6 astra medium 差不多 但实际修改的结果反而还 flash 的好。gpt 6 的太绕了,在原有的基础上又耦合了一堆东西,实测问题很多,让它修又开始水多了加面 所以,重要问题,还是各家交替着抽奖的好 |
6
ASHYWHISPER 9h 46m ago
|
7
mobpsycho100 9h 11m ago
Claude 给我整恶心了, A\是真该死啊
|
8
tomchen 9h 9m ago
“夹具”百分之一万是从 Claude 学来的😂
|
11
catazshadow 8h 49m ago via Android
@mobpsycho100 这跟 anthropic 有什么关系?
|
12
mingtdlb 8h 48m ago
早上深度用了一早上,完全就是已读乱回,傻快...
|
13
bencool 8h 47m ago
夹具在工业生产 很采用
|
15
yidinghe PRO |
16
qxmqh 7h 22m ago
哈哈 我也发现了 现在 gpt6 也有这种问题,我读起来 有时候很费劲。
|
18
handsome198311 5h 34m ago
上个月充了 50 块,在 VS Code 中用 deepseek 4.0 flash ,和它对话,同时看它推理,突然出现 “正在贿赂仓鼠”,然后立即撤回了,实际上的效果比 GPT 5.4 差,废话超多,解决问题慢,容易钻牛角尖(走弯路),用 GPT 十分钟解决的问题,它能搞几个小时。
|
19
bryceli 4h 45m ago
和 glm-5.3-flash 哪个好用点
|
20
nakun233 4h 41m ago 印象中以前 opus/fable 是最人话的,astra 有点机械味,还会构词
|
22
Kale 4h 16m ago
@handsome198311 我真怀疑你是否真用过了。
|
23
satoru 4h 6m ago
@yidinghe 哈哈,试了一下,用 "Spring 豆” 还多占个 token
In [28]: enc.encode('Spring Bean') Out[28]: [30099, 48157] In [29]: enc.encode('Spring 豆') Out[29]: [30099, 57697, 228] |
24
zhaoziling 3h 43m ago
对的,对的,这几个 AI ,都有这个问题,我体感 claude 最严重,chatgpt 次之,grok 和 deepseek 差不多,gemini 就不错了,豆包最好
特别是比较复杂的问题,claude 和 chatgpt 喜欢生造新词,逻辑曲里拐弯,看起来特别费脑子, |
25
killadm 2h 28m ago
|
26
victorc 2h 20m ago
是的,我早就有这个体会,开始是在 claude ,gpt 上,后面发现国产 glm 也是一个调调,很明显是蒸馏
只有豆包说人话 |
27
zuokanyunqishi 59 mins ago
哈哈,AI 文,AI 看的懂,人看了真心难受
|