Su7 发表于 2025-6-15 10:17

DeepSeek怎么越迭代越拉了。

以前用的时候还没这么明显,现在给出的数据参考全是一本正经口胡。只能当聊天机器人和翻译工具用了

pigsy 发表于 2025-6-15 10:19

jaewoongh_ 发表于 2025-6-15 10:19

佛剑分说 发表于 2025-6-15 10:38

数据有关的东西本来就不该让它们来做阿,事实性的东西得你自己做,不然还得自己再审一遍查一遍,反而更累。
它们比较擅长帮你梳理、修辞、排版、注水、说漂亮话这些

eulereld 发表于 2025-6-15 10:40

用下來覺得推理模型的幻覺問題比非推理模型嚴重

億万千 发表于 2025-6-15 10:47

中文使用我觉得gemini(pro)是比较好的

毒品 发表于 2025-6-15 10:53

数据类的先用深度搜索,再用大模型注水就好了

tk553521 发表于 2025-6-15 10:54

新r1写**在我这已经和0605持平了,中文古风涩涩还是r1舒适区。

—— 来自 Sony XQ-AT72, Android 12, 鹅球 v3.5.99-alpha

俾斯麥 发表于 2025-6-15 10:55

公交车容易得性病

chovc 发表于 2025-6-15 11:05

单论翻译的话gpt更差、不过gpt图片识别解析准确率相当高

Zurlg 发表于 2025-6-15 11:05

咋还在把AI当成搜索引擎来用啊……ds强的是推理,要用户自己去收集数据,然后喂给DS,让DS从这些数据里推理出用户想要的东西

eulereld 发表于 2025-6-15 11:13

Zurlg 发表于 2025-6-15 11:05
咋还在把AI当成搜索引擎来用啊……ds强的是推理,要用户自己去收集数据,然后喂给DS,让DS从这些数据里推理 ...

有這個認知知道ds 是推理模型、更應該用來做什麼怎樣用的人感覺不多
接上了即時搜尋功能是為了不讓結果局限在喂給模型的舊資料吧,推理模型該怎麼用還得怎麼用

发呆的龙虾 发表于 2025-6-15 11:18

tk553521 发表于 2025-6-15 10:54
新r1写**在我这已经和0605持平了,中文古风涩涩还是r1舒适区。

—— 来自 Sony XQ-AT72, Android 12, 鹅球 ...

0605不是不如原版2.5pro吗?

—— 来自 HUAWEI BRA-AL00, Android 12, 鹅球 v3.5.99

gearh 发表于 2025-6-15 11:26

关掉搜索试试

yvev 发表于 2025-6-15 11:33

看回帖的评价,怎么感觉LLM永远都是知道LLM的人才用得好,所谓大一统一键智能服务的饼还是遥遥无期啊

艾诺琳 发表于 2025-6-15 11:39

api加知识库,日常工作没问题

联网搜索信息污染太多了

lovepenny 发表于 2025-6-15 11:42

话说DS读的懂图纸吗?

----发送自 realme RMX3800,Android 15

瓦拉几亚之夜 发表于 2025-6-15 11:47

联网越多越拉,不是DS配不上人类,是人类配不上DS

艾诺琳 发表于 2025-6-15 11:52

lovepenny 发表于 2025-6-15 11:42
话说DS读的懂图纸吗?

----发送自 realme RMX3800,Android 15

不行,ds不是多模态模型,读图用豆包

凉良 发表于 2025-6-15 11:54

大模型如此之好 但是人类用来把互联网搞得一塌糊涂 真的太可惜了

jojog 发表于 2025-6-15 12:16

benchamrk是刷题不是解决问题,可不是越来越拉

啥都控星人 发表于 2025-6-15 13:22

因为训练语料主要来自于百度贴吧等()社区

Nanachi 发表于 2025-6-15 13:24

大模型幻觉日常

松开的鞋带 发表于 2025-6-15 14:31

艾诺琳 发表于 2025-6-15 11:39
api加知识库,日常工作没问题

联网搜索信息污染太多了

现在搭建知识库有上传分析再回传结果的吗?之前ragflow自己跑硬件根本带不动

ppntint 发表于 2025-6-15 14:38

想专业的据说API+自己上传知识库最好

库德里尔 发表于 2025-6-15 16:24

你用大语言模型
不是学生向老师请教,像有问必答机一样一切问题都有回答
而是导师给学生下发资料让他做研究,以及查一些简单的东西

记住这一点才能真正提高效率

—— 来自 OPPO PEDM00, Android 14, 鹅球 v3.5.99

Hydro 发表于 2025-6-15 17:25

我在文本生成模型还没大规模商用的时候,因为那时候在做类似研究,就大概已经预料到大模型的有效性会随语料库被开采完而达到上限(它自己无法推理出有效的新知识,而靠人类强化学习的又太慢且质量没法保证,后续归因的话是这样)
开始时会有一个爆发式的增长,但是后续放缓是必然的甚至接近完全停滞
但尽管如此,我不知道为什么后续大模型会无限进化的错觉还是如此严重,就因为传播上这东西叫"AI"??

lambl 发表于 2025-6-15 18:47

发呆的龙虾 发表于 2025-6-15 11:18
0605不是不如原版2.5pro吗?

—— 来自 HUAWEI BRA-AL00, Android 12, 鹅球 v3.5.99

神马原版2.5pro,原版2.5pro还没出呢,6.19才出。

发呆的龙虾 发表于 2025-6-15 19:56

lambl 发表于 2025-6-15 18:47
神马原版2.5pro,原版2.5pro还没出呢,6.19才出。

我指的是最初的那个2.5pro的预览版,后面不是又出了0506和0605,我看评价好像后面两版不如初版。

—— 来自 HUAWEI BRA-AL00, Android 12, 鹅球 v3.5.99

艾诺琳 发表于 2025-6-15 19:58

松开的鞋带 发表于 2025-6-15 14:31
现在搭建知识库有上传分析再回传结果的吗?之前ragflow自己跑硬件根本带不动 ...

学校信息老师搭建的,具体细节我不清楚

但是能批改主观题爽爆

bonnwang 发表于 2025-6-15 20:07

春节那版才是完全体
现在都是阉割版

松开的鞋带 发表于 2025-6-15 21:33

艾诺琳 发表于 2025-6-15 19:58
学校信息老师搭建的,具体细节我不清楚

但是能批改主观题爽爆

那硬件肯定很给力,不是我这种个人用户能比得了的了。

lambl 发表于 2025-6-15 22:46

本帖最后由 lambl 于 2025-6-15 22:48 编辑

发呆的龙虾 发表于 2025-6-15 19:56
我指的是最初的那个2.5pro的预览版,后面不是又出了0506和0605,我看评价好像后面两版不如初版。

——...
那个是0325啊,那个本来就不错,0506不如他,但是满血的0325也没了。但是现在用下来最强的还是kingfall,可惜被下架了。

放大镜 发表于 2025-6-16 01:03

之前用AI找过一次曲谱,试了3家,1家表示有版权隐忧拒绝回答,1家答非所问

最后这一家就厉害了,他自己给我现编了一段……

页: [1]
查看完整版本: DeepSeek怎么越迭代越拉了。