千千千千鸟 发表于 2025-12-1 23:02

什么!?写文超越gemini3.0了吗,粱圣无敌

晨灯 发表于 2025-12-1 23:16

本帖最后由 晨灯 于 2025-12-1 23:18 编辑

八股程度有所降低,但指令理解与记忆力依然不太行。
自己总是乱加戏的问题也依然在,常添加没有的剧情与设定。
目前来看,还是不太时候在有预期方向的情况下使用,纠正起来尤其耗时。

gawain 发表于 2025-12-1 23:20

感觉现在算力基础上极限了。不知道往后还能怎么突破

名居守 发表于 2025-12-1 23:26

如果不想让ds乱加戏,可以自己写一篇长大纲让ds润色以及“不能新增剧情”基本就不会乱写了,偶尔会幻觉下,大部分情况下其实很稳定了。
但是创作性只会基于自己的大纲了没那么灵活了

a4ac7 发表于 2025-12-1 23:39

试了下,挺不错了,一年前我记得没有模型能写出我感觉及格的场景

—— 来自 HUAWEI PLA-AL10, Android 12, 鹅球 v3.5.99

羊寢 发表于 2025-12-1 23:41

不喜欢ai自己加戏可以试试glm4.6,这模型是完全按你给的剧本来写,对我来说ds这种会自己加剧情的ai反而是我的好球区,有时候他的一些点子可能比我原本构想的剧本还要好

我特么吹爆 发表于 2025-12-1 23:47

经过上次的吐槽之后我现在只让ds给我提供灵感
结果他什么都不懂啊,给的都什么几把建议

羊寢 发表于 2025-12-2 01:56

木法莎 发表于 2025-12-1 23:00
搞涩涩如何

据说能有3.1t那种程度?不过类脑那边今天大多都是在测sfw,平时玩nsfw最狠的那几个在测代码和召回率偶然看到有一个说nsfw和3.1t差不多,如果是真的那确实王朝了,3.1t的nsfw确实写得很好

无尽的牙刷 发表于 2025-12-2 02:47

刚用Speciale本地化了个谐音笑话,思索了3分钟,思考过程1w字左右,前后探索了快10个方案,最后给出的答案很完美,不像之前用的其他模型经常思索着思索着就把自己绕进去了
同样的问题也问了gemini3跟克劳德,结果都不尽人意

—— 来自 vivo V2024A, Android 13, 鹅球 v3.5.99-alpha

wlhlz 发表于 2025-12-2 07:35

木法莎 发表于 2025-12-1 23:00
搞涩涩如何

跟自己比的话堪称飞跃式进步

—— 来自 鹅球 v3.3.96

行政裁定书 发表于 2025-12-2 08:52

目前单次能分析10万字?

不知何时能分析30万字以上

这不科学 发表于 2025-12-2 10:32

看了一下,还是不如gemini

bixinhaner 发表于 2025-12-2 10:36

现在写sese用什么好呢?酒馆那种角色对话式的感觉还是挺别扭,也写不了长文。有能像grok那种可以直接自己写提示词的吗

王兰花秀丽 发表于 2025-12-2 10:38

目前正式版上下文多少了

—— 来自 Xiaomi 23127PN0CC, Android 16, 鹅球 v3.5.99-alpha

脸宽 发表于 2025-12-2 10:46

gemini cli申请一直下不来,那就玩deepseek

千秋难诉 发表于 2025-12-2 10:49

有点强,甚至有第二次deepseek冲击的水平

近距离作战 发表于 2025-12-2 10:59

用同样的提示词翻新了一下之前写的nsfw,上下文逻辑性大幅提升,就算是擅自增加的部分也能在框架内圆回去,文笔这块比3.1和grok4都强。

黑哥啥时改密码 发表于 2025-12-2 11:10

翻译小说或者游戏,哪个模型的效果最好?

无尽的牙刷 发表于 2025-12-2 11:26

黑哥啥时改密码 发表于 2025-12-2 11:10
翻译小说或者游戏,哪个模型的效果最好?

轻量使用就直接ds,除非你的提示词很长还要加进去一大串的名词表,不然没有本质的差距
想达到最好的效果就让ds或gemini翻译了,另一个校对,最后再让claude检查一遍

对羟基笨甲酸 发表于 2025-12-2 11:48

试了一下写文,给出框架的情况下和gemini3差不多,够用了

Litccc 发表于 2025-12-2 11:54

目前玩下来的感觉是写文最好给一个大纲,而不是给一句话进行扩写,3.2喜欢擅自增加剧情,当然这点也是见仁见智,有时候deepseek给的剧情推进比我自己想的好

med 发表于 2025-12-2 12:05

用来英文论文写作和改文章,academic方面gpt比ds整体好用一些,但是局部ds能改的更好

fsckamui 发表于 2025-12-2 12:27

无尽的牙刷 发表于 2025-12-2 11:26
轻量使用就直接ds,除非你的提示词很长还要加进去一大串的名词表,不然没有本质的差距
想达到最好的效果 ...

感觉小日子那片假名名词,不给额外备注别说ai了 专业翻译都搞不懂

狭义文具爱好者 发表于 2025-12-2 12:48

fsckamui 发表于 2025-12-2 12:27
感觉小日子那片假名名词,不给额外备注别说ai了 专业翻译都搞不懂

片假名名词ai翻译处理的其实还过的去,游戏和长文翻译的主要问题在于,上下文和长文注意力不够的情况下,专有名词很容易前后不统一

爱护动物抓根宝 发表于 2025-12-2 13:04

ds真不做多模态了吗,至少把ocr集成一下吧

发呆的龙虾 发表于 2025-12-2 13:29

试了一下,不知道是不是我的api问题,写文感觉完全不如gemini3.0pro

—— 来自 HUAWEI BRA-AL00, Android 12, 鹅球 v3.5.99

亚瑟摩根 发表于 2025-12-2 13:46


洛拉斯 发表于 2025-12-2 13:49

亚瑟摩根 发表于 2025-12-2 13:46


把思考拉出来看看

亚瑟摩根 发表于 2025-12-2 13:50

说起写文,年初我用克劳德当时应该是3吧还是多少,文笔确实可以,但是整个故事结构和剧情起承转合太白开水了

后来6月用哈吉米2.5pro,我记得那会刚出吧,哈吉米2.5Pro当时真的无敌了,让我玩的茶饭不思

不过后来3出来以前,9月以后,哈吉米2.5p蠢的跟狗一样,将就玩了

亚瑟摩根 发表于 2025-12-2 13:56

本帖最后由 亚瑟摩根 于 2025-12-2 13:57 编辑

洛拉斯 发表于 2025-12-2 13:49
把思考拉出来看看
拉出来了

overflowal 发表于 2025-12-2 14:03

亚瑟摩根 发表于 2025-12-2 13:46


模型没有元认知

—— 来自 鹅球 v3.4.97

claymorep 发表于 2025-12-2 14:07

现在问他是谁这一招对大模型已经没用了

—— 来自 鹅球 v3.5.99-alpha

飛霞精灵 发表于 2025-12-2 14:15


网页版试了一下。

蜇灵 发表于 2025-12-2 14:19

写代码效果咋样,vsc里面有免费的通义灵码用,有必要换成DS的API吗?

mitzvah 发表于 2025-12-2 14:28

本帖最后由 mitzvah 于 2025-12-2 14:31 编辑

蜇灵 发表于 2025-12-2 14:19
写代码效果咋样,vsc里面有免费的通义灵码用,有必要换成DS的API吗?
swe分73.1,那肯定比qwen那堆高分低能的玩意强多了。这东西的代码agent能力强过grok和gpt5.1,也就比gemini3 pro和claude4.5比差一些

蜇灵 发表于 2025-12-2 15:01

mitzvah 发表于 2025-12-2 14:28
swe分73.1,那肯定比qwen那堆高分低能的玩意强多了。这东西的代码agent能力强过grok和gpt5.1,也就比gemin ...

一般是用啥来调用API,Cline吗?

mitzvah 发表于 2025-12-2 15:21

蜇灵 发表于 2025-12-2 15:01
一般是用啥来调用API,Cline吗?

我觉得kilocode和roocode比cline好用,可以自定义模式,开子任务嵌套扩展上下文空间,通义灵码我觉得是真简陋

蜇灵 发表于 2025-12-2 15:24

mitzvah 发表于 2025-12-2 15:21
我觉得kilocode和roocode比cline好用,可以自定义模式,开子任务嵌套扩展上下文空间,通义灵码我觉得是真 ...

通义灵码是很简陋,他那个定位代码功能我这里就没正常过,每次点了都没用,还得我自己翻

mitzvah 发表于 2025-12-2 15:25

而且阿里的东西先用后付钱,一不当心就扣了几百块,到月底账单送过来就知道它有多坑爹了,除了qwen max 以外agent代理能力也不见得比本地部署的glm4.5air q4强多少。qwen30b thinking或者code instruct 更是差远了

mitzvah 发表于 2025-12-2 15:29

本帖最后由 mitzvah 于 2025-12-2 15:35 编辑

蜇灵 发表于 2025-12-2 15:24
通义灵码是很简陋,他那个定位代码功能我这里就没正常过,每次点了都没用,还得我自己翻 ...
我用glm4.5air q4版,搜索工具能力基本可以满足需求,但是代码库索引的rag基本上就是废物,开了还不如不开。roocode,kilocode本质上是一个玩意,在glm4.5air 驱动下搜索工具和上下文压缩都工作的很正常,但是qwen30bthinking,和qwen3 code就不行,qwen3 max 先用后付被骗了两百块,亏大了,同样的钱开glm4.6包月服务可以开一季度任用,几十亿token都给你爽玩。qwen3 max我意识到不对即时关闭,只跑了一个小时几M就被骗两百块
页: 1 [2] 3
查看完整版本: DeepSeek V3.2 正式版发布