找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4.1 Flash:更强、更快、更普惠 | 大模型讨论专楼

 火... [复制链接]
     
发表于 2026-9-20 13:18 | 显示全部楼层
真红之闪电 发表于 2026-9-20 13:06
不要想,达芬奇最新版开了 MCP,你可以看下官方怎么描述的 AI能做什么。另外,不要期望速度。
当然,要看 ...

常常要做软件演示,有一些界面和操作素材, 手扣AE是效果挺满意的,但是急活就sd出了,还是得剪,想一懒到底。
回复

使用道具 举报

     
发表于 2026-9-20 13:45 来自手机 | 显示全部楼层
qwenimage2.1要开源了
看看能不能打过krea2

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-20 14:06 来自手机 | 显示全部楼层
hugosol 发表于 2026-9-20 12:42
我Jev账号申请下来了,每个月送5美金额度,还没想好怎么玩
之前做的记忆系统有用llm打分的,能换成这个模 ...

要极端一点,任何答案可以被转换为数值评价/答案为有限范围的问题都可以转换为Jev调用

不过目前实际上受限于上下文长度(25k),另外也不确定这个模型的语义理解能力和前沿LLM有多大差距。种种迹象表明Jev的参数量应该很小
回复

使用道具 举报

     
发表于 2026-9-20 14:10 | 显示全部楼层
本帖最后由 真红之闪电 于 2026-9-20 14:11 编辑
尼曼兔 发表于 2026-9-20 13:18
常常要做软件演示,有一些界面和操作素材, 手扣AE是效果挺满意的,但是急活就sd出了,还是得剪,想一懒 ...

这种我感觉你可以用 AI 直接生成啊。我之前就有片子懒得调色,让 Codex 直接调色。完全不通过剪辑软件。
就是它会通过 FFMPEG 去出片子的。
—— 来自 S1Fun
回复

使用道具 举报

     
发表于 2026-9-20 14:11 | 显示全部楼层
相见恨晚 发表于 2026-9-20 12:23
为啥啊,我看workbuddy太烂,trae又快倒闭了,就想买这个qoder cn了,请指教

软件问题,qoder仿的vs code,思路过时而且太重了。
我用起来反正非常不顺手
回复

使用道具 举报

发表于 2026-9-20 14:12 | 显示全部楼层
glm3.5flash在晟腾a3本地部署老是挂,啥时候出正式版
回复

使用道具 举报

     
发表于 2026-9-20 14:24 | 显示全部楼层
andychen 发表于 2026-9-20 14:06
要极端一点,任何答案可以被转换为数值评价/答案为有限范围的问题都可以转换为Jev调用

不过目前实际上受 ...

啥,上下文只有25K吗,那限制太大了
其实我觉得思路应该往实时性方面走,不然跟我直接用别的模型没啥区别
这个模型的判断能力理论上处在LLM的一个最准确的区域,有限输出套个壳其实能衍生出非常多的玩法,但问题是如果上下文真的只有25K其实限制还挺大的
或者换个思路,就是做些用脚本判断要写非常复杂逻辑的任务,直接自然语言丢给LLM判断,感觉也不错
回复

使用道具 举报

     
发表于 2026-9-20 14:32 | 显示全部楼层
neptunehs 发表于 2026-9-20 13:45
qwenimage2.1要开源了
看看能不能打过krea2

应该不能,qwen image是走图文混排路线的
目前的测试图看起来就是gpt-image-2蒸馏拉满
回复

使用道具 举报

     
发表于 2026-9-20 14:36 | 显示全部楼层
国内客户端这块已经结束比赛了吗?kimi work , trae work 啥的还有人用吗
回复

使用道具 举报

     
发表于 2026-9-20 14:40 | 显示全部楼层
我的AI帮我找了篇测试的文章,结论是jev速度快但没那么快,准确率一般,最大的优势是知道自己不知道。
https://wotai.co/blog/typesafe-jev-vs-claude-haiku-tested
回复

使用道具 举报

     
发表于 2026-9-20 14:50 来自手机 | 显示全部楼层
我自己用下来虽然workbuddy虽然有这个那个问题,实际上是目前最好用的。

阿里的qoder,可以用的模型太少

字节的trae,很多人拼写和发音都对不上,传播度烂完了。然后内部也放弃了,新的模型都不上,全部转到字节办公去了。

workbuddy除了有时候跑本地任务的时候卡一点,其实真没啥问题。对新手很友好

—— 来自 HONOR PTP-AN70, Android 17, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-9-20 15:05 | 显示全部楼层
cody198879 发表于 2026-9-20 14:50
我自己用下来虽然workbuddy虽然有这个那个问题,实际上是目前最好用的。

阿里的qoder,可以用的模型太少

事实就是这样,纯论产品能力,这些人是真的卷不过腾讯……
回复

使用道具 举报

     
发表于 2026-9-20 15:31 | 显示全部楼层
问下有没有读取游戏内文字信息的软件?比如一封信或者一本书的内容,这都不会有语音,但是几百个字看着累啊
回复

使用道具 举报

     
发表于 2026-9-20 15:36 来自手机 | 显示全部楼层
zerona 发表于 2026-9-20 15:31
问下有没有读取游戏内文字信息的软件?比如一封信或者一本书的内容,这都不会有语音,但是几百个字看着累啊 ...

最简单的就是当个拍屏党,豆包就能干的很好
回复

使用道具 举报

     
发表于 2026-9-20 15:59 | 显示全部楼层
其实hermes做表格和文档又快又好
回复

使用道具 举报

     
发表于 2026-9-20 16:00 来自手机 | 显示全部楼层
本帖最后由 tillnight 于 2026-9-20 16:02 编辑

我其实也不懂workbuddy有什么好黑的。不充钱白嫖开箱即用,界面虽然不算特别干净,但是在大厂harness里已经算清爽的了。充钱了给你api外接,连嫌弃workbuddy本体的问题都没了,国产开源模型齐全而且上新快,以后不好说现在推广期有额外每日积分,实际上是目前正规订阅里最便宜的v4.1f和k3。

评分

参与人数 1战斗力 +2 收起 理由
gooyoy + 2

查看全部评分

回复

使用道具 举报

     
发表于 2026-9-20 16:28 | 显示全部楼层
其实我只是嫌workbuddy启动执行都卡,而且其他agent配置起来也不麻烦
回复

使用道具 举报

     
发表于 2026-9-20 16:33 来自手机 | 显示全部楼层
纯办公的人哪有能力配置,哪里不会点哪里才是真的。

用了下千问办公,没有4.1flash,我感觉慢的都要死了

—— 来自 HONOR PTP-AN70, Android 17, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-9-20 16:47 | 显示全部楼层
服务器繁忙,请稍后重试

咋地了这是 我八股文还没造完呢
回复

使用道具 举报

     
发表于 2026-9-20 16:49 | 显示全部楼层
大肥鲸炸了,大的要来了?
回复

使用道具 举报

     
发表于 2026-9-20 16:49 | 显示全部楼层
期待一下
回复

使用道具 举报

     
发表于 2026-9-20 16:53 来自手机 | 显示全部楼层
我用了下千问办公,感觉还可以,确实没v4.1f的速度,干完活还是行的。
我自己这边是各种agent转着圈用,只有Hermes是保底不换的。
千问这种办公的是打算看看哪个够无脑,推给公司其他人用。

——来自 2410DPN6CC 上的 S1er 客户端
回复

使用道具 举报

     
发表于 2026-9-20 16:54 | 显示全部楼层
你们的4.1f炸了吗?我这一直重试,连上了也是一点点往外蹦
大的要来了难道是之前说的被举报的事吗
回复

使用道具 举报

     
发表于 2026-9-20 16:55 | 显示全部楼层
办正事呢,这闹的
回复

使用道具 举报

     
发表于 2026-9-20 16:55 来自手机 | 显示全部楼层
好像是炸了,正在跑项目……

—— 来自 HUAWEI SGT-AL10, Android 12, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-20 17:04 | 显示全部楼层
恢复了,无事发生
回复

使用道具 举报

     
发表于 2026-9-20 17:04 | 显示全部楼层
外包兄弟里的4.1f没炸呀
回复

使用道具 举报

     
发表于 2026-9-20 17:25 | 显示全部楼层
crow_wine 发表于 2026-9-20 17:04
外包兄弟里的4.1f没炸呀

估计藤子有卡和官方合作部署了吧
倒是刚在群里有人说opencode go的glm5.3f跟着炸了没绷住
回复

使用道具 举报

     
发表于 2026-9-20 17:37 来自手机 | 显示全部楼层
炸了只代表有可能一段时间后来大的,不是马上就要来大的啊
回复

使用道具 举报

     
发表于 2026-9-20 17:40 来自手机 | 显示全部楼层
有api无关的agent吗,专攻视频生成的那种

—— 来自 鹅球 v3.3.96
回复

使用道具 举报

     
发表于 2026-9-20 17:57 | 显示全部楼层
应该不是大的,今天梁文谷,DS不上班的
回复

使用道具 举报

     
发表于 2026-9-20 17:58 | 显示全部楼层
阶跃星辰出了一个新模型Step 5 Preview, 理论来说可以白瓢一个月, 我晚上回去看看效果
邀请链接:  https://platform.stepfun.com/?invite_code_v2=VEVFIRGZ
回复

使用道具 举报

     
发表于 2026-9-20 18:11 来自手机 | 显示全部楼层
hugosol 发表于 2026-9-20 14:24
啥,上下文只有25K吗,那限制太大了
其实我觉得思路应该往实时性方面走,不然跟我直接用别的模型没啥区别 ...

简单场景下的限定应用目前应该是最合适的

比如目前LLM做信息提取仍然有一定的幻觉概率,以前我是安排固定时间进行一次全量复核,现在则是用Jev做实时核查,流程更简化了。初步测试显示时间和金钱开销下降,准确率也有提升

目前还在测试一些语义级分类,例如给出特定信息,要求Jev给出矛盾/互证/无关的判断。这类应用高度依赖模型的语义理解能力,目前我测试下来和DS4.1f比准确率是上升的,时间成本更是从数十秒压缩到了数百毫秒

评分

参与人数 1战斗力 +2 收起 理由
hugosol + 2 感谢分享!

查看全部评分

回复

使用道具 举报

     
发表于 2026-9-20 18:15 来自手机 | 显示全部楼层
workbuddy对我最大的问题就是他自己塞的提示词太多也太诡异了,导致他输出的文本和dsh或者codex输出的文本相差太远,甚至都不是质量问题,而是输出方向不同

—— 来自 鹅球 v3.3.96
回复

使用道具 举报

     
发表于 2026-9-20 18:23 来自手机 | 显示全部楼层
rayaxu 发表于 2026-9-20 18:15
workbuddy对我最大的问题就是他自己塞的提示词太多也太诡异了,导致他输出的文本和dsh或者codex输出的文本 ...

每次看workbuddy那个初始提示词在新对话里的巨大占用量就很难绷,都浪费在每轮调查后的html总结还有莫名给出的图表展示,还有新对话必吃的“把昵称和城市交代一下”
回复

使用道具 举报

     
发表于 2026-9-20 18:36 | 显示全部楼层
mimo 的直播训练deepswe刷到72分了
回复

使用道具 举报

     
发表于 2026-9-20 18:50 | 显示全部楼层
cody198879 发表于 2026-9-20 14:50
我自己用下来虽然workbuddy虽然有这个那个问题,实际上是目前最好用的。

阿里的qoder,可以用的模型太少

Trae 一直在更新,它跟 Workbody 在模型的丰富度上,实际上是各有千秋的。

Trae 独有:字节 seed以及千问的 Qwen 大模型,

Workbody 独有: HY 混元模型。

trae 和 WorkBuddy 都有的模型: GLM、deepseek、Minimax 的模型    Re:Source
回复

使用道具 举报

     
发表于 2026-9-20 18:52 | 显示全部楼层
本帖最后由 zyjzhzyh 于 2026-9-20 18:59 编辑

在我看来 Trae 和 Workbody 都相对比较臃肿,他们都有自带的 MCP、skill 等,比如 trae 默认安装了 HTML report,触发率很高,普通的咨询类问题都会被写成图文 report,但是这也导致拖慢了回答速度   


Workbody 有更多的自带的各种 MCP,各种各样的软件和“专家”、模板库,看起来太花眼了。

这两个都突出一个开箱自用、小白友好,但不适合要求高的个人开发者,它的独有优势在于腾讯系和字节系的生态。比方说 Workbody 连腾讯的 IMA 或者腾讯文档,字节 Trae 可以连飞书。 Re:Source
回复

使用道具 举报

     
发表于 2026-9-20 18:56 | 显示全部楼层
zyjzhzyh 发表于 2026-9-20 18:52
在我看来 Trae 和 Workbody 都相对比较臃肿,他们都有自带的 MCP、skill 等,比如 trae 默认安装了 HTML re ...

在大模型的能力变得越来越强的未来,这些额外的臃肿的这些 skills、系统提示词、 MCP 可能反而会拖慢

但是反过来, Trae 和 Workbody 又有一些方便的小功能,比如说都有自己的手机app    Re:Source
回复

使用道具 举报

     
发表于 2026-9-20 19:33 来自手机 | 显示全部楼层
请问现在买哪家的coding/token plan性价比比较高?倾向于那种有多家模型可用的,是opencode go吗?很久之前听说阿里、火山的别家模型不是量化版就是限制上下文长度最好是100以内/月的,再贵就直接上gpt的Plus了

—— 来自 HONOR BKQ-AN00, Android 16, 鹅球 v4.0
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-9-23 08:19 , Processed in 0.203149 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表