找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4.1 Flash:更强、更快、更普惠 | 大模型讨论专楼

 火... [复制链接]
     
发表于 2026-9-7 08:49 | 显示全部楼层
浪子龙飞z 发表于 2026-9-7 01:53
我会翻墙也会海外付款,我就想要个性价比方案,gpt 怎么个性价比法呢

订阅+两三天重置一次额度,国内模型斩杀线对比图都是拿oa两家的api价格比的,实际上绝大部分人用的都是coding plan,api价格是coding plan的20-70倍,拿coding plan对比国模确实是没有性价比

—— 来自 S1Fun
回复

使用道具 举报

     
发表于 2026-9-7 08:52 来自手机 | 显示全部楼层
cscbzcbz 发表于 2026-9-7 06:05
只要灰测模型发出来,一切都会好起来的
如果GPT真的又好又便宜,梁子会降价的吧毕竟毛利是够的,只是怕需求 ...

并非没有代差,astra已经是openai七月份练出来的,现在openai的“灰测”模型是那个10t的bel,我感觉现在国内外的算力差距表现甚至更加明显了

—— 来自 OnePlus PKG110, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-7 08:53 | 显示全部楼层
真红之闪电 发表于 2026-9-7 08:26
DS 不 care 啊

—— 来自 S1Fun

还是care的,之前四小时会议梁子不是说降价他们内部是欢呼的吗
我理解就是技术人员希望自己的成果被更多人用的朴素感情
回复

使用道具 举报

     
发表于 2026-9-7 08:56 | 显示全部楼层
就说GLM5.3-Flash怎么这么慢呢,原来租的是海光的卡……
回复

使用道具 举报

     
发表于 2026-9-7 08:57 | 显示全部楼层
漏油都是第一次知道gpt的token效率高么
之前5.5和sol就是这样啊,gpt的token效率高于同代的Claude,更高于国模不少。
每个token的效率和每个token的计算消耗是两回事,又不代表token消耗低了就算力消耗低了。
不如说“高token效率”是gpt一直在走的技术路线。

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-7 08:57 | 显示全部楼层
bixinhaner 发表于 2026-9-7 08:43
不走雷霆大思考,更少token更高能力。这个方向业界走通的话,是不是存储内存价格就见顶了。 ...

我猜这个就是那个loop transfomer的技术带来收益,可能雷霆大思考但是在loop里被内部消化掉了,给你表现的只有只有最后一次loop的结果
回复

使用道具 举报

     
发表于 2026-9-7 09:04 来自手机 | 显示全部楼层
本帖最后由 Fuero 于 2026-9-7 09:09 编辑

Astra确实好用,虽然比方很怪,但我有种打车打到保时捷的感觉,等嫖公司token

开推一看提宝又赢了
We've made some improvements that improve usage on the long tail for power users of Astra when logged in with your ChatGPT account.

No change in quality and a pure win that on the long tail can result in up to 3-4X less usage being drawn from the subscription.
回复

使用道具 举报

     
发表于 2026-9-7 09:10 来自手机 | 显示全部楼层
CCauchy 发表于 2026-9-7 01:00
早晚7那个?那个分用户组的,core不限

论坛助手,iPhone

哈?那么怎么升core呢

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-7 09:14 来自手机 | 显示全部楼层
o/a两家的真实性价比得看这两个月上市后还能不能稳住订阅用户的额度了如果为了保业绩猛砍订阅(两家都有苗头了)那我觉得大多数人需要的其实还是flash0731级别的智力+不要钱一样的api性价比
glm5.3f虽然用着不咋地但是考虑性价比,还是原谅它
回复

使用道具 举报

     
发表于 2026-9-7 09:17 来自手机 | 显示全部楼层
opencode的v4f绝对降智了。
我用我自用的写文agent,ds本家一遍过,opencode的就一直原地打转卡在工具调用。
太坑了,下个月绝对不用了

—— 来自 nubia NX809J, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-9-7 09:23 来自手机 | 显示全部楼层
这个Astra是刻意做短的,实际这个架构就不一定思维链少,典型例子就是做Oneshot,不写/goal几步就结束了
回复

使用道具 举报

     
发表于 2026-9-7 09:32 | 显示全部楼层
https://codex-resets.com/
过去26周只有4周没手动重置/发重置卡.
现在就看到底是API价格杀2B/2G端凯子, 还是Coding plan赔血本赚吆喝了. GPT的API和订阅会员之间的价差已经有100倍了吧
回复

使用道具 举报

     
发表于 2026-9-7 10:05 | 显示全部楼层
而且真不用担心,灰测的基模也是七月份就拿出来的,后训练两个月也是同级,现在应该在找卡推理,就这点卡Pro这个价格都要被蹬爆
回复

使用道具 举报

     
发表于 2026-9-7 10:06 | 显示全部楼层
本帖最后由 nxmonitor 于 2026-9-7 10:09 编辑

这几天觉得V4F有点降智了,不知道是不是有进展了,其实之前灰测在DSH三个模式都测过了,新的Flash也练好了
回复

使用道具 举报

     
发表于 2026-9-7 10:13 来自手机 | 显示全部楼层
tk553521 发表于 2026-9-7 09:17
opencode的v4f绝对降智了。
我用我自用的写文agent,ds本家一遍过,opencode的就一直原地打转卡在工具调用 ...

感觉现在commandcode也不行,让他改代码雷霆大思考然后截断没反应了,换官方api重来就能写完

—— 来自 Xiaomi 25019PNF3C, Android 17, 鹅球 v3.5.99-alpha
回复

使用道具 举报

发表于 2026-9-7 10:23 | 显示全部楼层
小津江 发表于 2026-9-7 05:21
4o是我唯一破限后可以涩涩,可以反推色图,甚至给我推荐黄网的版本,也是那会奥特曼说要开放nsfw,现在6 ...

sol可以写黄啊,文笔挺好的
就是对于双方同意和戴套有着极强的执着
回复

使用道具 举报

     
发表于 2026-9-7 10:34 | 显示全部楼层
泰坦失足 发表于 2026-9-7 09:32
https://codex-resets.com/
过去26周只有4周没手动重置/发重置卡.
现在就看到底是API价格杀2B/2G端凯子, 还 ...

o的api定价对比国模都不算特别高的那档,对比来说coding plan确实性价比爆棚上市前猛猛蹬吧

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-7 10:42 | 显示全部楼层
本帖最后由 drodchang 于 2026-9-7 10:48 编辑

其实不管是openai还是A/离赚钱都还差十万八千里呢,国内的问题是搞大模型的公司太多了,资源太分散了,最好合并成2家就好,不然很难和oa抗衡
回复

使用道具 举报

     
发表于 2026-9-7 10:52 | 显示全部楼层
真红之闪电 发表于 2026-9-7 06:03
这是啥?能详细说下吗

—— 来自 S1Fun

上下文检索. 不进行压缩. 可以节约一次压缩的请求
回复

使用道具 举报

     
发表于 2026-9-7 10:53 | 显示全部楼层
请教各位大佬,平时用来写办公室调研报告、活动策划、商业方案的话,用哪个模型会比较好啊
回复

使用道具 举报

     
发表于 2026-9-7 11:04 来自手机 | 显示全部楼层
xjlarry 发表于 2026-9-7 10:53
请教各位大佬,平时用来写办公室调研报告、活动策划、商业方案的话,用哪个模型会比较好啊 ...

买得到就K3,没有就V4P
回复

使用道具 举报

     
发表于 2026-9-7 11:13 | 显示全部楼层
冤枉呐 发表于 2026-9-7 09:10
哈?那么怎么升core呢

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

不知道

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-7 11:38 来自手机 | 显示全部楼层
本帖最后由 lactone 于 2026-9-7 11:40 编辑

字节不是说要搞一个10T大模型吗

这个领域最大的特点就是追到第一很难但是到第一梯队不难

meta谷歌xai落后几次,现在也能追上来

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha
回复

使用道具 举报

     
发表于 2026-9-7 12:02 来自手机 | 显示全部楼层
冤枉呐 发表于 2026-9-7 09:10
哈?那么怎么升core呢

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

公告里不是说带你的项目和用量找管理员升档吗
回复

使用道具 举报

     
发表于 2026-9-7 12:02 来自手机 | 显示全部楼层
o这两个月砍额度的恶劣行为如果不是有那几个重置那真是不如a了

—— 来自 Xiaomi 2211133C, Android 15, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-9-7 12:03 | 显示全部楼层
用了一段时间paseo移动端
感觉UI操作比直接用chatgpt、claude都更丝滑一些
就是paseo管理的会话和codex原生管理的会有冲突比较麻烦 准备全部切过来先试试
回复

使用道具 举报

     
发表于 2026-9-7 12:11 | 显示全部楼层
astra真的已经非常够用了,如果能便宜点就好了
回复

使用道具 举报

     
发表于 2026-9-7 12:18 | 显示全部楼层
astra实际上已经砍半额度了,可以让codex自己写脚本算。算下来20x的astra周额度1200-1300刀就会用完,sol的周额度之前是2000-2500刀。这里的计算已经考虑价格因素,纯粹是额度减半了。
回复

使用道具 举报

发表于 2026-9-7 12:23 来自手机 | 显示全部楼层
本帖最后由 德尔惠净水器 于 2026-9-7 12:28 编辑
培根芝士蛋堡XD 发表于 2026-9-7 01:13
会翻墙的现在没有任何理由用国模,性能还是性价比基本都被gpt斩杀了


我的需求用不了这么智能的模型时候,我认为他的性价比不如一些国模高
回复

使用道具 举报

     
发表于 2026-9-7 12:35 来自手机 | 显示全部楼层





—— 来自 Xiaomi 25060RK16C, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-7 12:38 | 显示全部楼层
德尔惠净水器 发表于 2026-9-7 12:23
我的需求用不了这么智能的模型时候,我认为他的性价比不如一些国模高

gpt6即使是文字工作、各种编辑调研也是一哥,一遍出的性价比比国模反复试错还要人去纠错是高很多的
回复

使用道具 举报

发表于 2026-9-7 12:40 | 显示全部楼层
RookieTnT 发表于 2026-9-7 00:47
[features]
context_management.experimental_mode = true

harness 本身这个功能是开源的 https://github.com/openai/codex/pull/42385
但肯定依赖openai 自己的llm
回复

使用道具 举报

     
发表于 2026-9-7 12:44 来自手机 | 显示全部楼层
有人说装ripgrep能省token 真的吗

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-7 12:44 来自手机 | 显示全部楼层
有人说装ripgrep能省token 真的吗

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-7 16:06 | 显示全部楼层
本帖最后由 RookieTnT 于 2026-9-7 16:12 编辑
重楼 发表于 2026-9-7 12:40
harness 本身这个功能是开源的 https://github.com/openai/codex/pull/42385
但肯定依赖openai 自己的llm ...

你看pr就知道了. 和codex的远程压缩一样. 具体实现是依赖OpenAI的服务器的
回复

使用道具 举报

     
发表于 2026-9-7 16:09 | 显示全部楼层
这是嘉豪们又固定刷新啦?
回复

使用道具 举报

     
发表于 2026-9-7 16:09 | 显示全部楼层
每次泥潭被爬后短期内国模水平就大跃升,说明泥潭是AI竞争的关键,谁掌握泥潭,谁先AGI
回复

使用道具 举报

     
发表于 2026-9-7 16:14 | 显示全部楼层
本帖最后由 omnitoken 于 2026-9-7 16:15 编辑
neptunehs 发表于 2026-9-7 12:44
有人说装ripgrep能省token 真的吗

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0

不是rg的问题, 是现在找不出来哪个harness在macos/linux上不用rg的

如果你想更省还可以装个rtk
回复

使用道具 举报

     
发表于 2026-9-7 17:07 来自手机 | 显示全部楼层
比sol强不少,但是这额度使用太夸张了
回复

使用道具 举报

发表于 2026-9-7 17:16 来自手机 | 显示全部楼层
Hy4 preview 模型升级公告

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-9-23 11:35 , Processed in 0.255170 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表