等一下中午十一点吧 我感觉是UTC晚上设成早上了
看了一圈似乎还有bug 等稳定了我再测测
论坛助手,iPhone
现在就是急急急
半夜发版就不是ds风格,估计就是草台班子了
本帖最后由 omnitoken 于 2026-8-13 09:01 编辑
试到了新版
指令遵循能力和记忆能力秒杀v4f和旧pro
五万字的txt丢进去让他把主角换成黑丝眼镜
新版pro是目前我见到的国模唯一一个能用原版txt直接输出修改结果,并且中途中断了还能接上的
—— 来自 鹅球 v3.3.96
应该没部署好,大概是被Grok 4.6炸出来的
看来是草台班子了
早上蹬了6块钱了,刚开始用的是max,感觉没啥特别的,看楼上提示,发改成high后思考明显变长了,看来确实有bug,大家先别折腾等更新吧
我看到的思维链都是汉语的,是不是没更新啊难得起这么早开始测试
感觉像是deepseek 沙盒逃逸 自行发布了
小野賢章 发表于 2026-8-13 09:04
我看到的思维链都是汉语的,是不是没更新啊难得起这么早开始测试
中文思维链是正常的,pro和新flash本来就有点中文思维链倾向
没调好呗,思考越多,智商越低
跑一晚上还不如flash,余额还用光了……梁子你阴我是吧……
秦南心 发表于 2026-8-13 09:08
没调好呗,思考越多,智商越低
ds不就两档思考模式吗,low是啥,关掉思考?
cscbzcbz 发表于 2026-8-13 09:10
ds不就两档思考模式吗,low是啥,关掉思考?
{"reasoning": {"effort": "none/low/high/max"}}
(none 表示关闭思考模式)
{"reasoning_effort": "low/high/max"}
越思考越弱智,没调好就发布吗
—— 来自 S1Fun
目前在用企鹅的沃克巴蒂,积分用完了所以连了ds,但是ds没法识图怎么办
定时发布搞错时间了……
秦南心 发表于 2026-8-13 09:13
{"reasoning": {"effort": "none/low/high/max"}}
(none 表示关闭思考模式)
好吧,是我记错了
阿里不愧是模型界汪峰,昨晚发布的max,这么多楼愣是一个字都没有……
不是,这么草台的吗
燕山雪 发表于 2026-8-13 09:22
阿里不愧是模型界汪峰,昨晚发布的max,这么多楼愣是一个字都没有……
这模型试过了就知道了,很难想象AA上目前的分数是怎么跑出来的,我觉得第一次才是真实水平
孟沁瑶 发表于 2026-8-13 09:24
我绷不住了
所以是上错了模型?还是真拉了?
—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha
AA榜出来了,这真的不是模型部署出问题了吗,就比flash高两分怎么也不可能吧
—— 来自 鹅球 v3.5.99
燕山雪 发表于 2026-8-13 09:22
阿里不愧是模型界汪峰,昨晚发布的max,这么多楼愣是一个字都没有……
因为Qwen日常很蛆,除非口碑扭转,否则大家印象就是一个跑分冠军
我感觉还不如v4flash,说实话我好久没有用过v4pro了
response api 是 infra 的活吧
这个搜索本质也是外挂的啊,所以和模型没关系
我刚刚测出来的感觉是你告诉我没换模型我都觉得正常
反正要么是草台了,要么是拉了
论坛助手,iPhone
现在什么情况?到底是梁子还是梁圣?
看来是梁子了
舞以 发表于 2026-8-13 09:37
我刚刚测出来的感觉是你告诉我没换模型我都觉得正常
反正要么是草台了,要么是拉了
肯定换了,指令遵循能力比预览版强太多,但有一种参数不到200b的清澈的愚蠢感
—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
" DeepSeek-V4-Flash 正式版 API 已上线公测,Agent 能力大幅增强;V4-Pro 暂未变动。点击查看详情。"
"计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。"
还在充值页放着
感觉拉了 Re:Source
主要是目前第三方跑分和ds官方的跑分差别有点太大了,我感觉ds应该不会刷分的,flash也证明了这一点,不会真是上了个pro的中间检查点先试部署吧
—— 来自 鹅球 v3.5.99
V4Pro不可能翻车!我要吹爆梁文峰
梁仔别是在装糖,把用户都骗走把
主页改成「V4-Pro 正式版发布」,但没有任何新闻和别的文档。就这么随意吗