Rowen233 发表于 2026-8-13 08:54

等一下中午十一点吧 我感觉是UTC晚上设成早上了

小川彩 发表于 2026-8-13 08:56

看了一圈似乎还有bug 等稳定了我再测测

论坛助手,iPhone

david5515 发表于 2026-8-13 08:58

现在就是急急急

三两幺 发表于 2026-8-13 08:59

半夜发版就不是ds风格,估计就是草台班子了

omnitoken 发表于 2026-8-13 08:59

本帖最后由 omnitoken 于 2026-8-13 09:01 编辑

试到了新版

指令遵循能力和记忆能力秒杀v4f和旧pro

五万字的txt丢进去让他把主角换成黑丝眼镜

新版pro是目前我见到的国模唯一一个能用原版txt直接输出修改结果,并且中途中断了还能接上的

—— 来自 鹅球 v3.3.96

startraveller 发表于 2026-8-13 08:59

应该没部署好,大概是被Grok 4.6炸出来的

蜇灵 发表于 2026-8-13 09:02

看来是草台班子了

lowezack 发表于 2026-8-13 09:02

早上蹬了6块钱了,刚开始用的是max,感觉没啥特别的,看楼上提示,发改成high后思考明显变长了,看来确实有bug,大家先别折腾等更新吧

小野賢章 发表于 2026-8-13 09:04

我看到的思维链都是汉语的,是不是没更新啊难得起这么早开始测试

zack1999 发表于 2026-8-13 09:06

感觉像是deepseek 沙盒逃逸 自行发布了

serj005 发表于 2026-8-13 09:07

小野賢章 发表于 2026-8-13 09:04
我看到的思维链都是汉语的,是不是没更新啊难得起这么早开始测试

中文思维链是正常的,pro和新flash本来就有点中文思维链倾向

秦南心 发表于 2026-8-13 09:08



没调好呗,思考越多,智商越低

真田源次郎信繁 发表于 2026-8-13 09:09

跑一晚上还不如flash,余额还用光了……梁子你阴我是吧……

cscbzcbz 发表于 2026-8-13 09:10

秦南心 发表于 2026-8-13 09:08
没调好呗,思考越多,智商越低

ds不就两档思考模式吗,low是啥,关掉思考?

秦南心 发表于 2026-8-13 09:13

cscbzcbz 发表于 2026-8-13 09:10
ds不就两档思考模式吗,low是啥,关掉思考?

{"reasoning": {"effort": "none/low/high/max"}}
(none 表示关闭思考模式)

{"reasoning_effort": "low/high/max"}

love4aids 发表于 2026-8-13 09:19

越思考越弱智,没调好就发布吗

—— 来自 S1Fun

斯卡文分则能成 发表于 2026-8-13 09:21

目前在用企鹅的沃克巴蒂,积分用完了所以连了ds,但是ds没法识图怎么办

nxmonitor 发表于 2026-8-13 09:21

定时发布搞错时间了……

cscbzcbz 发表于 2026-8-13 09:22

秦南心 发表于 2026-8-13 09:13
{"reasoning": {"effort": "none/low/high/max"}}
(none 表示关闭思考模式)


好吧,是我记错了

燕山雪 发表于 2026-8-13 09:22

阿里不愧是模型界汪峰,昨晚发布的max,这么多楼愣是一个字都没有……

chuchoselph 发表于 2026-8-13 09:23

不是,这么草台的吗

孟沁瑶 发表于 2026-8-13 09:24


nxmonitor 发表于 2026-8-13 09:24

燕山雪 发表于 2026-8-13 09:22
阿里不愧是模型界汪峰,昨晚发布的max,这么多楼愣是一个字都没有……

这模型试过了就知道了,很难想象AA上目前的分数是怎么跑出来的,我觉得第一次才是真实水平

wandeeees 发表于 2026-8-13 09:24

孟沁瑶 发表于 2026-8-13 09:24


我绷不住了

noword 发表于 2026-8-13 09:25

所以是上错了模型?还是真拉了?

—— 来自 Xiaomi 22041211AC, Android 12, 鹅球 v4.0-alpha

qz66618 发表于 2026-8-13 09:25

AA榜出来了,这真的不是模型部署出问题了吗,就比flash高两分怎么也不可能吧

—— 来自 鹅球 v3.5.99

80后卢瑟 发表于 2026-8-13 09:28

燕山雪 发表于 2026-8-13 09:22
阿里不愧是模型界汪峰,昨晚发布的max,这么多楼愣是一个字都没有……

因为Qwen日常很蛆,除非口碑扭转,否则大家印象就是一个跑分冠军

小野賢章 发表于 2026-8-13 09:35

我感觉还不如v4flash,说实话我好久没有用过v4pro了

crow_wine 发表于 2026-8-13 09:35

response api 是 infra 的活吧

nxmonitor 发表于 2026-8-13 09:36

这个搜索本质也是外挂的啊,所以和模型没关系

舞以 发表于 2026-8-13 09:37

我刚刚测出来的感觉是你告诉我没换模型我都觉得正常
反正要么是草台了,要么是拉了

论坛助手,iPhone

来都来了 发表于 2026-8-13 09:37

现在什么情况?到底是梁子还是梁圣?

世界制服 发表于 2026-8-13 09:38

看来是梁子了

半江瑟瑟半江红 发表于 2026-8-13 09:39

舞以 发表于 2026-8-13 09:37
我刚刚测出来的感觉是你告诉我没换模型我都觉得正常
反正要么是草台了,要么是拉了


肯定换了,指令遵循能力比预览版强太多,但有一种参数不到200b的清澈的愚蠢感

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

zy450 发表于 2026-8-13 09:39

" DeepSeek-V4-Flash 正式版 API 已上线公测,Agent 能力大幅增强;V4-Pro 暂未变动。点击查看详情。"
"计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。"

还在充值页放着

王兰花秀丽 发表于 2026-8-13 09:39

感觉拉了    Re:Source

qz66618 发表于 2026-8-13 09:41

主要是目前第三方跑分和ds官方的跑分差别有点太大了,我感觉ds应该不会刷分的,flash也证明了这一点,不会真是上了个pro的中间检查点先试部署吧

—— 来自 鹅球 v3.5.99

小野賢章 发表于 2026-8-13 09:43

V4Pro不可能翻车!我要吹爆梁文峰

Hyst3r1a 发表于 2026-8-13 09:44

梁仔别是在装糖,把用户都骗走把

samfs 发表于 2026-8-13 09:46

主页改成「V4-Pro 正式版发布」,但没有任何新闻和别的文档。就这么随意吗
页: 158 159 160 161 162 163 164 165 166 167 [168] 169 170 171 172 173 174 175 176 177
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼