nxmonitor 发表于 2026-7-10 10:54

很久就在那边l 发表于 2026-7-10 10:43
希望是虚晃一枪上线再打折吧,api忙时价格翻倍后即使有gpt5.5的性能也很难竞争过openai的套餐,5.6的中间档 ...

如果现在看到的性能属实,这价格怎么看都是别让太多人用的,催一催950DT才能打折

舞以 发表于 2026-7-10 11:14

5h限额这种傻逼机制到底谁带起来的
要我为了5h内的更高限额买gpt的pro订阅就太划不来了,根本用不完。
dsv4预览版的能力现在确实又距离gpt-5.5/5.6sol挺远。😡

ysubm 发表于 2026-7-10 11:16

但你距离deepseekV4正式版很近

—— 来自 鹅球 v4.0-alpha

nxmonitor 发表于 2026-7-10 11:21

舞以 发表于 2026-7-10 11:14
5h限额这种傻逼机制到底谁带起来的
要我为了5h内的更高限额买gpt的pro订阅就太划不来了,根本用不完。
dsv4 ...

这不就是类似健身房的操作吗?赚的就是你用不完的钱,当然目前看其实coding plan都是赔本赚吆喝的

杀人鲸 发表于 2026-7-10 11:34

客户端更新到222了。

—— 来自 S1Fun

Rowen233 发表于 2026-7-10 12:22

AI竞赛这块LPL啥时候能肘飞LCSGrok 4.5忽然突飞猛进了

nxmonitor 发表于 2026-7-10 12:51

Rowen233 发表于 2026-7-10 12:22
AI竞赛这块LPL啥时候能肘飞LCSGrok 4.5忽然突飞猛进了

翻前面的内容看看例子,只要过几天真有这个水平,直接把大多数模型按住了

舞以 发表于 2026-7-10 13:41

Rowen233 发表于 2026-7-10 12:22
AI竞赛这块LPL啥时候能肘飞LCSGrok 4.5忽然突飞猛进了

搞到高质量数据,做好后训练,就能有能力飞跃,至少在coding方面是这样的
v4正式版如果性能真有现在流传的水平,那也是突飞猛进进进进了

nxmonitor 发表于 2026-7-10 14:57

真正的问题是如何在coding和其他间取得平衡,opus从4.6-4.8就是越来越机器人,GLM也是一个问题

zypyong 发表于 2026-7-10 15:06

为什么国内这几个coding的模型都不加视觉能力,调页面的时候很不舒服

nxmonitor 发表于 2026-7-10 15:28

【不知道是不是被deepseek v4正式版灰度到了,用一句话生成的,但效果确实好-哔哩哔哩】 https://b23.tv/dyoO9PM
又一个高维空间碎片,可能是后室三个例子里最好的一个,不过我认为后面两个可能自己装了一些skill

overflowal 发表于 2026-7-10 15:29

zypyong 发表于 2026-7-10 15:06
为什么国内这几个coding的模型都不加视觉能力,调页面的时候很不舒服
不是你说加就加的,视觉token没处理好会干扰模型的能力。国内这几家都是在规模比较小的模型上实验。最顶级的模型都还是纯text。
目前看来kimi在这方面是scale的最成功的

nxmonitor 发表于 2026-7-10 15:31

国内几个都深受DeepSeek-V3的影响自然就这样了,也就kimi确实有个多模态,下次普及要等V4.1或者V4.2了

tillnight 发表于 2026-7-10 15:38

什么玩意,qwenmax和doubao都是原生多模态超大模型,不开源就不是国模了是吧。

nxmonitor 发表于 2026-7-10 15:43

本帖最后由 nxmonitor 于 2026-7-10 15:44 编辑

tillnight 发表于 2026-7-10 15:38
什么玩意,qwenmax和doubao都是原生多模态超大模型,不开源就不是国模了是吧。 ...
Max不是纯文本的吗?好像外挂一个小模型?Plus才是多模态的吧?至于doubao真算了……

nxmonitor 发表于 2026-7-10 15:47

有个思路应该是不去练多模态大模型,而是在Agent里自动分配不同模型,不知道DeepSeek自己的工具出了会不会这样做

pf67 发表于 2026-7-10 15:52

本帖最后由 pf67 于 2026-7-10 15:53 编辑

nxmonitor 发表于 2026-7-10 15:47
有个思路应该是不去练多模态大模型,而是在Agent里自动分配不同模型,不知道DeepSeek自己的工具出了会不会 ...
低成本方案,我自己的agent就是这么干的,好处就是视觉可以高频度调用随便折腾, 代价就是要付出很多额外的后处理成本,而且效果怎么做都不如原生多模态

pf67 发表于 2026-7-10 15:57

nxmonitor 发表于 2026-7-10 15:43
Max不是纯文本的吗?好像外挂一个小模型?Plus才是多模态的吧?至于doubao真算了…… ...

千问几个开源都是原生多模态的, qwen2.6 27b已经可以算是目前最强的可消费级卡上部署的大模型了

nxmonitor 发表于 2026-7-10 16:00

pf67 发表于 2026-7-10 15:57
千问几个开源都是原生多模态的, qwen2.6 27b已经可以算是目前最强的可消费级卡上部署的大模型了 ...
写代码总要选Max吧,然而这个就是纯文本的……

wandeeees 发表于 2026-7-10 16:00

开放平台的前端UI变了,大的要来了,但是我试了下还是复现不了oneshot生成MC,生成出来一坨

pf67 发表于 2026-7-10 16:19

nxmonitor 发表于 2026-7-10 16:00
写代码总要选Max吧,然而这个就是纯文本的……

我自己的体验, 27b水平约等于ds v4 flash, 大多数任务也能用

goranger 发表于 2026-7-10 16:48

考虑下周也没什么节假日,今天周五更新让友商加下班美股波动下符合鲸鱼一贯性格

论坛助手,iPhone

半江瑟瑟半江红 发表于 2026-7-10 17:09

nxmonitor 发表于 2026-7-10 15:47
有个思路应该是不去练多模态大模型,而是在Agent里自动分配不同模型,不知道DeepSeek自己的工具出了会不会 ...

原生多模态更容易抵达大世界模型这条路线吧

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

無始無終 发表于 2026-7-10 18:44

nxmonitor 发表于 2026-7-10 15:31
国内几个都深受DeepSeek-V3的影响自然就这样了,也就kimi确实有个多模态,下次普及要等V4.1或者V4.2了 ...

Qwen3在捣鼓Gated Delta Net,没怎么受DeepSeek影响

—— 来自 HUAWEI NOH-AN00, Android 12, 鹅球 v3.5.99

舞以 发表于 2026-7-10 18:58

platform.deepseek.com的ui重做了,变“现代”了
v4正式版会是鲸鱼哥再一次震惊世界的moment么
反正我的期望已经被拉高很多了

另外问一下漏油,reasonix这个harness咋样?听说是专门给DeepSeek设计的?

绝地潜兵 发表于 2026-7-10 19:04

多模态和具身智能、工业生产密切相关,必须搞啊

舞以 发表于 2026-7-10 19:05

我觉得想要搞多模态肯定得是到下个大版本做完全原生的了,外挂小模型做图形识别还是不太行。

冤枉呐 发表于 2026-7-10 19:31

nxmonitor 发表于 2026-7-9 19:57
https://www.bilibili.com/video/BV1GyMj6dE4Q
新例子,群星文明六和魔兽世界

cc接ds做的?

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

冤枉呐 发表于 2026-7-10 19:31

nxmonitor 发表于 2026-7-9 19:57
https://www.bilibili.com/video/BV1GyMj6dE4Q
新例子,群星文明六和魔兽世界

cc接ds做的?

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

zy450 发表于 2026-7-10 19:42

冤枉呐 发表于 2026-7-10 19:31
cc接ds做的?

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

他们好像都是用opencode做的

nxmonitor 发表于 2026-7-10 20:49

看了一下GPT5.6一句话生成的结果,除了材质提升可能还不如神秘模型,这几天的几个示例有些还是很偏门的,不至于刷分吧?

ST2002 发表于 2026-7-10 20:50

舞以 发表于 2026-7-10 18:58
platform.deepseek.com的ui重做了,变“现代”了
v4正式版会是鲸鱼哥再一次震惊世界的moment么
反正我的期 ...

reasonix 用了一个多月了,确实缓存命中率非常高,基本就没见过低于 95%的时候,配合 flash 模型很经济,经常跑一整天项目烧上亿 token 才花几块钱

—— 来自 鹅球 v3.3.96

舞以 发表于 2026-7-10 20:58

ST2002 发表于 2026-7-10 20:50
reasonix 用了一个多月了,确实缓存命中率非常高,基本就没见过低于 95%的时候,配合 flash 模型很经济 ...

ok,感觉是不是更适合专业码农用啊
我这种小白感觉拿codex当许愿机更合适

ST2002 发表于 2026-7-10 21:02

舞以 发表于 2026-7-10 20:58
ok,感觉是不是更适合专业码农用啊
我这种小白感觉拿codex当许愿机更合适 ...

我一行代码都不会写,但只要能尽量准确描述自己的需求和期望,基本想要什么都能做出来,而且 AI 辅助学习成本真是太低了,有啥不懂的直接开个新会话提问,然后一通搜索调研就能搞个 demo 出来,然后就是不断迭代了

—— 来自 鹅球 v3.3.96

半江瑟瑟半江红 发表于 2026-7-10 21:34

ST2002 发表于 2026-7-10 21:02
我一行代码都不会写,但只要能尽量准确描述自己的需求和期望,基本想要什么都能做出来,而且 AI 辅助学习 ...

我感觉现在限制我使用LLM的最大阻力是自己的需求和想象力,实在想不到祈愿开发啥玩意

—— 来自 HUAWEI SGU-AL10, Android 12, 鹅球 v3.5.99

c月光咖啡 发表于 2026-7-10 21:54

我现在需求开到手软,瓶颈在于测试和反复调试,所以期望v4正式版上线后能够减少低级错误

—— 来自 HONOR MAA-AN10, Android 16, 鹅球 v3.5.99-debug

neptunehs 发表于 2026-7-10 22:04

干嘛我reasonix在windows各种碰钉子 什么wsl进不去啊 开不起沙盒啊 用不了python啊 linux限定?

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99

舞以 发表于 2026-7-10 22:21

本帖最后由 舞以 于 2026-7-10 22:26 编辑

neptunehs 发表于 2026-7-10 22:04
干嘛我reasonix在windows各种碰钉子 什么wsl进不去啊 开不起沙盒啊 用不了python啊 linux限定?

—— 来自 ...
大概 windows 是二等公民吧,我今天还问了gpt codex 的 windows 沙箱怎么实现的,它告诉我很 dirty ,完全是 OpenAI 这种大厂才能做好
claude code 在 windows 都没沙箱功能

论坛助手,iPhone

goranger 发表于 2026-7-10 22:30

neptunehs 发表于 2026-7-10 22:04
干嘛我reasonix在windows各种碰钉子 什么wsl进不去啊 开不起沙盒啊 用不了python啊 linux限定?

—— 来自 ...

所有这类软件都有这类通病,因为本质都是运行在wsl沙箱里的,而且训练的时候天生linux环境路径亲和

论坛助手,iPhone

舞以 发表于 2026-7-10 22:44

还真就codex对windows环境最友好
有桌面端和cli,在windows环境也做了沙箱的实现,还在app里面适配了远程控制桌面codex。
和a\比,现在的closeai真的太像人了。
页: 46 47 48 49 50 51 52 53 54 55 [56] 57 58 59 60 61 62 63 64 65
查看完整版本: DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼