找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼

 火.. [复制链接]
     
发表于 2026-8-27 00:21 | 显示全部楼层
goranger 发表于 2026-8-27 00:14
为了让更多新朋友能 0 成本上手体验 GLM-5.3-Flash,我们准备了一批 GLM Coding Plan 7 天体验卡(从未订阅 ...

怎么还要身份证和扫脸,不搞了
回复

使用道具 举报

发表于 2026-8-27 00:26 | 显示全部楼层
qwased 发表于 2026-8-27 00:21
怎么还要身份证和扫脸,不搞了

国内所有plan都需要实名啊
回复

使用道具 举报

     
发表于 2026-8-27 00:26 | 显示全部楼层
flash模型为什么那么慢, 5.3都感觉更快
回复

使用道具 举报

     
发表于 2026-8-27 00:27 | 显示全部楼层
今天开了commandcode  虽然吐字比官方慢一半  但是好歹找回没有后顾之忧随便蹬的感觉了

本来白天都要冲runinfra了   晚上找银行卡的功夫就看到了commandcode
runinfra挺好的 速度很快 比官网也便宜

用D指导算了一下实测数据 文峰8.5  文谷4.2  runinfra3.73
我选择commandcode

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

发表于 2026-8-27 00:49 | 显示全部楼层
本帖最后由 城北无尘 于 2026-8-27 00:50 编辑
唠叨 发表于 2026-8-27 00:27
今天开了commandcode  虽然吐字比官方慢一半  但是好歹找回没有后顾之忧随便蹬的感觉了

本来白天都要冲run ...

commandcode跑v4f缓存0.03美元,是官网梁文峰时候的2倍了啊,梁文谷的4倍
回复

使用道具 举报

     
发表于 2026-8-27 01:00 | 显示全部楼层
给ai丢几百万的采样数据,让他弄弄一个识别的通讯数据的算法
flash 一个个穷举
pro直接卷积

参数量大就是了不起啊
回复

使用道具 举报

     
发表于 2026-8-27 01:04 | 显示全部楼层
黄金时代啊,你何日再来
回复

使用道具 举报

     
发表于 2026-8-27 01:07 | 显示全部楼层
f77887 发表于 2026-8-27 00:12
不能啊,我用5080+48g内存,用a3b还是很丝滑的

—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0 ...

上下文实际占多了就暴跌到10tps出头了
回复

使用道具 举报

发表于 2026-8-27 01:09 | 显示全部楼层
→熙← 发表于 2026-8-27 00:26
flash模型为什么那么慢, 5.3都感觉更快

雷霆大思考
回复

使用道具 举报

     
发表于 2026-8-27 01:10 来自手机 | 显示全部楼层
5.3flash这消息没有阻击美股吗

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-27 01:11 | 显示全部楼层
qwased 发表于 2026-8-26 22:06
pi vcc+64K上下文的qwen3.8 27b测试完了,长任务触发了2次上下文压缩也没有出现跑偏,装了思考修复之后也是 ...

思考修复是哪个

—— 来自 S1Fun
回复

使用道具 举报

发表于 2026-8-27 01:14 | 显示全部楼层
→熙← 发表于 2026-8-27 00:26
flash模型为什么那么慢, 5.3都感觉更快

现在的几个小参数模型为了编程跑分,都开始拼命后训练,代价就是雷霆大思考,速度慢,一点都不flash。
与其说是flash不如说是cheap更直接。
回复

使用道具 举报

     
发表于 2026-8-27 01:14 | 显示全部楼层
回复

使用道具 举报

发表于 2026-8-27 01:24 | 显示全部楼层
PI 更新了,看说明是支持了原生 PowerShell。我还没有测试,不知道对大语言模型大战 PowerShell 的状况有没有改善。
回复

使用道具 举报

     
发表于 2026-8-27 01:36 | 显示全部楼层
王兰花秀丽 发表于 2026-8-26 23:30
歪个楼,这个晚点是新出的媒体吗,最近一年能看见很多他们独家的报道,信息量都不少    Re:Source ...

财经类播客出身
专业性嘛,我听过一期播客吹Alex Wang的,后来就取关了
回复

使用道具 举报

     
发表于 2026-8-27 01:37 | 显示全部楼层
goranger 发表于 2026-8-26 23:36
正常人都是拿新模型让大家免费体验,他到处搞活动免费两周,已经看到两三家了,拿自己家旗舰模型免费这么 ...

我之前是把M3作为便宜的多模态民工模型用,不过现在看来GLM5.3 Flash可以取代了
回复

使用道具 举报

     
发表于 2026-8-27 01:44 | 显示全部楼层
来都来了 发表于 2026-8-27 01:24
PI 更新了,看说明是支持了原生 PowerShell。我还没有测试,不知道对大语言模型大战 PowerShell 的状况有没 ...

卵用没有 一样被各种转译坑肘击
回复

使用道具 举报

     
发表于 2026-8-27 01:48 来自手机 | 显示全部楼层
来都来了 发表于 2026-8-27 01:24
PI 更新了,看说明是支持了原生 PowerShell。我还没有测试,不知道对大语言模型大战 PowerShell 的状况有没 ...

gemini3.7在反重力里面写pwsh脚本倒是好像错误率还行,不像ds4f那样不停的重写
感觉可能是谷歌收集的数据里面有这方面的内容
回复

使用道具 举报

     
发表于 2026-8-27 03:22 | 显示全部楼层
https://agentrouter.org/register?aff=3YEd
传火
用了前面坛友的链接
回复

使用道具 举报

发表于 2026-8-27 07:08 来自手机 | 显示全部楼层
Windows上powershell转义问题是修不好的,根源在llm上输出就错了,用了linux的语法。

傻逼powershell用`这个做转义符号。harness工具不太可能去机械的处理这个,因为llm输出的shell命令可以很复杂
回复

使用道具 举报

     
发表于 2026-8-27 07:09 来自手机 | 显示全部楼层
根据我自己尝试学pwsh的经历来看,建议放弃pwsh。命令太多太复杂,实际上就那几个基本的命令常用,但一下子根本想不起来。

—— 来自 Xiaomi 25042PN24C, Android 16, 鹅球 v4.0-alpha
回复

使用道具 举报

     
发表于 2026-8-27 07:13 来自手机 | 显示全部楼层
Minimax也在财报电话会上预告了3t的m3pro和即将上线的国产算力集群。
回复

使用道具 举报

发表于 2026-8-27 07:15 来自手机 | 显示全部楼层
你用pwsh,怪不得你塞车
回复

使用道具 举报

     
发表于 2026-8-27 07:27 | 显示全部楼层
pro模型好像有变化了?
刚刚用它做审查,发现在极简/anchored模式下的思维链也是let me了,但是cot/工具调用的行为和标准还是有明显变化。
极简/anchored仍然是那种利索的感觉,标准上来就啰里八嗦,极简还会出中文思维链了。
梁叔叔不会真的在修了吧?
回复

使用道具 举报

     
发表于 2026-8-27 07:28 来自手机 | 显示全部楼层
dhs 有没有破限的办法
我想让他帮我反推 r18 图片提提示词

—— 来自 鹅球 v3.3.96
回复

使用道具 举报

     
发表于 2026-8-27 07:35 | 显示全部楼层
DSH本地干活选哪种长期记忆?OpenViking树状  还是dsh-memory简洁平铺? 我看GPT说现在的CODEX也改用多层复杂结构了
回复

使用道具 举报

     
发表于 2026-8-27 07:43 来自手机 | 显示全部楼层
来都来了 发表于 2026-8-27 01:24
PI 更新了,看说明是支持了原生 PowerShell。我还没有测试,不知道对大语言模型大战 PowerShell 的状况有没 ...

不会改善的,没有做额外约束或者转换(实际上也不可能专门去做这方面适配),只是相比老版本能一键切换使用,为了为未来可能出现的pwsh专训模型做准备或者有pwsh专门需求的用户用。现在的llm都对pwsh支持差的前提下没什么用。
回复

使用道具 举报

     
发表于 2026-8-27 07:44 来自手机 | 显示全部楼层
自由之紫roy 发表于 2026-8-26 20:05
qwen 3.8 27b FP8 去审核版了解一下

这个可以租服务器,下半年到明年各种魔改卡会上了,算力扩张很多的。openai的辣椒卡,还有谷歌的下代tpu,老黄的大整合服务器柜。如果不冲agi,跑deekseek这种moe,等价算力得翻3倍以上。
而且现金流都开始吃紧了,有一家放水,token都会大降价的。
而且按价格Tonken算,5090虽然便宜,但输出性价比真不如B300那样的新卡(就在这个整租都租不起,得搞分租😒)
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-27 07:45 , Processed in 0.129501 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表