找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] DeepSeek V4-Flash-Vision-Exp 上线!多模态来啦|大模型讨论专楼

 火.. [复制链接]
     
发表于 2026-8-19 03:45 | 显示全部楼层
现在市面上的第三方V4F基本都是没外审的? 随便选么
回复

使用道具 举报

     
发表于 2026-8-19 04:38 | 显示全部楼层
本帖最后由 厍无春 于 2026-8-19 14:30 编辑

邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_bkuV2Fp0qZMTgllgVNRCvf_P

deepseek 涨价了,我再发一遍这个吧,注册就送68元额度,api哪里都能接,确实能用,白天偶尔429,晚上还挺快的,价格同官方。

邀请别人注册也会送68,不过需要被邀请的人用一下他们自己推的harness才给。

有需要的注册白嫖68,不过额度有效期只有一个月

我已经邀请满了,再邀请也不会加额度了,建议去找其他人的邀请链接,不要再用我的了,避免浪费。
回复

使用道具 举报

     
发表于 2026-8-19 07:53 来自手机 | 显示全部楼层
我用qwen3.8-27b iq3xss 都跑到500tps了 结果一个prompt跑了500多秒 这在大context下真的可用吗(

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-19 08:47 来自手机 | 显示全部楼层
现在办公用哪个厂商的比较好?在考虑付费
gpt在单位不方便用魔法
workbuddy用了下还行,但是积分消耗挺快的
豆包现在免费档,经常遇到算力不够要多刷新
ds没多模态,处理文件方面还是不方便



—— 来自 vivo V2405A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-19 08:48 来自手机 | 显示全部楼层
矮矮人 发表于 2026-8-19 08:47
现在办公用哪个厂商的比较好?在考虑付费
gpt在单位不方便用魔法
workbuddy用了下还行,但是积分消耗挺快的 ...

mini max3,mimo2.5或者k3

—— 来自 HONOR AAP-AN00, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-19 08:52 来自手机 | 显示全部楼层
办公如果在用飞书那就用 traework
最低档位即可 每天还可以签到领 200 积分
平时用 DeepSeek 模型,重一点的需求用 glm5.3 或者 qwen3.8max
回复

使用道具 举报

     
发表于 2026-8-19 08:55 | 显示全部楼层
舞以 发表于 2026-8-19 00:06
第三方这区样,感觉反面证明0731之后梁子给大伙真调了不少推理算力吧,只是偶尔爆炸一下,我都没碰到过429 ...

我猜梁子应该整个公司一个算力池子,不限速也不保留算力,所以才会设置在北京时间的高峰期,因为用户用多了,员工就没得用了。
回复

使用道具 举报

     
发表于 2026-8-19 08:58 来自手机 | 显示全部楼层
小野賢章 发表于 2026-8-19 08:55
我猜梁子应该整个公司一个算力池子,不限速也不保留算力,所以才会设置在北京时间的高峰期,因为用户用多 ...

训练又不会因为员工下班就停了而且全球的算力需求又不会照顾北京时间
回复

使用道具 举报

     
发表于 2026-8-19 08:59 | 显示全部楼层
厍无春 发表于 2026-8-19 04:38
邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_bkuV ...

哇噢,这个可以!感谢邀请,省了一波token。

邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_cobPrRDuQUaIZL0uvrWifL5c
回复

使用道具 举报

     
发表于 2026-8-19 09:03 | 显示全部楼层
厍无春 发表于 2026-8-19 04:38
邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_bkuV ...

注册送的额度必须一个月用完
回复

使用道具 举报

     
发表于 2026-8-19 09:12 | 显示全部楼层
本帖最后由 crow_wine 于 2026-8-19 09:15 编辑

国算平台上 0813 了,让我来尝尝咸淡

好像没部署好,连不上
回复

使用道具 举报

     
发表于 2026-8-19 09:32 来自手机 | 显示全部楼层
国算平台本质是个统一定价的菜市场吧,每次接到的算力节点会有不同的部属效能差异,首字延迟大很可能是单纯的对应末端机器不行
回复

使用道具 举报

     
发表于 2026-8-19 09:35 | 显示全部楼层
scikirbypoke 发表于 2026-8-19 00:07
手里的pixel扫直接不过,可能是解了bl,这个不恢复出厂真没办法,但备份又巨麻烦 ...

成功了,有个早期大号无需验证就能登免费版反重力,通过家庭组共享过去就行了,太逆天了
回复

使用道具 举报

     
发表于 2026-8-19 09:36 | 显示全部楼层
求问minimaxH3这个挂的LLM可以换么

看网上好多NSFW模感觉都不靠谱怕被坑
但是qwen3.8太大了感觉挂不上
回复

使用道具 举报

发表于 2026-8-19 09:39 来自手机 | 显示全部楼层
国算平台算力调度不知道效果稳定不
回复

使用道具 举报

     
发表于 2026-8-19 09:49 | 显示全部楼层
本帖最后由 onezer0618 于 2026-8-19 09:51 编辑

咨询下各位,非程序员,现在建议用哪家的订阅当主力使用,我目前主用的是Hermes和ChatGPT,Hermes接的v4f当日常问答用的工具,ChatGPT处理工作上的事以及辅助做一些小玩意,开的plus订阅,gpt快到期了
回复

使用道具 举报

     
发表于 2026-8-19 09:51 | 显示全部楼层
onezer0618 发表于 2026-8-19 09:49
咨询各位的事,非程序员,现在建议用哪家的订阅当主力使用,我目前主用的是Hermes和ChatGPT,Hermes接的v4f ...

轻度问答,有plus感觉都不用v4f吧?网页端额度基本也用不完。
回复

使用道具 举报

     
发表于 2026-8-19 09:52 来自手机 | 显示全部楼层
onezer0618 发表于 2026-8-19 09:49
咨询下各位,非程序员,现在建议用哪家的订阅当主力使用,我目前主用的是Hermes和ChatGPT,Hermes接的v4f当 ...

那还是gpt罢

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-8-19 09:59 来自手机 | 显示全部楼层
gptplus必须要稳定的翻墙环境才能用吗,比如今天欧洲明天日本后天台湾是不是容易封号
回复

使用道具 举报

     
发表于 2026-8-19 10:00 | 显示全部楼层
龙骑士尹志平 发表于 2026-8-19 09:59
gptplus必须要稳定的翻墙环境才能用吗,比如今天欧洲明天日本后天台湾是不是容易封号 ...

没见过飞 ** 封号的,我 Claude 都没被封

—— 来自 S1Fun
回复

使用道具 举报

     
发表于 2026-8-19 10:04 来自手机 | 显示全部楼层
单位电脑+公网用不了外国模型国内多模态模型不是贵就是太菜,折磨
回复

使用道具 举报

     
发表于 2026-8-19 10:06 来自手机 | 显示全部楼层
龙骑士尹志平 发表于 2026-8-19 09:59
gptplus必须要稳定的翻墙环境才能用吗,比如今天欧洲明天日本后天台湾是不是容易封号 ...

Plus无所谓,PRO会员网页用PRO模式如果IP不干净会被路由到5.5mini

评分

参与人数 1战斗力 -2 收起 理由
matthewsteel -2

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-19 10:07 | 显示全部楼层
蛋黄酱Release 发表于 2026-8-19 10:04
单位电脑+公网用不了外国模型国内多模态模型不是贵就是太菜,折磨

叫单位给你报销DS呗,又不是不能开票
回复

使用道具 举报

     
发表于 2026-8-19 10:07 | 显示全部楼层
站立风景 发表于 2026-8-19 09:51
轻度问答,有plus感觉都不用v4f吧?网页端额度基本也用不完。

用Hermes轻度问答,它的排版什么很舒服,我不知道是d4f的原因还是Hermes本身的原因
回复

使用道具 举报

     
发表于 2026-8-19 10:09 来自手机 | 显示全部楼层
飞天荷兰人 发表于 08-19 08:59
哇噢,这个可以!感谢邀请,省了一波token。


邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_cobPrRDuQUaIZL0uvrWifL5c


薅了一个试试水

——来自 S1er 客户端
回复

使用道具 举报

     
发表于 2026-8-19 10:09 来自手机 | 显示全部楼层
qwased 发表于 2026-8-19 10:07
叫单位给你报销DS呗,又不是不能开票

deepseek也不是多模态啊,报销也是有总额度的所以得找个平衡点
回复

使用道具 举报

发表于 2026-8-19 10:11 | 显示全部楼层
workbuddy的v4f和v4p暴涨,服了,用完积分不用了
回复

使用道具 举报

     
发表于 2026-8-19 10:13 来自手机 | 显示全部楼层
onezer0618 发表于 08-19 10:07
用Hermes轻度问答,它的排版什么很舒服,我不知道是d4f的原因还是Hermes本身的原因


Hermes可以用OAuth登陆gpt账号使用Codex额度,你喜欢的排版+gpt模型,双份快乐?

——来自 S1er 客户端
回复

使用道具 举报

     
发表于 2026-8-19 10:15 | 显示全部楼层
孔祈 发表于 2026-8-19 10:13
Hermes可以用OAuth登陆gpt账号使用Codex额度,你喜欢的排版+gpt模型,双份快乐?

——来自 S1er 客户 ...

有道理,我来试试,目前用下来感觉gpt各方面还是更均衡些,多端用着也方便
回复

使用道具 举报

     
发表于 2026-8-19 10:21 | 显示全部楼层
gpt上下文只有272k是正常的吗,而且用的超级快啊。习惯了DS的100M上下文,用DS的时候都是手动压缩的,这GPT随便就触发自动压缩了。
回复

使用道具 举报

     
发表于 2026-8-19 10:22 来自手机 | 显示全部楼层
阿刚 发表于 2026-8-19 00:13
说真的v4f哪怕开了智写文效果也很不错了,但是这个开智思维链只和dsh绑定就有点难受……hermes就算输入了提 ...

高级开头到底是啥啊
let's, we need, i am?

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-8-19 10:25 | 显示全部楼层
onezer0618 发表于 2026-8-19 10:15
有道理,我来试试,目前用下来感觉gpt各方面还是更均衡些,多端用着也方便 ...

这样的缺点就是占用codex额度了,plus相对会比较少的,网页端问答基本用不完。
回复

使用道具 举报

     
发表于 2026-8-19 10:25 | 显示全部楼层
千千千千鸟 发表于 2026-8-19 10:21
gpt上下文只有272k是正常的吗,而且用的超级快啊。习惯了DS的100M上下文,用DS的时候都是手动压缩的,这GPT ...

是的,不过gpt压缩效果感觉还不错,实际使用体感没有太大的问题。

评分

参与人数 1战斗力 +1 收起 理由
千千千千鸟 + 1

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-19 10:27 | 显示全部楼层
千千千千鸟 发表于 2026-8-19 10:21
gpt上下文只有272k是正常的吗,而且用的超级快啊。习惯了DS的100M上下文,用DS的时候都是手动压缩的,这GPT ...

gpt模型是支持1.05M的,但是默认限制272k是帮你省钱,因为超过272k的部分价格更贵

评分

参与人数 1战斗力 +1 收起 理由
千千千千鸟 + 1 原来如此

查看全部评分

回复

使用道具 举报

     
发表于 2026-8-19 10:33 | 显示全部楼层

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-8-19 10:43 | 显示全部楼层
这两天用了下gpt-5.6-sol,确实很强,逻辑比DS的模型要清晰很多
问题是太慢了(不知道是不是因为我开的只是plus套餐),而且只要不是做复杂规划,其实直接用DS系的模型可以快速反馈修正的路线用起来会更舒服
还是DeepSeek的infra太强了,其他家的模型再怎么强用起来都是便秘
回复

使用道具 举报

     
发表于 2026-8-19 10:43 | 显示全部楼层
感觉后端能力上和实际的复杂算法推理上 qwen 3.8 max 比 kimi3 强很多,表现更贴合一个 2.4 万亿模型的表现。k3 这纯纯的绣花枕头
回复

使用道具 举报

     
发表于 2026-8-19 10:46 | 显示全部楼层
千千千千鸟 发表于 2026-8-19 10:21
gpt上下文只有272k是正常的吗,而且用的超级快啊。习惯了DS的100M上下文,用DS的时候都是手动压缩的,这GPT ...

codex里面默认是272k,可以手动调到1m,但实测gpt的自动压缩还挺黑科技的
回复

使用道具 举报

     
发表于 2026-8-19 10:59 | 显示全部楼层
hugosol 发表于 2026-8-19 10:43
这两天用了下gpt-5.6-sol,确实很强,逻辑比DS的模型要清晰很多
问题是太慢了(不知道是不是因为我开的只是 ...

跟套餐关系不大,就是sol想的慢。我用的pro也是慢慢悠悠的。
回复

使用道具 举报

     
发表于 2026-8-19 11:02 | 显示全部楼层
拯救节操希灵宅 发表于 2026-8-19 10:46
codex里面默认是272k,可以手动调到1m,但实测gpt的自动压缩还挺黑科技的

那看来要下载CODEX了,我用的是pi
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-8-24 23:19 , Processed in 0.130796 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表