那一年的河川 发表于 2026-8-3 11:17

本帖最后由 那一年的河川 于 2026-8-3 11:22 编辑

邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_bjxYVYD8SKurWS7TARexwFaV

也就当个硅基流动之外用来翻译的保险,有需要就点吧

jojog 发表于 2026-8-3 11:18

压力给到梁圣了

赶快点!

冤枉呐 发表于 2026-8-3 11:22

那一年的河川 发表于 2026-8-3 11:17
邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_bjxY ...

我用我自己另外手机注册了一个,似乎不好使

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

2017.05.04 发表于 2026-8-3 11:23





——来自HUAWEI Mate 80 Pro OpenHarmony-7.0.0.32(Beta2)(26) 上的 S1 Orange 1.4.1

thq 发表于 2026-8-3 11:32

千问max是首次开源啊, 是被哪家刺激到了?

冤枉呐 发表于 2026-8-3 11:35

那一年的河川 发表于 2026-8-3 11:17
邀请好友限时活动继续延长,体验OpenSquilla新功能畅享免费token
https://tokenrhythm.studio/i/rf_tr_bjxY ...

邀请必须双方都用他那个harness调用一次才行
操作习惯有点像codex,但是不卡

wandeeees 发表于 2026-8-3 11:39

thq 发表于 2026-8-3 11:32
千问max是首次开源啊, 是被哪家刺激到了?

他自己搞炸了,感觉都不一定打得过现在的V4F

lactone 发表于 2026-8-3 11:40

我一直认为3.8MAX就是一个没有编程特化的K3,除了编程之外的工作都能打fable5

阿刚 发表于 2026-8-3 11:43

为啥都说写作能力下降了,我觉的是提升啊,原来需要检查返工两遍的东西现在一遍就出了,终于不用肘那些尾椎骨锁骨窝,不是xx是oo了

SmterC 发表于 2026-8-3 11:45

周末尝试让它实现一个hitomi la的安卓viewer。相比起Eh这个网站用AVIF编码比较多,清晰度也很不错,所以想的实现一下试试。
使用matt skills,基于issue跟踪的开发。初始的wayfinder会规划地图,将这个复杂任务拆分成调查、技术原型验证、正式功能开发等好几个不同的issue,估计这样处理也在它这样短平快的AI的舒适区。
一路都非常顺利,中间有过一点cdn解析出链接不可达的问题,它会越尝试越暴躁,思维链和表达都加入大量感叹号。换新会话就反应过来修好了。
最终成品有点小问题,不过让其借助android-cli辅助查看布局调试后都能修好。
有点牛逼的是它没法读图的情况下,有时候会自己将图片转成ASCII字符画来尝试理解,最诡异的是这么做后它真能理解现状了。
不得不说最终表现是远远超出我的预期的,相比起预览版真的是云泥之别,至少借助一定的工程优化这个模型是能达到相当高的可用性的。虽然还不是之前灰度测试时Pro那种指哪打哪许愿机的水平,但也相当牛逼了。    Re:Source

半江瑟瑟半江红 发表于 2026-8-3 11:48

SmterC 发表于 2026-8-3 11:45
周末尝试让它实现一个hitomi la的安卓viewer。相比起Eh这个网站用AVIF编码比较多,清晰度也很不错,所以想 ...

V4Flash在触及能力边界时候就会激动,感叹号和问号增加,跟哈气了似的
我让他写还原魔方的APP的时候就遇到这个问题,他自己看不到图没办法debug哈气哈了二十分钟

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

SmterC 发表于 2026-8-3 11:51

半江瑟瑟半江红 发表于 2026-8-3 11:48
V4Flash在触及能力边界时候就会激动,感叹号和问号增加,跟哈气了似的
我让他写还原魔方的APP的时候就遇 ...

有时候它会主动转换图片到字符画来识别,也许可以主动让它这么干来曲线实现多模态    Re:Source

nxmonitor 发表于 2026-8-3 11:59

这Qwen估计要跟不上了,DeepSWE分数比Flash就高了2分,Opus4.8都没刷过,大概率是会被Pro斩了……

nxmonitor 发表于 2026-8-3 12:02

本帖最后由 nxmonitor 于 2026-8-3 12:06 编辑

半江瑟瑟半江红 发表于 2026-8-3 11:48
V4Flash在触及能力边界时候就会激动,感叹号和问号增加,跟哈气了似的
我让他写还原魔方的APP的时候就遇 ...
这个很像是蒸馏了Pro的痕迹,感叹号是用来提高关注点的地方,当然这个是真正意义上的蒸馏,不是搞点语料

王兰花秀丽 发表于 2026-8-3 12:03

我觉得v4p有多模态能力 ,不然就是harness有什么特殊视觉功能Re:Source

nxmonitor 发表于 2026-8-3 12:05

SmterC 发表于 2026-8-3 11:51
有时候它会主动转换图片到字符画来识别,也许可以主动让它这么干来曲线实现多模态    Re:Source ...

外接一个多模态模型比如最便宜的Mimo,告诉他截图就去调用这个,转成向量以后就能懂了

drodchang 发表于 2026-8-3 12:06

thq 发表于 2026-8-3 11:32
千问max是首次开源啊, 是被哪家刺激到了?

那还用说,kimi呗

lactone 发表于 2026-8-3 12:17

minimax h3开源了

—— 来自 HONOR AAK-AN00, Android 16, 鹅球 v3.5.99

CCauchy 发表于 2026-8-3 12:19

现在专家模式是什么模型

论坛助手,iPhone

nxmonitor 发表于 2026-8-3 12:20

本帖最后由 nxmonitor 于 2026-8-3 12:25 编辑

CCauchy 发表于 2026-8-3 12:19
现在专家模式是什么模型

论坛助手,iPhone

Pro预览版,当然比网页的快速模式还是要强的

tillnight 发表于 2026-8-3 12:45

阿里这种大公司怎么可能在k3发布两天内就作出下一代旗舰开源的决策,你说豆包开源了他被逼紧急开源那可能性还大点。正常这种决策起码是7月中上旬就定好的事情。

更何况目前最该着急的不是智谱吗,是人是鬼都踩前国模一哥一脚。而且看Qwen3.8max的各项跑分只有DeepSWE拉了但也没避讳,反倒是感觉千问想好了方向就是不往已经非常拥挤的vibe coding赛道拥挤。硬要说的话,Agent的需求肯定远比狭义编程工具广阔的多。归根到底千问其实应该要去打豆包的,普通人也能在日常工作上用起来的智能体很可能是下一个爆发点,OAI拿work模式替代codex站到C位是一个道理。

Promeus 发表于 2026-8-3 12:48

tillnight 发表于 2026-8-3 12:45
阿里这种大公司怎么可能在k3发布两天内就作出下一代旗舰开源的决策,你说豆包开源了他被逼紧急开源那可能性 ...

智谱的新模型大概率有k3到fable级,也就是这个月了,其实也没啥急的

sellboy 发表于 2026-8-3 12:51

tillnight 发表于 2026-8-3 12:45
阿里这种大公司怎么可能在k3发布两天内就作出下一代旗舰开源的决策,你说豆包开源了他被逼紧急开源那可能性 ...

去年重点是思考模式
今年重点是agent
明年重点是持续记忆

跟不上重点那不就和gemini一桌了么。

半江瑟瑟半江红 发表于 2026-8-3 12:53

SmterC 发表于 2026-8-3 11:51
有时候它会主动转换图片到字符画来识别,也许可以主动让它这么干来曲线实现多模态    Re:Source ...

不中,魔方还原动画涉及到建模和颜色,转字符画它也debug不了,最后靠我用文字描述模拟器上的建模bug给它读,它才完成

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

那一年的河川 发表于 2026-8-3 12:57

冤枉呐 发表于 2026-8-3 11:35
邀请必须双方都用他那个harness调用一次才行
操作习惯有点像codex,但是不卡


其实我也不知道拿来干啥,看到别人薅我就也先薅着硅基的 ds流口水的厉害,这个当个备用的吧

nxmonitor 发表于 2026-8-3 13:01

本帖最后由 nxmonitor 于 2026-8-3 13:03 编辑

Promeus 发表于 2026-8-3 12:48
智谱的新模型大概率有k3到fable级,也就是这个月了,其实也没啥急的

如果真这水平,还要指望灰测Pro不出来,一拿出来大概率满血斩杀,不论价格哪怕性能接近,灰测版token效率也是国模仅有的,智谱只有拿出超越Fable5的模型才行了…

绝地潜兵 发表于 2026-8-3 13:03

本帖最后由 绝地潜兵 于 2026-8-3 13:25 编辑

冤枉呐 发表于 2026-8-3 11:35
邀请必须双方都用他那个harness调用一次才行
操作习惯有点像codex,但是不卡


我说怎么后面没到账,原本是调用API即可,现在是使用hamess了
使用了一下,不太行,让它查询我本地安装了哪些AI软件都找不齐,TRAE倒是可以找。
内置办公自动化库倒是很齐全

平贺才人 发表于 2026-8-3 13:12

Promeus 发表于 2026-8-3 13:15

平贺才人 发表于 2026-8-3 13:12


https://p.sda1.dev/34/e342ae26ab30e9730fb59107ef268018/image.jpg

mitzvah 发表于 2026-8-3 13:16

Promeus 发表于 2026-8-3 12:48
智谱的新模型大概率有k3到fable级,也就是这个月了,其实也没啥急的

智谱那模型成本太高了,你看涨成现在这个价格,根本搞不下去的


hyhyhyhy 发表于 2026-8-3 13:26

serj005 发表于 2026-8-3 09:44
看ds官方文档发现新的responses api好像可以调用ds自己的服务端在线搜索功能,自己试着调用了一下发现真能 ...

自己解决就行,我让Agent自己写一个插件装上,tavity没积分了就会去用deepseek官方搜索了

Hieda 发表于 2026-8-3 13:30

官方的搜索(虽然我只在网页版用过)其实效果不是很好,v4f还没正式版的时候我遇到过不开搜索能答对但开了反而答错的情况
api加我本地自己搭的简单搜索工具也能答对

nxmonitor 发表于 2026-8-3 13:34

Hieda 发表于 2026-8-3 13:30
官方的搜索(虽然我只在网页版用过)其实效果不是很好,v4f还没正式版的时候我遇到过不开搜索能答对但开了 ...

之前是外挂的,现在有了原生的搜索

孙吧星人 发表于 2026-8-3 13:50

这新V4的甲有点厚啊,未成年这一块死不松口。

冤枉呐 发表于 2026-8-3 13:55

那一年的河川 发表于 2026-8-3 12:57
其实我也不知道拿来干啥,看到别人薅我就也先薅着硅基的 ds流口水的厉害,这个当个备用的吧

...

68按照ds的价格能蹬好久了

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

冤枉呐 发表于 2026-8-3 13:55

绝地潜兵 发表于 2026-8-3 13:03
我说怎么后面没到账,原本是调用API即可,现在是使用hamess了
使用了一下,不太行,让它查询我本地安装了 ...

直接测一下连通性就算成了

—— 来自 HUAWEI ALN-AL10, Android 12, 鹅球 v3.5.99

wandeeees 发表于 2026-8-3 13:56

DeepSeek 网页/API 性能下降(DeepSeek Web/API Degraded Performance)
已实施修复,正在监控结果。
·
影响 DeepSeek V4 Pro API服务(API Service)、专家模式(Expert Mode)

只有V4 PRO出问题了,难道就在今日!?

80后卢瑟 发表于 2026-8-3 14:00

wandeeees 发表于 2026-8-3 13:56
DeepSeek 网页/API 性能下降(DeepSeek Web/API Degraded Performance)
已实施修复,正在监控结果。
·

之前猜是 3 号来的,但 3 号又不可能

—— 来自 Xiaomi 23013RK75C, Android 15, 鹅球 v4.0-alpha

zy450 发表于 2026-8-3 14:08

今天就发有点不敢想啊

CCauchy 发表于 2026-8-3 14:22

感觉现在免费的fast、flash之流最好的是grok,不仅可以写黄,文笔也没什么大毛病,就是输出少,而且过于按照提示词,没有自由发挥,不过其他的自由发挥一般都会在逻辑、空间问题上碰壁,没什么用
页: 113 114 115 116 117 118 119 120 121 122 [123] 124 125 126 127 128 129 130 131 132
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼