Promeus 发表于 2026-8-3 00:17

王兰花秀丽 发表于 2026-8-2 23:42
现在还能用用时说一下,开到 max 时长差不多,分数也差不多,那不更搞笑了吗    Re:Source ...

什么时长差不多,屎山测试那个luna max干了整整仨小时还没搞定一个bug,突出一个慢工出烂活

雨昼斯基 发表于 2026-8-3 00:21

Promeus 发表于 2026-8-3 00:17
什么时长差不多,屎山测试那个luna max干了整整仨小时还没搞定一个bug,突出一个慢工出烂活 ...

是说 luna 开 max 思考完成时长可能和 luma 开 high 差不多
不是和别家的时间比    Re:Source

Promeus 发表于 2026-8-3 00:24

雨昼斯基 发表于 2026-8-3 00:21
是说 luna 开 max 思考完成时长可能和 luma 开 high 差不多
不是和别家的时间比    Re:Source ...

就是说high还没那么雷霆蜗牛

舞以 发表于 2026-8-3 00:29

反正我用codex都是要么xhigh,要么ultra

论坛助手,iPhone

Rowen233 发表于 2026-8-3 00:42

phorcys02 发表于 2026-8-2 22:16
这毕竟是flash,体积小, 本地部署非常友好...
128g的mac 就能有二三十t/s
公司用花点小钱买两块 pro6000,...

量化性能之后还有多少

squallx 发表于 2026-8-3 01:11

Rowen233 发表于 2026-8-3 00:42
量化性能之后还有多少

按QWEN和之前R1量化的例子来看就算有损也是吊打下面同体积的小模型的

MeursaulT 发表于 2026-8-3 01:20

王兰花秀丽 发表于 2026-8-2 17:59
你们说第ds被墙这个能发一下问题链接吗?什么叫以公司的形式来墙    Re:Source ...

可能墙的不止ds。我在外企,除了gpt和claude什么ai服务都访问不了,gemini grok ds qwen kimi全屏蔽。因为公司只跟oa买了企业服务,考虑到数据安全,就墙了别的。    Re:Source

squallx 发表于 2026-8-3 01:21

cscbzcbz 发表于 2026-8-2 22:54
周末用v4f处理了一些问题,我觉得我已经离不开AI了

之前是便宜够用 现在是还变的好用了
已经通过hermes接入homeassistand突出一个陪伴    再见了米猴家,下一步是夺舍小爱同学

舞以 发表于 2026-8-3 02:08

本帖最后由 舞以 于 2026-8-3 02:13 编辑

x上到处都是本地部署的测试,感觉以后各种网安嘉豪和中小组织都可能靠本地部署,微调去掉拒答的flash-0731拷打各种大小草台班子的网安实力了
oa两家炒作沙箱逃逸对网络安全的影响可能不如梁叔叔的一键开源啊我说

这下真的是人人有枪了

论坛助手,iPhone

squallx 发表于 2026-8-3 02:19

舞以 发表于 2026-8-3 02:08
x上到处都是本地部署的测试,感觉以后各种网安嘉豪和中小组织都可能靠本地部署,微调去掉拒答的flash-0731 ...

我这第一时间就是检查家中网安 然后发现智能电器太多简直就是住在屎山里

来都来了 发表于 2026-8-3 02:31

我买电器的第一个要求就是它不能联网,即使能联网,我也不会把WiFi密码给它输进去。

nxmonitor 发表于 2026-8-3 07:58

这luna是不是蒸馏了sol?行为差不多疯狂开子代理,但是智力不够导致max的思考时间夸张,小参数的模型还是别搞这样的花活了…

mitzvah 发表于 2026-8-3 08:26

最考验智力的gpu算子编写


flash全面斩杀sol




大多数测试比的前端不过就是个仗着视觉能力欺负瞎子模型而已

lowezack 发表于 2026-8-3 08:37

mitzvah 发表于 2026-8-3 08:26
最考验智力的gpu算子编写



这个太牛逼了,是不是因为ds公司内部需求,特化过了啊

nxmonitor 发表于 2026-8-3 08:39

lowezack 发表于 2026-8-3 08:37
这个太牛逼了,是不是因为ds公司内部需求,特化过了啊

应该是,现在的模型没语料的领域表现都不行…

水風船 发表于 2026-8-3 09:03

今天早上玩了一圈,感觉纯粹的不涉及现实情况的哲学辩经还是gemini厉害,一样的话题gemini两轮就能讨论出的东西deepseek要讨论四五轮

neptunehs 发表于 2026-8-3 09:08

你们怎么都说opencode go用不完 我就三开了而已半小时就周用量1%了(拖

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99

lactone 发表于 2026-8-3 09:26

水風船 发表于 2026-8-3 09:03
今天早上玩了一圈,感觉纯粹的不涉及现实情况的哲学辩经还是gemini厉害,一样的话题gemini两轮就能讨论出的 ...

现在哲学汴京最厉害的我感觉是k3和qwen3.8max,主打一个狡辩

—— 来自 vivo V2520A, Android 16, 鹅球 v3.5.99-alpha

半江瑟瑟半江红 发表于 2026-8-3 09:40

水風船 发表于 2026-8-3 09:03
今天早上玩了一圈,感觉纯粹的不涉及现实情况的哲学辩经还是gemini厉害,一样的话题gemini两轮就能讨论出的 ...

Gemini太喜欢迎合用户了,我跟它辨军事领域,每几轮就我国的歼20云云
不是你跟谁俩呢,你哪国ai啊你就套近乎

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0

serj005 发表于 2026-8-3 09:44

本帖最后由 serj005 于 2026-8-3 09:46 编辑

看ds官方文档发现新的responses api好像可以调用ds自己的服务端在线搜索功能,自己试着调用了一下发现真能搜。
以前的Chat Completions API一直没这个功能就以为web搜索是网页端独占的。
后面再看Anthropic API的文档发现Anthropic API也能调用搜索功能。

现在好像还没有开源agent工具把这俩api的搜索功能实际用起来的,查东西都是本地调web fetch

Rowen233 发表于 2026-8-3 10:01

半江瑟瑟半江红 发表于 2026-8-3 09:40
Gemini太喜欢迎合用户了,我跟它辨军事领域,每几轮就我国的歼20云云
不是你跟谁俩呢,你哪国ai啊你就套 ...

提示词要求的吧

nxmonitor 发表于 2026-8-3 10:06

半江瑟瑟半江红 发表于 2026-8-3 09:40
Gemini太喜欢迎合用户了,我跟它辨军事领域,每几轮就我国的歼20云云
不是你跟谁俩呢,你哪国ai啊你就套 ...

系统提示给的,网页版的V4F也变这个样子了,先夸用户再说

qz66618 发表于 2026-8-3 10:11

这周能把pro的正式版端出来吗

—— 来自 鹅球 v3.5.99

蛋黄酱Release 发表于 2026-8-3 10:15

v4f做决策还是差点劲,这周赶快把v4p和harness一起端上来吧

—— 来自 vivo V2405A, Android 16, 鹅球 v4.0

zy450 发表于 2026-8-3 10:15

qz66618 发表于 2026-8-3 10:11
这周能把pro的正式版端出来吗

—— 来自 鹅球 v3.5.99

先把专武放出来也行啊

王兰花秀丽 发表于 2026-8-3 10:26

高僧预测本周三之前就会出来

对吗肯定会吧

官方貌似没说过harness和v4p会一起出来    Re:Source

phorcys02 发表于 2026-8-3 10:37

Rowen233 发表于 2026-8-3 00:42
量化性能之后还有多少

小体积模型,你可以选择不量化,加点卡...也不贵多少

卡普空 发表于 2026-8-3 10:39

蛋黄酱Release 发表于 2026-8-3 10:15
v4f做决策还是差点劲,这周赶快把v4p和harness一起端上来吧

—— 来自 vivo V2405A, Android 16, 鹅球 v4. ...

那这周可以封梁总为 开源普惠AI显圣真君

david5515 发表于 2026-8-3 10:39

先用flash,等pro和工具,怎么着8月份也能出来

tk553521 发表于 2026-8-3 10:42

这特么的离谱了,我用opencode接v4fnew,工作区没仔细看选错了,给了另一个项目的流程和接口要求开发。
v4f雷霆大思考后发现了这一点,熟练地自己找到了另一个项目的代码开始给我干活了。
我是真的服了

阿刚 发表于 2026-8-3 10:45

MeursaulT 发表于 2026-8-3 01:20
可能墙的不止ds。我在外企,除了gpt和claude什么ai服务都访问不了,gemini grok ds qwen kimi全屏蔽。因 ...

这数据安全考虑各种意义上都有点幽默了

passgan 发表于 2026-8-3 10:50

那个hermes的客户端有没有人用,和codex有没有啥区别

nxmonitor 发表于 2026-8-3 10:52

本帖最后由 nxmonitor 于 2026-8-3 10:55 编辑

tk553521 发表于 2026-8-3 10:42
这特么的离谱了,我用opencode接v4fnew,工作区没仔细看选错了,给了另一个项目的流程和接口要求开发。
v4f ...
还有搞测试的时候跑到其他模型的文件去把结果改改上交的,甚至听说让V4F做翻译工作,然后自己下载了Qwen-6B部署好以后,又写了个harness开干的……

nxmonitor 发表于 2026-8-3 10:54

MeursaulT 发表于 2026-8-3 01:20
可能墙的不止ds。我在外企,除了gpt和claude什么ai服务都访问不了,gemini grok ds qwen kimi全屏蔽。因 ...
openai也就算了,A÷有获取客户数据,然后推出和客户一样的功能的前科的……

cyberalogo 发表于 2026-8-3 11:02

RT转CNBC报道

【#美外卖巨头测试中国AI模型#被要求配合安全调查】当地时间8月2日,据美国消费者新闻与商业频道(CNBC)报道,美国知名外卖平台DoorDash因在内部系统测试中国人工智能(AI)模型Kimi K2.6,被美国众议院两大委员会发函,要求提供更多相关信息以配合安全调查。

据报道,美国联邦众议院负责“美中战略竞争”的特别委员会**穆勒纳尔与国土安全委员会**加巴里诺7月31日联名致函DoorDash联合创始人兼首席执行官徐迅,要求公司详细说明是否整合了中国开发的开放权重AI模型,以及相关的安全防护措施。为此,委员会要求DoorDash须于8月14日前提交详尽的信息,包括:使用的中国AI模型清单、安全测试结果、风险评估、内部决策文件、使用成本及替代方案等,并说明在模型训练、微调与部署过程中,是否向开发者提供了美国用户信息、商业信息或其他敏感信息。此外,相关高管须于8月21日前赴国会进行现场说明。

此前,DoorDash联合创始人方安迪曾在社交媒体发文透露,公司已将部分较低级别的AI任务交给由中国月之暗面公司开发的Kimi K2.6模型处理。


美国现在对中国AI真是层层设防,防不胜防啊。

neptunehs 发表于 2026-8-3 11:07

opencode提示insufficient balance
这不是opencode的ds费被蹬完了吧?

—— 来自 OnePlus PJX110, Android 14, 鹅球 v3.5.99

wpwing 发表于 2026-8-3 11:10

有没有什么社区讨论插件之类的?我今天才知道superpowers

phorcys02 发表于 2026-8-3 11:11

neptunehs 发表于 2026-8-3 11:07
opencode提示insufficient balance
这不是opencode的ds费被蹬完了吧?


我估计是的....我这也提示了

→熙← 发表于 2026-8-3 11:13

opencode连不上了 网页也上不去

蛋黄酱Release 发表于 2026-8-3 11:14


27b打得过v4f吗?

—— 来自 vivo V2405A, Android 16, 鹅球 v4.0
页: 112 113 114 115 116 117 118 119 120 121 [122] 123 124 125 126 127 128 129 130 131
查看完整版本: Ox Alpha被认领,GLM-5.3-Flash上线|大模型讨论专楼