找回密码
 立即注册
搜索
楼主: 绕指流光

[科技] OPENAI数学氢弹雨来袭 | 大模型讨论专楼

 火... [复制链接]
     
发表于 2026-9-27 14:27 来自手机 | 显示全部楼层
jyj256 发表于 2026-9-27 12:58
我就不知道官方为什么不给 DSH 增加一个消息撤回删除的按钮 这又不是什么难事 ...

为了保障缓存命中吧。实际上分叉某回复基本也等于将其后所有对话删除
回复

使用道具 举报

     
发表于 2026-9-27 14:27 | 显示全部楼层
@所有人
目前 MiniMax-M3.1-Flash-Preview 已经面向 tokenplan 和 MiniMax code 的用户开始公测,欢迎大家体验。

MiniMax-M3.1-Flash是面向高频工作场景、兼顾专业能力与使用效率的日常主力模型,以多模态能力支持开发者、职场人与创作者的编程开发、研究分析和创意制作,给大家提供速度更快、质量更高的模型选择。
当前Preview版本的不是MiniMax-M3.1-Flash最终版,我们仍然在高速迭代中,正式版预计很快和大家见面。
我们希望让用户的反馈能直接体现到模型迭代中,大家深度体验后,可以填写下面的问卷,会帮助正式版变得更好用。
https://vrfi1sk8a0.feishu.cn/share/base/form/shrcnv2bVa5RWfkQ1I2VCylLgNg?from=navigation

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-27 14:31 | 显示全部楼层
jyj256 发表于 2026-9-27 12:58
我就不知道官方为什么不给 DSH 增加一个消息撤回删除的按钮 这又不是什么难事 ...

相比撤回消息我还是想要直接删除对话,这个更简单
回复

使用道具 举报

发表于 2026-9-27 14:32 | 显示全部楼层
现在DSH对话不能删除,只能归档,估计是测试稳定性的原因吧
删除对话还得用skill
回复

使用道具 举报

     
发表于 2026-9-27 14:49 来自手机 | 显示全部楼层
qwased 发表于 2026-9-27 14:26
qwen4预览版测试很强啊 看来下半年国模的coding能力有希望集体进入astra/fable水平 ...

狠狠期待了。。我等着27b
回复

使用道具 举报

     
发表于 2026-9-27 14:53 | 显示全部楼层
Nanachi 发表于 2026-9-27 14:27
为了保障缓存命中吧。实际上分叉某回复基本也等于将其后所有对话删除

但是分叉只能在回复那里才行  于是就出现了一个问题:如果我的破限预设 没注意用了一个不支持的模型。模型说有问题不干   于是这个回复就一直哪里 等于提醒其他模型这提示词有问题 别干  我的那个插件 你就是为了解决这个问题 还有就是提示词有时候打错了 却删不掉
回复

使用道具 举报

     
发表于 2026-9-27 14:56 | 显示全部楼层
绝地潜兵 发表于 2026-9-27 14:32
现在DSH对话不能删除,只能归档,估计是测试稳定性的原因吧
删除对话还得用skill ...

我让ai写的那个插件没什么稳定性问题吧 就是和酒馆一样 不让AI模型看到他不应该看到的东西
回复

使用道具 举报

     
发表于 2026-9-27 14:56 | 显示全部楼层
codex是不是至少pro起步,搞了个plus想试试astra,基本一个来回5小时额度就归零了


就是不知道pro一个月近700块,公司给不给报
回复

使用道具 举报

     
发表于 2026-9-27 15:09 | 显示全部楼层



4.1f的口癖是hmm是吧
想不出来就一直hmm然后枚举可能性,调用工具是let me,but wait是什么,读到skill了嘛?

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-9-27 15:27 来自手机 | 显示全部楼层
相当妈妈的大肥鱼be like:
牛来!


—— 来自 Xiaomi 25019PNF3C, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-27 15:32 | 显示全部楼层
codebuddy在百分之零六十几上下文后会自动变回百分之几,这是咋回事,是好是坏?我本来要重开了的
回复

使用道具 举报

     
发表于 2026-9-27 15:33 | 显示全部楼层
相见恨晚 发表于 2026-9-27 15:32
codebuddy在百分之零六十几上下文后会自动变回百分之几,这是咋回事,是好是坏?我本来要重开了的 ...

workbuddy/codebuddy是自动压缩的吧
回复

使用道具 举报

     
发表于 2026-9-27 15:35 | 显示全部楼层
来都来了 发表于 2026-9-27 08:50
月初还在听你们吹Astra太强了,达里奥没招了。现在又变成OpenAI不行了,能不能消停消停? ...

Astra没得说,目前最好的模型

不行的是GPT6系列其他模型
回复

使用道具 举报

     
发表于 2026-9-27 15:43 来自手机 | 显示全部楼层
相见恨晚 发表于 2026-9-27 15:32
codebuddy在百分之零六十几上下文后会自动变回百分之几,这是咋回事,是好是坏?我本来要重开了的 ...

上下文触达上限前自动压缩

—— 来自 samsung SM-S9380, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-27 16:04 | 显示全部楼层
qwased 发表于 2026-9-27 14:26
qwen4预览版测试很强啊 看来下半年国模的coding能力有希望集体进入astra/fable水平 ...

哪里有测试看
回复

使用道具 举报

     
发表于 2026-9-27 16:19 来自手机 | 显示全部楼层

b站现在在直播
回复

使用道具 举报

发表于 2026-9-27 16:25 | 显示全部楼层

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

     
发表于 2026-9-27 16:25 | 显示全部楼层
Qwen4要出来以后再看,之前的3.8Flash的迁移能力很差,本身的推理能力非常不够,这个架构到了大模型怎么样要另说。实际上我觉得3.8的刷分现象朝着小模型蔓延了,3.8-27B很多时候都比不上3.6-27B,至少在注意力这方面是这样的。
回复

使用道具 举报

     
发表于 2026-9-27 16:30 | 显示全部楼层
天涯墨客 发表于 2026-9-26 16:13
大佬们,借楼问一下,医科纯小白不想折腾,打算用智能体定时搜文献,设计湿实验。如果能后台全自动生信跟ad ...

老板组织了一帮开始用gpt business了    Re:Source
回复

使用道具 举报

     
发表于 2026-9-27 16:32 来自手机 | 显示全部楼层
minimax 3.1flash有没有测过的?

—— 来自 vivo V2505A, Android 16, 鹅球 v3.5.99
回复

使用道具 举报

     
发表于 2026-9-27 16:32 | 显示全部楼层
nxmonitor 发表于 2026-9-27 16:25
Qwen4要出来以后再看,之前的3.8Flash的迁移能力很差,本身的推理能力非常不够,这个架构到了大模型怎么样 ...

虽然说Qwen确实刷分,但是Qwen 3.8 27B还是比3.6强不少的,不过复杂点的任务本地27B都是图一乐。
回复

使用道具 举报

发表于 2026-9-27 16:36 来自手机 | 显示全部楼层
codebuddy和workbuddy有啥区别
回复

使用道具 举报

     
发表于 2026-9-27 16:50 | 显示全部楼层
Nanachi 发表于 2026-9-27 14:27
为了保障缓存命中吧。实际上分叉某回复基本也等于将其后所有对话删除

dsh本身有分支功能,但是做的并不好用,因为只在系统回复的结尾放了个分支按钮,能做到变相删除撤回刚发送的用户对话但是分支本身操作不方便
回复

使用道具 举报

     
发表于 2026-9-27 16:50 来自手机 | 显示全部楼层
德尔惠净水器 发表于 2026-9-27 16:36
codebuddy和workbuddy有啥区别

一个是通用任务一个是编程,CodeBuddy是三个产品,IDE、插件、cli,和workbuddy共享额度但是不能签到,最好的用法是在workbuddy签到然后去CLI消耗额度
回复

使用道具 举报

     
发表于 2026-9-27 16:50 | 显示全部楼层
德尔惠净水器 发表于 2026-9-27 16:36
codebuddy和workbuddy有啥区别

先有的腾讯云代码助手,后面升级codebuddy后又发现面向更多普通人使用的工作台太火了就加七加八搞了一大堆类似网游的东西进去,不过总之可以签到做任务领积分给codebuddy用
回复

使用道具 举报

     
发表于 2026-9-27 17:08 | 显示全部楼层
Qwen这个测试,到底是什么思考强度的?看了一会很不稳定……
回复

使用道具 举报

     
发表于 2026-9-27 17:12 | 显示全部楼层
nxmonitor 发表于 2026-9-27 17:08
Qwen这个测试,到底是什么思考强度的?看了一会很不稳定……

国模没做完后训练就preview也是定番了
回复

使用道具 举报

     
发表于 2026-9-27 17:17 来自手机 | 显示全部楼层
本帖最后由 neptunehs 于 2026-9-27 17:24 编辑
lactone 发表于 2026-9-27 16:32
minimax 3.1flash有没有测过的?

—— 来自 vivo V2505A, Android 16, 鹅球 v3.5.99

如果他是星际兔女郎
我的意见是prompt遵照还行 写代码不行
适合打杂 不适合搞难度比较高的代码

如果不是 当我没说

搞我的翻译勘误效果很好 搞我的mod项目一塌糊涂最后都是dsf擦屁股 不过不是因为幻觉重引入莫名的bug 而是能力不足差临门一脚的那种 ds4f接手后都能很快擦干净 不像muse spark会留一些很深的雷。。。

—— 来自 vivo V2561A, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-27 17:18 | 显示全部楼层
neptunehs 发表于 2026-9-27 17:17
如果他是星际兔女郎
我的意见是prompt遵照还行 写代码不行

今天已经确认了,就是这个……
回复

使用道具 举报

     
发表于 2026-9-27 23:13 | 显示全部楼层
所以现在的AI写作还有救吗?

这一波下来DS写文已经退化到完全不能用的地步了,之前那些手法全部失效,无论怎样生成出来的都是垃圾。而且稍微带点肉的文字(不是H甚至也不是亲密,就是带点身体描写)就会被秒吞。

又要回归手写时代了吗?
回复

使用道具 举报

     
发表于 2026-9-27 23:13 来自手机 | 显示全部楼层
ww-tsl 发表于 2026-9-27 23:13
所以现在的AI写作还有救吗?

这一波下来DS写文已经退化到完全不能用的地步了,之前那些手法全部失效,无论 ...

吞什么?你不会花钱用api吗
回复

使用道具 举报

发表于 2026-9-27 23:27 | 显示全部楼层
想破甲还不用 api 才是没救了

回复

使用道具 举报

     
发表于 2026-9-27 23:35 | 显示全部楼层
jinuzuktII 发表于 2026-9-27 23:27
想破甲还不用 api 才是没救了

貌似现在很多人都在白嫖哈基米b反代的3.7 3.8f写文 类脑的预设已经差不多把谷歌的外审攻陷的差不多了  看来暂时ai还是比不过人脑
回复

使用道具 举报

     
发表于 2026-9-27 23:39 | 显示全部楼层
本帖最后由 ww-tsl 于 2026-9-27 23:45 编辑

几个月都没怎么碰这方面了(除了当搜索引擎用),有没有什么最近一个季度推出的,拿和谐少擅长写文当最大卖点的API客户端可以推荐的?

说到这种东西就是NoveAI,Dreamgen AI,KudoWrite这些。想看看活人对这几个的评价如何,哪个最值得投入?

回复

使用道具 举报

     
发表于 2026-9-27 23:39 | 显示全部楼层
国模现在的策略是对的,与其出了大家也用不起,不如搞flash级别的模型,至少营收上好看
回复

使用道具 举报

     
发表于 2026-9-27 23:47 | 显示全部楼层
等devday重演opus5.5惨剧咯,O/一发astra-minor,sol(terra)就被sonnet5.5狙击,然后luna被haiku狙击,opus卡住你的astra-minor,fable卡住你的astra,全部给你卡爆,额度和智商都拉爆你,O/骄傲地宣布推出500刀会员把所有人吓跑。
回复

使用道具 举报

     
发表于 2026-9-27 23:50 | 显示全部楼层
美国这波远程bot热潮算不算是iPhone垄断的产物? 我看做的事情和国内安卓厂商做的事情差不多啊.
回复

使用道具 举报

     
发表于 2026-9-28 00:07 | 显示全部楼层
最近AI越用越多,反而遇到问题,就是让AI整理工作流方案,结果AI出的总结文字怎么都看不进去
最近接了公司的工资核算想说用AI完全辅助一下,让CODEX给我整了个方案出来看的自己头疼。感觉脑子已经追不上AI的输出了
回复

使用道具 举报

     
发表于 2026-9-28 00:16 | 显示全部楼层
千千千千鸟 发表于 2026-9-28 00:07
最近AI越用越多,反而遇到问题,就是让AI整理工作流方案,结果AI出的总结文字怎么都看不进去
最近接了公司 ...

现在各种模型都被gpt腌入味了,还要回到老式提示词工程,现在我在各种总结类对话之前都会加一句“我是一个大学生,用我能听明白的方式说明”,这样类似gpt不说人话的风味语句会变少一些。
大学生提示词能默认用户有基本的逻辑理解能力+听不懂各种行业黑话,可读性比它直出高很多。
回复

使用道具 举报

     
发表于 2026-9-28 00:23 | 显示全部楼层
4.1Pro出来还是用得起的,如果后面出5-10T的模型,大概就DeepSeek这压缩KV的能力能用得起
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-10-11 13:23 , Processed in 0.202770 second(s), 7 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表