找回密码
 立即注册
搜索
楼主: kira1988

[科技] 话说国内跟国外的AI模型差距在哪

[复制链接]
     
发表于 2026-9-20 12:36 | 显示全部楼层
贝恩德塔 发表于 2026-9-20 10:58
https://yuriaqua.com/mygo/  用 astra 两轮跑出来的鸡狗斗地主,不知道国内能不能达到这个效果

思考级别开到多少,我开高点随便搞点什么一个星期的额度就去掉1/3了
回复

使用道具 举报

     
发表于 2026-9-20 12:37 来自手机 | 显示全部楼层
本帖最后由 serj005 于 2026-9-20 12:41 编辑

短期追上也不是不可能,astra这顶级位置真说不准能坐多久,之前opus4.6都觉得无敌了看不到赶上的可能(同样是认为国内卡不够做不到),结果现在国模人人皆有opus之勇,全都开始对标肥波了。
回复

使用道具 举报

     
发表于 2026-9-20 12:47 来自手机 | 显示全部楼层
serj005 发表于 2026-9-20 12:37
短期追上也不是不可能,astra这顶级位置真说不准能坐多久,之前opus4.6都觉得无敌了看不到赶上的可能(同样 ...

opus4.6也不是只有coding这个用途吧
回复

使用道具 举报

发表于 2026-9-20 12:48 来自手机 | 显示全部楼层
现在都不是怎么追上,而是多长时间追上

— from S1 Next Goose v4.0-alpha
回复

使用道具 举报

发表于 2026-9-20 12:54 来自手机 | 显示全部楼层
本帖最后由 NONORIRI 于 2026-9-20 12:56 编辑

Astra 跟 fable 5.1对我的任务确实比国模强不少,但我的任务偏数理研究型的,一般软件开发最近没怎么做过了确实不知道这俩有没有比国模强
回复

使用道具 举报

     
发表于 2026-9-20 13:02 | 显示全部楼层
5.6的sol都不算差距大,astra出来确实厉害,很多活漂亮很多

oa两家赶快用,百亿补贴不知道还能持续多久,10刀的plus套餐和1块的奶茶没区别

回复

使用道具 举报

发表于 2026-9-20 13:04 | 显示全部楼层
Astra太强了,相比于a畜的fable也强不少,a畜现在问题在于不说人话和过于发散。
回复

使用道具 举报

     
发表于 2026-9-20 13:06 | 显示全部楼层
虽然ds的api已经是最便宜了,但是比起来openAI真的是百亿补贴本贴
回复

使用道具 举报

     
发表于 2026-9-20 13:06 | 显示全部楼层
好蓝啊 发表于 2026-9-20 12:36
思考级别开到多少,我开高点随便搞点什么一个星期的额度就去掉1/3了

最低就够了,astra 最低已经非常强了,我体感堪比没降智的 sol xhigh,而且更重要的是可控,让他改什么就改什么,不像高思考喜欢自由发挥,也就是所谓的防御型编程
回复

使用道具 举报

     
发表于 2026-9-20 13:07 来自手机 | 显示全部楼层
穷人和富人的区别在哪儿:缺钱
回复

使用道具 举报

发表于 2026-9-20 13:09 来自手机 | 显示全部楼层
低难度使用没区别,只是最顶端的使用上差一截,但那个和普通人使用没关系
回复

使用道具 举报

     
发表于 2026-9-20 13:13 | 显示全部楼层
抛开模型能力先不说,价格方面其实很割裂的。
对企业用户来说,ao两家闭源,安全性存疑,价格还高,还不如国内的开源模型,性能不差多少,价格还便宜。
但是个人用就不一样了,coding plan的价格补贴太夸张了,Astra卖DeepSeek的价格,难免受人吹捧

论坛助手,iPhone
回复

使用道具 举报

     
发表于 2026-9-20 13:14 来自手机 | 显示全部楼层
到底是啥码农一定要选最强的模型给自己兜底啊,不是填空题吗
回复

使用道具 举报

     
发表于 2026-9-20 13:18 | 显示全部楼层
其实对于大部分人来说,现在最先进模型卷出的那些能力几乎就是不可感知的,正常用用的话国内模型的能力完全够了
回复

使用道具 举报

发表于 2026-9-20 13:21 | 显示全部楼层
顺便吹安全性的就算了,智谱上周刚爆出来把用户代码仓库加密打包上传的事情

评分

参与人数 1战斗力 -1 收起 理由
Min_FOrder -1

查看全部评分

回复

使用道具 举报

     
发表于 2026-9-20 13:29 来自手机 | 显示全部楼层
seducer0719 发表于 2026-9-20 13:21
顺便吹安全性的就算了,智谱上周刚爆出来把用户代码仓库加密打包上传的事情 ...

开源可以自己部署啊,一个公司用任何别人的云系统都有这个风险,但是你能本地部署GPT吗
回复

使用道具 举报

     
发表于 2026-9-20 13:31 | 显示全部楼层
先不说模型能力,国内比国外算力就是 20倍以上的差距
回复

使用道具 举报

发表于 2026-9-20 13:47 | 显示全部楼层
楼里发言说明大部分人都是64K上下文的2B小模型
回复

使用道具 举报

发表于 2026-9-20 13:58 来自手机 | 显示全部楼层
洛拉斯 发表于 2026-9-20 13:29
开源可以自己部署啊,一个公司用任何别人的云系统都有这个风险,但是你能本地部署GPT吗 ...

认真的吗?
哪怕模型开源,个人或公司内部能完整部署
铺开能力一致的基本没有
回复

使用道具 举报

     
发表于 2026-9-20 14:13 | 显示全部楼层
我现在Astra开medium基本满足我对DS V4.1 pro的期望,只要不用来直接写代码,plus的5小时额度也基本够用
Astra和Sol开到high以上就基本是过度思考了,返回时间也会被大 大拉长,没法快速反馈修正模型思路或者提出我的疑问是最让人头疼的
GPT思考强度再往上开相应的提升的只是one-shot的能力,对我来说这就是没意义的能力,因为我持续任务都丢给DS V4.1 flash干了,反正token不心疼,现在DS现在的指令遵循能力和长上下文也非常适合做持续性任务
但是DS flash V4.1我体感high和max的智商是有区别的,如果做规划只用high是完全不理解我想说的东西,开max会稍微好一点,但是又有不说人话的问题
所以目前还是期待4.1pro能有核弹瘫坐的效果,这块用起来肯定还是跟GPT的模型不一样的体验……
回复

使用道具 举报

     
发表于 2026-9-20 14:41 | 显示全部楼层
技术上没啥差距,差距只在规模和算力。
回复

使用道具 举报

     
发表于 2026-9-20 14:41 | 显示全部楼层
公司用sol,个人用DeepSeek-V4.1-Flash.
平时用Pi多,偶尔用OpenCode。

差距很明显,简单的任务确实V4.1-Flash也够用了,但是我们代码量特别大,历史包袱特别重,DeepSeek-V4.1-Flash跑着跑着会撞墙,换Sol重新出方案,立刻就改进了。
回复

使用道具 举报

     
发表于 2026-9-20 14:44 来自手机 | 显示全部楼层
yenvy 发表于 2026-9-20 11:49
奥特曼达里奥家的每一代模型是怎样做到比上一代先进的?是训练方法改进还是纯堆训练时长还是都有 ...

你对着4.6到4.8这么说你信吗?

—— 来自 HUAWEI SGU-AL10, Android 16, 鹅球 v4.0
回复

使用道具 举报

     
发表于 2026-9-20 15:07 | 显示全部楼层
qwased 发表于 2026-9-20 10:47
200刀月付的订阅用满了差不多是api计价8000刀的额度
国模的订阅最多给你2折 ...

20x没那么多了,一周现在应该就1600刀多
回复

使用道具 举报

     
发表于 2026-9-20 15:10 | 显示全部楼层
神必迷你龙 发表于 2026-9-20 10:23
ASTRA出来之前个人感觉差距不大,出来后差距很明显,根本原因就是算力不足,而国外的投入越来越大 ...

Astra 降智太厉害了,第一天和现在完全两个模型,现在这个只会流口水,sol 高都不如
回复

使用道具 举报

     
发表于 2026-9-20 15:18 | 显示全部楼层
感觉最大的问题是算力…你要说模型本身的能力确实是相差无几的,但算力不够再好的模型也要流口水的
回复

使用道具 举报

     
发表于 2026-9-20 15:25 | 显示全部楼层
枯风瘦雪 发表于 2026-9-20 13:18
其实对于大部分人来说,现在最先进模型卷出的那些能力几乎就是不可感知的,正常用用的话国内模型的能力完全 ...

+1,至少目前开发,glm体感够用了
回复

使用道具 举报

头像被屏蔽
     
发表于 2026-9-20 15:41 来自手机 | 显示全部楼层
提示: 作者被禁止或删除 内容自动屏蔽
回复

使用道具 举报

     
发表于 2026-9-20 15:47 | 显示全部楼层
价格。同价位下,订阅服务和额度本来就比国模划算,国外订阅还经常有bug价,前前后后买了2个450一年的supergrok、800的pro20x,1x会员平均下来月费不到40。转给别人,每月甚至能赚五六百
回复

使用道具 举报

     
发表于 2026-9-20 16:12 | 显示全部楼层
redbuck 发表于 2026-9-20 15:10
Astra 降智太厉害了,第一天和现在完全两个模型,现在这个只会流口水,sol 高都不如 ...

我这边用着还可以,试试其他干净的节点吧
回复

使用道具 举报

     
发表于 2026-9-20 17:41 | 显示全部楼层
yenvy 发表于 2026-9-20 11:49
奥特曼达里奥家的每一代模型是怎样做到比上一代先进的?是训练方法改进还是纯堆训练时长还是都有 ...

目前还是在力大砖飞,单纯拉参数量就能获得提升
回复

使用道具 举报

     
发表于 2026-9-20 18:33 来自手机 | 显示全部楼层
cc这么难用,老是封号
你要是在大厂,都会自己开发点agent的
回复

使用道具 举报

     
发表于 2026-9-20 18:44 | 显示全部楼层
程序员的问题在于公司无限制的话,别人的模型比你效率高就能淘汰你。在价格差距不大/不敏感的情况下必须追“最好”的。

https://space.bilibili.com/35467 ... arch-card.all.click
回复

使用道具 举报

发表于 2026-9-20 18:50 | 显示全部楼层
上次在泥潭问过,得到的答案是国外模型参数量大
国模参数量少可能也有算力不够支撑的原因吧
回复

使用道具 举报

     
发表于 2026-9-20 20:08 | 显示全部楼层
Astra也才发布不太久吧,说赶不上那也得等上几个月吧……
回复

使用道具 举报

     
发表于 2026-9-20 23:29 | 显示全部楼层

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|上海互联网违法和不良信息举报中心|网上有害信息举报专区|962110 反电信诈骗|举报电话 021-62035905|Stage1st ( 沪ICP备13020230号-1|沪公网安备 31010702007642号 )

GMT+8, 2026-10-11 07:21 , Processed in 0.167595 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz! X3.5 Licensed

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表