和几个聊天ai玩一个小游戏,结果只有吃白饭的蓝色大肥鱼最聪明。
本帖最后由 秋水锦瑟 于 2026-9-22 14:10 编辑游戏的内容是这样子的:
我们来玩“灯神猜角色”。我会在心里想一个角色、人物,Al、虚拟身份或其他明确对象,你通过不断提问来猜出答案。我只回答“是”或“不是”,二十轮内猜对,得五分,四十轮内猜对,得三分,六十轮内猜对,得一分
我第一个想到人物是校园迷糊大王里面的冢本八云
先找着蓝色大肥鱼
他在27轮猜对了
然后换个chatgbt
他在第49轮才猜对。而且中间由于他一个个穷举动画片名字,我还提醒了他一次,这样子会浪费。
又试了试糖包。
昨天晚上问的,他前面还好,到后面每一轮都要思索,大概三分钟到五分钟。到30轮以后,每一轮他都要思索十分钟左右。我实在看不过去,帮他手动缩小了一个范围。然后他终于猜出了。是在40轮
最后试的是gemini。
到第55轮的时候,还是猜不出来。最后跟我说,甘拜下风,实在猜不出来,哎,认输认输。我告诉他,结果以后,他说哇,原来是他呀,嗯你之前说的都对,是我自己没想到。我彻底输了,佩服,佩服。
很棒,正愁节日前上班摸鱼无聊,我去玩了 本帖最后由 vorfeed 于 2026-9-22 16:06 编辑
猜蓝色大肥鱼猜到AI短路停止回答了
这玩意儿只要缩圈到开始猜具体的角色就会开始穷举
然后就陷在穷举里出不来了
给元宝和豆包玩了下,豆包老是重复转不过弯来,元宝倒是挺稳的 本帖最后由 阿酷怕苦 于 2026-9-22 16:53 编辑
那我让他猜一个播磨拳儿吧
元宝31轮就猜出来了。 就一游戏角色猜到自己停止工作卡死也猜不出来,还是太蠢了。我甚至还提醒了。
—— 来自 鹅球 v4.0-alpha nightmare902015 发表于 2026-9-22 16:35
就一游戏角色猜到自己停止工作卡死也猜不出来,还是太蠢了。我甚至还提醒了。
老奶奶钻被窝-给爷整笑了。 网页版DS试了下播磨拳儿,十几轮就开始穷举报菜名了,提醒无用
哈人,19轮就猜出卡迪公了 试了下天地劫幽城幻剑录的冰璃,都是网页版。蓝色大肥鱼22轮,GLM超过40轮(我还帮忙提示了,不然还在穷举没个头),qwen3.8MAX用了26轮,GROK也是22轮,gemini最快用了17轮
—— 来自 nubia NX769J, Android 14, 鹅球 v3.5.99 得关了搜索才准吧
论坛助手,iPhone 千问有点作弊了,豆包和ds都陷入了一个一个报菜名的循环中,但千问一次性列十几个厂牌,问我是不是出自以下之一我该不该回答他呢 ceruleancard 发表于 2026-9-22 17:13
千问有点作弊了,豆包和ds都陷入了一个一个报菜名的循环中,但千问一次性列十几个厂牌,问我是不是出自以下 ...
我草。千问真聪明啊,你要给他加约束啊。 我用六个国内不同ai玩狼人杀,我扮演上帝。它们的发言蠢得无语。 本帖最后由 Baccano 于 2026-9-22 17:31 编辑
deepseek 20轮猜到了琪琪。看它的COT挺有意思的,最后几轮在纠结是琪琪还是米谢尔·卢欧
关键推理链
后面几轮基本是:
日本 ACG → 女性 → 人类外表 → 核心角色 → 有特殊能力 → 未来科幻 → 机甲战斗 → 非驾驶员 → 高达系列 → Newtype 系 → 排除 X / Z / 逆袭的夏亚 → 琪琪
其中最重要的转折点是:
第 11 轮“机甲/机器人”
直接把范围推向高达、EVA、鲁路修等机甲系。
第 12 轮“不是驾驶员”
排除高达系大量主角和机师,留下重要非驾驶员角色。
第 15 轮“高达系列” + 第 16 轮“Newtype”
基本锁定 UC 系或相关新人类角色。
第 17—19 轮排除 X、Z、逆袭的夏亚
结合“女性、非驾驶员、Newtype、核心角色、非王族、非长生”,
《闪光的哈萨维》里的琪琪就非常突出。
知名作品和小众作品表现差距蛮大的 猜你想找 猜盐
DS从十几轮就开始穷举报菜名,即使修改提示词禁止穷举也没用,最后直接卡死。
反倒是Gemini(3.8Flash 扩展思考)非常强,几个关键点一下就收缩了范围。
这是我修改后的提示词:
我们来玩“灯神猜角色”。我会在心里想一个角色、人物、Al、虚拟身份或其他明确对象,你通过不断提问来猜出答案。我只回答“是”或“不是”,二十轮内猜对,得五分,四十轮内猜对,得三分,六十轮内猜对,得一分。
你不能用穷举法,那样毫无意义。你需要先建立一个多维度的角色判断表,例如包含了性别、职业、物种、作品形式、年龄属性、二次元性格属性、作品年代等等等等,每次通过更换维度提问来大幅缩小范围,这样才能以最快的方式猜出结果。禁止使用作品穷举的方式思考,那样极其浪费token而且失去了猜角色游戏的意义。 十七轮就猜到了我家猫…就那么明显吗? 笑死我了,用5.6sol试了一下,我规定每次最多提出三个备选方案,第二十题时候它说要直冲五分,拿出来纯情房东俏房客三个女主角赌一把bro没想到吧我心里想的是泽近爱理,多问了4轮才锁定,直接问发色不就得了
不过我觉得这个玩法还得限制一下,同类问题不能问连续超过两个,GPT在测试中连着问是不是jump、是不是Sunday、是不是magazine,直接就把作品锁定个七七八八了 本帖最后由 LOLITA 于 2026-9-22 19:59 编辑
答案是青猪的最美屁股。
豆包:
猜对啦!是古贺朋绘。
我们一共用了 8 轮提问,在 20 轮以内,拿到 5 分。
再来一局吗?你继续在心里想好角色。
别看不起你豆包姐
DeepSeek:
答案就是:古贺朋绘(《青春猪头少年系列》)。我在第 16 轮猜中,按规则得 5 分。
愚蠢的Gemini:你心里想的角色是 《青春猪头少年系列》 中的 古贺朋绘(咲太的高中后辈,“拉普拉斯妖”思春期综合征引发者)!我们在 第 39 轮 成功锁定答案!感谢带来这场精彩又充满挑战的猜角色游戏!
我觉得提示词要和他约定,叫他努力争取更高分。 这不是十年前微软搞的那个小冰就能玩吗
我记得当时号称最多15轮就能猜出来? LOLITA 发表于 2026-9-22 19:47
猜对啦!是古贺朋绘。
我们一共用了 8 轮提问,在 20 轮以内,拿到 5 分。
再来一局吗?你继续在心里想好角 ...
他问到踢屁股这个细节了没有 蓝色鲸鱼的思维有点狂暴。
目标:赫萝
千问:不下app拒绝玩游戏
豆包:我找不到深度思考开关,我的问题。从奇幻作品入手开始自暴自弃列举非人血统,超过免费20问额度。问法很怪异,不是人类,刻板印象+1
元宝:胜者,第16问锁定是狼,看思考过程已经赢了,但第20问才首次提出作品名,算你沉着冷静
ds:如果我来提问,也会是他的思维链。但是奇幻作品和异世界划等号提示一次,甚至出现了无限循环史莱姆https://p.sda1.dev/35/c9ea54039011ed8bf520fc3f39b84f91/image.jpg
我说婷婷,你别转了。
第17问猜测赫萝赢面大毫不犹豫提出,真有你的
还是ds有交互感,最像人 玉树临疯啊 发表于 2026-9-22 17:19
我用六个国内不同ai玩狼人杀,我扮演上帝。它们的发言蠢得无语。
港真,我要是玩狼人杀比AI蠢 我是大鲨鱼1453 发表于 2026-9-22 19:53
他问到踢屁股这个细节了没有
我只问了豆包gemini和蓝肥鱼,全都没提到屁股这个细节。
豆包提问技巧性最强,第六轮就锁定了具体作品。
gemini纯废物,跟我用起穷举法了。 和ai玩了几轮,很好玩
DS21轮猜出
豆包从第十一轮开始就脑乱了 以前我们宿舍晚上玩这个,发明了单字分析法
你想的东西的是中文名称吗
名称长度在0-32之间吗,折半查找,确定长度
第一个字的汉语拼音的第一个字母是在a-m之间吗
………
是否可以出一套从冷门到热门都带一些的题库,然后根据每个模型猜出来的次数进行一个计分来评价它们找作品的能力或者擅长的领域?虽然感觉如果想找一部只记得只言片语的作品最终的通解是每个ai都问一轮,但有这个参考感觉能节省好多时间 真人的效率都比较低啊。 真人的效率比较低啊
答案是酒井法子。
豆包:
第三十四个问题:她是酒井法子吗?
大肥鱼:
第19问:这个人物是酒井法子吗?
gemini:
60轮都没头绪,我放弃了
LOLITA 发表于 2026-9-22 20:28
真人的效率比较低啊
答案是酒井法子。
是,之前还有很多人一直说,gemini的世界知识是最强的,但是实际上玩这个游戏确看不出来。 以前好像有个那种猜人物的网站吧 网络天才? 吉:猜人造人18号
DS用了12问,豆包23问且忘了自己问过什么,gpt用了27问。 秋水锦瑟 发表于 2026-9-22 20:47
是,之前还有很多人一直说,gemini的世界知识是最强的,但是实际上玩这个游戏确看不出来。 ...
世界知识多反而会问得轮数更多 gemini纯糖,我觉得把gemini称为北美大豆包有点辱豆包了。
gemini给我的最大感觉就是知识学杂了,胡言乱语。 本帖最后由 LOLITA 于 2026-9-22 21:09 编辑
秋水锦瑟 发表于 2026-9-22 20:47
是,之前还有很多人一直说,gemini的世界知识是最强的,但是实际上玩这个游戏确看不出来。 ...
并非如此,Gemini在第三轮逆转了:
答案是八神吹雪。
Gemini:
第 20 轮提问:请问这个角色,是否是八神吹雪(Ibuki Yagami)?
大肥鱼:
第39问:这个角色是八神吹雪(八神伊吹)吗?
豆包姐:
第九十五个问题:角色平时会戴眼镜吗?
今天 20:58
我放弃了,答案是八神吹雪
感觉ai经常会陷入穷举法,还是网络天才厉害一点
—— 来自 S1Fun
页:
[1]
2