aimbot 发表于 2026-10-6 13:06

抛砖引玉一下,一个关于ai杯子的想法

ai杯子现在理论上确实能够实现
大致就是把osr这种通过脚本运行的炮架接入模型
语音输入→转换文字→模型处理→模型同时转换成文本和脚本→输出到机器上
几个月前试过这个种方案,就是延迟非常大,上面这一条龙走下来再快也要两三分钟,就算加入了预处理和随机轴运动,体验效果还是非常差,遇到瓶颈了
泥潭卧虎藏龙不知道有没有大能指点一下

我不是学院派,纯野路子

Jet.Black 发表于 2026-10-6 13:12

AI负责情感交流,运动控制逻辑还是要实时系统来搞。

aimbot 发表于 2026-10-6 13:24

Jet.Black 发表于 2026-10-6 13:12
AI负责情感交流,运动控制逻辑还是要实时系统来搞。

如果是这样的话普通的电动飞机杯就能解决了
主要是想要炮机的轴运动和ai语音同步输出

炎之暴君 发表于 2026-10-6 13:28

我觉得是让ai先大量学习素材,根据关键词控制运动部分的激烈度,最后形成根据素材同步爬坡的行为。

铁甲钢弹 发表于 2026-10-6 13:41

这应该不算讨论法器吧,只是讨论一下操控技术?

感觉这个需求是在实时聊天中进行控制,不是视频那种可以全程预处理的情况。那实时聊天,似乎只能靠更多预处理了吧。多预录好一些场景和对应的脚本、语音,并且在这些场景中增加一些控制点,在实时聊天中,AI选择调用这些场景,同时再按照实时语音去调用场景控制点,比如让某段运动延长或者停止,在思考的时候维持之前的动作或者一些随机停止配合语音模拟寸止之类。总是就是用类似游戏里面loading过场来掩盖实际loading过程的思路,尽量减少实时生成,以及通过预录场景进行参数控制,来掩盖思考延迟导致的操控延迟。

我没用过AI也没用过OSR,纯靠猜测的

qwased 发表于 2026-10-6 13:58

多做几种预设然后直接上分类器来控制什么时候切模式?

Kaltsit 发表于 2026-10-6 14:18

这个是为了达到什么目标?实时+拟真吗。

前者的瓶颈是AI理解文本输出指令这个过程需要长时间思考?后者的问题在于AI没有任何资料输入,只能凭空瞎想?

所以或许需要一套SKILL+Semantic IR / DSL+MCP?即自然语言应该以什么方式理解意图,然后意图如何转换成操控目标,最后操控目标应该如何通过工具调用指令来实现。

hu14againagain 发表于 2026-10-6 14:36

......实际上电动玩意儿基本不好用.......

棍机凹升龙 发表于 2026-10-6 14:54

之前有用gpt扮演触手怪接摄像头和跳蛋的项目
https://github.com/ra1nyxin/tentacle-monster-roleplay-esp32

—— 来自 samsung SM-F9460, Android 16, 鹅球 v3.5.99-alpha

麻仓月轩 发表于 2026-10-6 15:07

语音输入到输出整套流程本地部署 延迟可以控制在1s
大模型用远程的 也可以控制在几秒
但实际你就几套固定模式,可以事先生成好,用用快速决策模型就行了



—— 来自 vivo V2454A, Android 16, 鹅球 v3.5.99

hugosol 发表于 2026-10-6 15:22

你模型实时写脚本肯定慢啦,能事先写脚本的就写脚本,语义分析用jev这类模型做路由判断就行了

takami 发表于 2026-10-6 16:27

你这需求哪里用得到ai啊

查表就可以了

伽蓝寺 发表于 2026-10-6 18:53

但是,要射O其实有好几种方法,可以试试配合郊狼使用电刺激法更加赛博一些吧,而且硬件上也更好的支持ai

刀巴 发表于 2026-10-6 19:15

感觉像牛肉的那个电击项圈
页: [1]
查看完整版本: 抛砖引玉一下,一个关于ai杯子的想法