生成式AI和LLM应该怎么应用?
有好些个疑问呢1,目前在用火山引擎的,隔两天就要我登录,好烦。怎么避免?或者其他家?
2,Deepseek似乎不能输出图片,需要它解释一些电路上的东西就很麻烦。有能输出图片能力的吗?
3,有订阅POE,里面有些有可以语音对话的,但是我连接麦克风总是失败,是网络还是其他什么配置吗?
4,有看到有演示用人工智能对话纠正英文发音的,是哪家的服务?
5,有哪些口碑好的应用教程吗?各方面的都想看看
THX~
不少新技术自己每次都早早知道,然后赶了个大晚
越发感觉自己不是什么料,只是个普通人呢
这些问题你也可以问AI啊 1. 这年头使用方式要么网页版(包含用官方软件)要么api。买个api往通用软件(比如cherry studio)里一接就能用。
2. 这年头的图生成完全不是你想的那样。生成图片文件就不论了,就算是生成流程图,也是依托于代码渲染出来的。
3.4. 语音不懂,不好意思。
5. 这年头的大模型输入,在纯文本以外也支持一些文档。office几大件本来就是可以解压提xml的,图片有的只做了文本识别,没有通用意义上的识图。大多数时候还是文生文。
—— 来自 鹅球 v3.5.99 1. 没用过火山引擎。多服务商一般用 cherry studio 和 nextchat 这种客户端整合多家的 api token 使用。一般用户用 cherry studio 就能做到问答、图片生成、翻译、agent 、知识库等常规功能,cherry 的更新与最新应用跟进也非常快
2. 像 GPT-4o,Google Gemini 2.5,甚至于国内的豆包都有输出图片的能力
3. 没用过 POE
4. 我只用过豆包 ai 通话功能,它确实可以陪练口语
5. 应用教程这个太宽泛了,结合 awesome 在 github 上搜搜看吧,其实 b 站上知识分享的人也很多。目前 LLM 的使用除了搭建框架外,还有海量的 MCP 服务可供结合
comrade 发表于 2025-9-8 15:49
1. 没用过火山引擎。多服务商一般用 cherry studio 和 nextchat 这种客户端整合多家的 api token 使用。一 ...
输出图片简单,但是输出图片符合电路逻辑就难了 t
—— 来自 Xiaomi 22041211AC, Android 14, 鹅球 v3.5.99 在你需要的方向,找个大佬,然后用他写的智能体和数据库目录文件表。
页:
[1]