Hydro 发表于 2025-9-4 09:36

推荐一些(个人层面)好用的ai工作流?

如题,最近想要拿着锤子找一找钉子
虽然ai工作流平台很多,但是似乎没有见到什么在个人使用场景下特别有吸引力的工作流?
有哪些场景会常时地需要批量处理或输出非结构化资料的呢?

库德里尔 发表于 2025-9-4 09:46

我给你个钉子:
从各类rss源订阅信息,然后让llm给你每周出个摘要。

—— 来自 鹅球 v3.5.99

Hydro 发表于 2025-9-4 10:19

库德里尔 发表于 2025-9-4 09:46
我给你个钉子:
从各类rss源订阅信息,然后让llm给你每周出个摘要。


我记得很早之前我有一个类似的爬取各方材料然后生成统计信息和主题云图的工具,但是那个后续就没接着用,因为我发现如果我日常没有在阅读那些材料的话,我也不会对其报告感兴趣anyway
但是这个思路可能对感兴趣但是太长的内容有用?所以会有ai电影解说
或许可以爬**的几个小时的超长科普视频的字幕,或是用更先进的语音转文本模型,把内容转化为文本后给llm,让它总结内容和生成批判性观点,然后我根据这些内容决定要不要看
好像B站有些人投放的机器人实现的就是类似的功能,但是我可以私有化部署一个,更灵活

就咋的 发表于 2025-9-4 10:41

本帖最后由 就咋的 于 2025-9-4 10:55 编辑

我的钉子盒就是收藏夹,原来都是徒手锤钉,上个月才注册了 DS (没错,你没看错,我会使用高级工具了)


chautauqua 发表于 2025-9-4 15:39

有没有坛友用腾讯最近出的ima?

—— 来自 S1Fun

Hydro 发表于 2025-9-4 17:58

就咋的 发表于 2025-9-4 10:41
我的钉子盒就是收藏夹,原来都是徒手锤钉,上个月才注册了 DS (没错,你没看错,我会使用高级工具了)




ai生成3D建模是好文明,3D模型可以应用在更多地方,拿来生成视频的话也比直接2D图像生成要可控和可靠
可惜我3D建模软件技能都没点,离日常工作太远了,而且码农办公本带不起来

oswald 发表于 2025-9-4 18:11

github上的一个项目,用deepseek每天自动拉arxiv上指定领域的论文,输出摘要和总结

—— 来自 Xiaomi 2410DPN6CC, Android 15, 鹅球 v3.5.99

Hydro 发表于 2025-9-4 18:14

今日摸了一个自动下载和翻译yt视频字幕的工作流,基本上就是

js脚本爬取某个播放列表的元数据(其实yt-dlp也可以直接做到下载某个列表,但是我想更可控),或是手动维护to_download.txt->
yt-dlp下载to_download.txt内的视频的vtt字幕 ->
python程序过程对vtt格式进行简单的清洗,删除时间标记和冗余的文本(因为有些自动生成的字幕质量很差)->
把清洗后的文本分段,交给ai,让它还原正常的断行、标点和纠正可能的误听 ->
将纠正后的英文文本再次分段交给ai,让它进行翻译,输出中英json格式文档



如果加上自动打字幕和自动上传B站,应该能做到自动搬屎,但还是不要了

whzfjd 发表于 2025-9-4 18:24

之前想试试网页自动操作,结果被 selenium + wall + cookie + cloudflare + recaptcha 搞到再起不能

Hydro 发表于 2025-9-4 18:28

我今天正好遇到个需要用ai辅助的场景,某学习平台上推了一个某没必要地巨他妈长和难的学习任务,而且在线考试把人当日本人整,简单的文本模式匹配搜不到答案

那个我把他们文档爬下来以后,丢到某rag服务里去了,然后配合DS直接把问题往里面怼,效果还不错,只不过复制粘贴效率太低,这个过程可以自动化一下
简单来说就是

js把教学文档批量爬下来->
丢进rag的向量知识库里->
js把试题遍历爬取下来->
疯狂并发问ds选什么->
形成答案文档或者直接消费(指填进试卷)

5202年了,怎么还有人要用脑子记的(反正平时也没用),就应该狠狠开发速查网站和回答ai,落后,落后哇

wasdfghjkl 发表于 2025-9-4 18:44

大家说的都好专业啊我有个需求不知道怎么实现比较容易 试了试豆包感觉不大行      一般做项目习惯直接汇总在我们比较标准的目录模版ppt里面无论是查缺补漏还是直接给领导汇报直接都很方便不过一旦项目值得推进 最终还是要提交一个word文档的报告。想知道哪个AI比较擅长这种 阅读和整理汇总ppt 然后再按照word目录的格式或者模板往里填充 最后直接输出文件的

Hydro 发表于 2025-9-4 18:47

whzfjd 发表于 2025-9-4 18:24
之前想试试网页自动操作,结果被 selenium + wall + cookie + cloudflare + recaptcha 搞到再起不能 ...

我爬数据一般抓api然后后端发请求调,selenium的状态控制写起来巨麻烦,而且浏览器元素哪个元素出现哪个不出现很难固定,说不定下次网站改了改样式自动化脚本就不能用了,不可靠;而且失败了通常要完全重新开始,拟真性++ 效率-- 健壮性----
如果是要网页环境,我一般直接写个js遍历我想要的元素然后下载,可以作斗争但没必要,我真的就是个真人在操作浏览器,只不过运行了一段js来解放我的双手捏

库德里尔 发表于 2025-9-4 19:00

暴力的场合,无头浏览器+bs4……

—— 来自 鹅球 v3.5.99

whzfjd 发表于 2025-9-4 19:07

Hydro 发表于 2025-9-4 18:47
我爬数据一般抓api然后后端发请求调,selenium的状态控制写起来巨麻烦,而且浏览器元素哪个元素出现哪个 ...

我想用真实浏览器过了真人验证的 cookie 搞后续操作,结果它 cookie 死活留不住 + 反复触发验证

diohanmilton 发表于 2025-9-4 19:08

问一个,目前还有没有微信公众号转rss或者其他订阅的爬虫了。

—— 来自 鹅球 v3.3.96-alpha

gx19860411 发表于 2025-9-4 20:09

Hydro 发表于 2025-9-4 17:58
ai生成3D建模是好文明,3D模型可以应用在更多地方,拿来生成视频的话也比直接2D图像生成要可控和可靠
可 ...

请问现在ai生成3D模型用哪套工具好?方便拆分部件吗?

—— 来自 Xiaomi M2011K2C, Android 14, 鹅球 v3.5.99

Hydro 发表于 2025-9-4 20:38

wasdfghjkl 发表于 2025-9-4 18:44
大家说的都好专业啊我有个需求不知道怎么实现比较容易 试了试豆包感觉不大行      一般做项目习惯直接 ...

我不确定有没有模型对这种直出优化过,但是我要做的话应该会先把ppt转化为某种文本表示形式(比如html),然后清洗那个html(尤其是类似转化出了base64表示的图片的场合,那些元素对模型理解没用,可以全部洗掉),或者直接让模型提取里面的文本内容,看到模型提取出的内容比较合理之后,再让模型根据那个内容进行写作
相当于拆分成几个步骤,然后human in the loop一下,可以做到更好的品控

Hydro 发表于 2025-9-4 20:47

whzfjd 发表于 2025-9-4 19:07
我想用真实浏览器过了真人验证的 cookie 搞后续操作,结果它 cookie 死活留不住 + 反复触发验证 ...

"留不住"听着像是被什么东西冲掉了,比如某处的响应头里有个set-cookie,或是某处js有个自动更新cookie的代码,假如看到的最终发送的请求头里的cookie跟自己塞的那个不一样的话;
但是如果至少有一个可用cookie(无论是从真浏览器里拿过来的还是无头浏览器自己拿到的)的话也不应该反复触发recaptcha?可能是单纯的cookie有效期短,无头浏览器自己有什么特殊请求头(e.g. user-agent:X-Headless-Chrome)被服务器识别到了,或者服务器单纯地认为你的ip很可疑

Hydro 发表于 2025-9-4 20:50

gx19860411 发表于 2025-9-4 20:09
请问现在ai生成3D模型用哪套工具好?方便拆分部件吗?

—— 来自 Xiaomi M2011K2C, Android 14, 鹅球 v3 ...

我不知道,你得蹲个有缘人
我不会建模,我只是技术刚出来的时候试用过几个而已

就咋的 发表于 2025-9-4 20:59

Hydro 发表于 2025-9-4 17:58
ai生成3D建模是好文明,3D模型可以应用在更多地方,拿来生成视频的话也比直接2D图像生成要可控和可靠
可 ...

好多技能点都是被动点出来的。实况足球9 (PES5) 外挂球场、真实头像、球鞋等,有些弄得太糙了,去看了几个视频教程开始鼓捣 Rhino, 瞎鼓捣了一个礼拜,弄了一个看着挺好看,但是根本无法载入的玩意 -(o_O)<`. BANG!!!

继续用别人的模型吧,这说着技能也没点出来啊,是的。

魔法师lain 发表于 2025-9-5 09:43

时隔十多年重回游戏汉化玩玩,现在有什么能处理本地文本(把暴力导出的文本整理一下,去除乱码和明显不需要翻译的),初翻文本。现在没有强力显卡,有没有好用的ai工具?

hanfze 发表于 2025-9-5 18:26

whzfjd 发表于 2025-9-4 18:24
之前想试试网页自动操作,结果被 selenium + wall + cookie + cloudflare + recaptcha 搞到再起不能 ...

我有个selenium邪道用法就是在调试模式里调用,把登录验证啥的全手动解决,只用脚本执行抓取,这样写会简单很多

wasdfghjkl 发表于 2025-9-5 23:18

Hydro 发表于 2025-9-4 20:38
我不确定有没有模型对这种直出优化过,但是我要做的话应该会先把ppt转化为某种文本表示形式(比如html) ...

感谢 我研究下

Hydro 发表于 2025-9-16 18:47

把这贴挖起来

近日打forge(万智牌对战引擎)的冒险模式,但是奖励的牌很多鉴别得很累,于是有了这个东西
万智牌自动评分工具


左边两个部件是普通的万智牌图鉴,有基本的带分页搜索的导航,中间显示牌的基本信息(数据是从forge里扒的)
右边接入了我本地的llm服务,可以一键把中间的卡的数据喂给它,然后配合提示词产出一个相对结构化的分析

结合设计常见性(可替代性)和强度可以快速分析出哪些卡留哪些卡卖

缺点:模型毕竟不是真的牌手经常会胡言乱语(比如“多个杰斯配合效果更好”),缺乏环境理解,另外很明显没有最新最靓的新拓展包里的内容

scstriker 发表于 2025-9-16 19:01

我看最近这半年老主机汉化游戏井喷,除了翻译以外是哪部分大规模用到AI了呢?破解?

MLP_102 发表于 2025-9-16 19:06

本帖最后由 MLP_102 于 2025-9-16 19:08 编辑

这两天搞了一个利用小红书的Dots.OCR,搞文本识别的自动处理,把一些以前的只有扫描档的旧书转换成了电子文本,姑且算是ai吧
可惜对竖排的日文文本不太友好 设备本身有些孱弱

Izunu_3 发表于 2025-9-17 02:06

对ai建模挺有兴趣的,有什么上手难度低一点的玩具吗

希德尼娅 发表于 2025-9-19 21:24

gx19860411 发表于 2025-9-4 20:09
请问现在ai生成3D模型用哪套工具好?方便拆分部件吗?

—— 来自 Xiaomi M2011K2C, Android 14, 鹅球 v3 ...

图生3d方面sparc3d输出比较稳定

dangoron 发表于 2025-9-20 12:21

自己搭的一个常用工作流是,用docs.ocr提取PDF文件中的文本信息,然后用LLM把关键信息提取成JSON。用来对大量PDF做信息筛选很实用

—— 来自 S1Fun

全世界失恋 发表于 2025-9-21 08:01

万恶淫猥手 发表于 2025-9-21 08:52

页: [1]
查看完整版本: 推荐一些(个人层面)好用的ai工作流?