全部/科技/节点 · 分享创造

V2EX · 节点 · 分享创造

HISTORY近 30 天历史柱高表示当天去重热搜数量
5007
09/08—10/07 有历史数据
  • 01
    开源了 12 个电商短视频 Agent Skills:一张商品图 → 带配音字幕的 15 秒竖屏视频,本地 ffmpeg 出片
    之前发过一个电商出图的 Skills ,有人问能不能接着把图变成视频。这周把这部分也做完了,开源( MIT ): https://github.com/xianyu110/ecommerce-video-skills?utm_source=v2ex&utm_medium=post&utm_campaign=ecommerce-video-skills&utm_content=body 想解决的问题 :让大模型写带货分镜很容易,但写完还得自己开剪映一镜一镜拖。我想让 agent 不光写脚本,还能把片子真剪出来。 做法 :让 agent 输出一份 storyboard.json (每镜:用哪张图、怎么动、说什么、字幕高亮哪个词),然后本地一条命令渲染: python scripts/assemble.py storyboard.json -o out/demo.mp4 脚本做的事:edge-tts 逐句配音 → 镜头时长按配音实际长度反推 → 静图做 Ken Burns (逐帧 scale+crop ,比 zoompan 稳)→ xfade 转场(居中在镜头分界,不吃配音)→ ASS 字幕boisy
  • 021
    做了个 Chrome 标签管理插件:先存再关、崩溃有快照、标签组能原样恢复
    自己用标签管理插件时最怕两件事:一是崩溃或手滑之后标签找不回来,二是存起来的标签组恢复后变成一堆散标签。所以做了 Tabwright 。 - 会话:把所有窗口存下来,可以恢复整个会话、一个窗口或单个标签 - 后台自动保存 + 崩溃快照 - Chrome 标签组保存和恢复时名字、颜色都保留 - 键盘搜索所有窗口的标签,回车直达 - 点 × 关闭、拖动排序、同一网站排在一起、关闭重复标签 - 不用注册,没有统计代码,数据只在本机 免费可用( 3 个会话、2 个工作区)。Pro 一次买断 $6.99 ,没有订阅。 我是作者,欢迎挑毛病,尤其是标签特别多的朋友。 https://tabwright.dev/zh/tomyinxkd
  • 03
    做了个 PDF 银行流水转 Excel 的网站
    一、产品概述 Bank Statement Wizard 是一款专注于 PDF 银行对账单转 Excel 的在线工具,官网地址为 https://bankstatement-wizard.net 。其核心定位是帮助用户摆脱手动录入银行流水的繁琐过程,通过自动化转换技术,将 PDF 格式的银行对账单快速、精准地转换为结构化的 Excel 表格,从而大幅提升财务数据处理效率。 二、核心功能 1. PDF 转 Excel 转换 支持将 PDF 格式的银行对账单转换为可编辑的 Excel (.xlsx / .xls )文件。 转换后保留原有的交易数据结构,包括交易日期、交易描述、收入/支出金额、账户余额等关键字段。 2. 高精准度识别 针对银行对账单常见的复杂排版(多栏、表格线、页眉页脚等)进行优化识别。 减少传统 OCR 工具常见的错行、漏项、数字识别错误等问题。 3. 结构化数据输出 将非结构化的 PDF 文本整理为规范的表格行列,便于直接在 Excel 中进行排序、筛选、求和与透视分析。 4. 在线操作,无需安装 作为网页端工具,用户无需下载安装额外软件,通过浏览器即可完成上传与转换。gigode
  • 04
    做了个浏览器本地处理 GIF 的小工具站,欢迎大家挑毛病
    大家好,独立开发者一枚,最近做了个在线 GIF 工具: https://easygif.app 为什么做这个 平时经常要把录屏、视频片段转成 GIF 放到文档和 issue 里,用过的几个在线工具问题不少:要上传文件到服务器、导出带水印、有的还要注册登录。干脆用 Claude 写了一个。 目前的功能 [视频转 GIF:支持 MP4 / WebM / MOV ,可选起止时间] [多张图片合成 GIF ,可调整顺序和每帧时长] [裁剪、调整尺寸、调速度、倒放] [ GIF 压缩,控制输出体积] [添加文字] 全部免费,无水印,不用注册。 技术实现 [所有处理都在浏览器本地完成,文件不会上传到服务器。] [前端用 Next.js ,部署在 vercel 。] 求反馈 刚上线没多久,肯定还有很多问题,欢迎大家试用后拍砖:功能缺什么、哪里不好用、遇到 bug 都可以直接回帖,我会尽快修。 谢谢!lijiang0327
  • 05
    做了个小工具:两张照片生成 Hotel Lobby 风格的 AI 短视频
    最近 TikTok / Reels 上有个挺火的 "Hotel Lobby" 梗:两个人挤在一个橙色的小录音棚里,中间吊着一支麦克风,对着镜头轮流 rap。后来大家开始用 AI 把自己、朋友、对象甚至猫狗放进这个场景,效果挺魔性的。 我自己试的时候发现,用通用的 AI 视频工具做这个要写 prompt、找参考图、反复调参,挺折腾。所以就做了个只干这一件事的小网站: https://myhotellobbyai.com 用法很简单: 上传两张照片(左右各一位,人或宠物都行) 点生成,等一会儿 拿到一条 8 秒、9:16 竖屏、720p 的 MP4,配乐是 AI 生成的(不是原曲) 不用注册,不用写 prompt。按条付费($5.99 一条),生成失败会自动退回 credits;上传的照片 24 小时后自动删除。 演示视频: https://youtu.be/u4-xVfZRgxs 技术栈是 Next.js + Neon,大部分代码是和 Claude Code / Codex 一起写的。个人项目,还比较粗糙,欢迎大家试试、拍砖提意见 🙏lavande
  • 06
    查词还能顺手看词源: WordHub iOS 版上架了
    折腾了一阵,WordHub iOS 版刚上架。 可以并排查多本词典,也能沿着词源时间线和地图逛单词;碰到想记的词就收藏,之后再复习,进度会和账号同步。 App Store: https://apps.apple.com/app/wordhub/id6812649164 欢迎试用,拍砖也行meekr
  • 07
    在线社交视频转 GIF 小工具
    做了个小工具,叫 GIF Downloader: https://gif-downloader.app 粘贴帖子链接就能下载视频,支持 X / Twitter 、Facebook 、TikTok 、Instagram 、Threads 和 Reddit 。想做动图的话,可以直接选一段转成 GIF 。 也能打开本地视频或 GIF ,裁剪画面、调帧率、限制文件大小。转换在浏览器里完成,本地文件不用上传。 免费,不用注册,打开网页就能用。有需要的可以试试。zhw2590582
  • 087
    受 Jev 启发,花了三周、600 美元、20 多轮训了两个小模型专门做 Computer use
    这三周业余时间做了个东西,开源出来给大家看看。 DeskMind 得心:一个在 Mac 上替你操作电脑的 agent ,决定每一步怎么做的是两个跑在本机的小模型( Qwen3.5 0.8B 和 4B 微调,MLX )。不走云端,也不按次付费。 思路来自 Jev:把每一步变成选择题,让模型给每个选项打分,而不是生成一段文字。区别是 Jev 是云端服务,我想要一个全在本机跑的版本,所以自己在 Qwen3.5 上训了 0.8B 和 4B 两个小模型。决策服务用的是和 Jev 相同的 POST /v1/systemone 请求格式,已有的 harness 换个地址就能接到本机。和 TypeSafe 没有任何关系。 0.8B 有把握就直接做(大约 0.5 秒),没把握就交给 4B 再判断(约 3.6 秒)。任务有两种理解的时候,它会先问你,比如表里有两笔 Lisa Wong 的订单,它会问你用哪一笔,而不是随便挑一个写进去。 自己出了 13 个真机任务,每个跑 3 次,目前发布版是 38/39 ,没出现过没做完就说「完成」的情况。题是我自己出的、样本也小,仅供参考,逐题结果都公开了。 踩过最有意gxcsoccer
  • 092
    做了一个把照片转成短视频的网页工具,想听听大家的使用反馈
    我做了 TurnImageIntoVideo ,可以上传自己有权使用的照片,选择模型并描述希望出现的动作,生成短视频。网站支持中英文。 地址: https://turnimageintovideo.com/?utm_source=v2ex&utm_medium=referral&utm_campaign=launch 想请大家试用后反馈:图片上传和生成流程是否顺手?结果是否符合动作描述?遇到问题时,提示是否清楚? 这是我自己的产品,欢迎直接提问题。具体额度和收费以网站当前展示为准。Blues0203
  • 101
    国庆在家搞了个小游戏站,去年的游戏词
    国庆没出门,在家折腾了个出海小游戏站点,上线 Wacky Flip ,一款 ragdoll 布娃娃物理空翻小游戏。 浏览器直接打开就能玩,PC/手机都适配,不用下载客户端。 玩法很简单:按住蓄力起跳,空中控制旋转,双脚平稳落地才算成功。物理效果很魔性,经常各种翻车,摸鱼几分钟放松一下刚好。 站点: https://wacky-flip.net 后续会加更多好玩的小游戏进来。shonewangu
  • 11
    [送码] 做了个随机翻阅过去照片的 App: Itemory - 时光相册,能接 NAS、WebDEV、SMB
    为什么做这个 我们一直在拍照,却很少再打开它们。相册往上滑五屏,是收据、梗图和路线截图;再往下,才是几年前某个下午的光。 系统相册是按时间线排的,最近的永远在最前面,几年前的照片基本没有机会再被看到。所以我做了一个反过来的东西: 每次打开,从你的相册里随机抽出过去的一天,把那天的照片和视频摆到你眼前。 一句话介绍:翻出你忘掉的那一天。 App Store: https://apps.apple.com/cn/app/itemory/id6769250619 官网: https://itemory.gouqinglin.com/ 它能做什么 Reels:随机翻回过去的一天 竖向全屏滑动,每一页是同一天的照片和视频,上下滑换一天,左右滑看当天的其他内容。日子是随机抽的,本轮看过的不会再抽到,翻完一轮可以重新开始。可以收藏这一天、记下心情和手记,也可以开纯净模式,隐藏所有界面只看照片。相册里的视频还能截一段导出成实况照片,拿去做锁屏壁纸。 那年今日 / 那年节日 按同月同日把往年的今天聚到一起,按年份翻。某一天如果是节日(中秋、除夕、七夕、国庆,以及所在地区的公众假日),日期旁边会有节日标签sherlockGou
  • 12
    送码|镜像机器人:在 Mac 上给 iPhone 镜像录制和执行自动化流程
    在 Mac 上给 iPhone 镜像录制和执行自动化流程 最近做了一个 macOS 小工具,叫「镜像机器人」,主要是配合 Mac 上的 iPhone 镜像使用,把一些需要重复操作的流程录下来,之后自动执行。 目前可以免费送一些体验码,想试试的朋友可以下方领取。 产品地址: https://mbot.snso.win/ 它能做什么? 简单来说,就是把你在 iPhone 镜像窗口里的操作记录下来,整理成一个可以重复执行的流程。 目前支持这些操作: 点击指定位置 滑动操作 滚动操作 输入文字 等待一段时间 等待某个颜色出现或消失 等待画面中出现指定文字 根据画面颜色做条件判断 根据 OCR 识别到的文字做条件判断 循环执行一组操作 设置失败后的重试、跳过或停止 录制完成后,可以在网页里查看和编辑流程,调整每一步的坐标、等待时间、输入内容和判断条件。也可以直接从零开始创建流程,不一定要先录制。 举几个适合的场景 比如: 重复打开 App ,点击固定位置完成一套操作 定期执行一组固定的点击和滑动 等待某个页面加载完成后继续下一步 等待按钮、提示文字或颜色出现后再操作 页面状态不同的时候,分别执行snso
  • 134
    [开源]基于 LAYA 本地开源决策模型的视觉应用水果采摘、杂草灭除、害虫监测、钢管质检、纺织物质检等领域
    [开源]基于 LAYA 本地开源决策模型的视觉应用水果采摘、杂草灭除、害虫监测、钢管质检、纺织物质检等领域 项目地址: https://github.com/uu889/laya-opencvuu889com
  • 143
    code agent 内的双向翻译
    起因是最近在做一个浏览器的翻译插件(感觉也要变成 todo list 的常见项目了 hh ),突然想到之前的想法:既然都推荐用英文和 agent 沟通(最近也有传言说用中文可能会增加 claude 的封号概率的)那为什么不做一个翻译插件呢 于是 https://github.com/jhao0413/parrot-agent-extensions 来了,目前是只做了 claude 版本,这两天会把 pi 的也补上,效果图如下 做的比较匆忙,后续会持续优化,欢迎大家反馈建议jhao413
  • 15
    做了一个 AI Zombie Video 小工具:如果变成丧尸,他还会记得你吗?
    大家好,最近做了一个面向海外用户的 AI 视频小工具,叫 AI Zombie Video ,想发到 V2EX 和大家交流一下。 它的玩法比较具体:上传照片,生成一段带有剧情反转的丧尸短视频。故事开头是末日场景,一个熟悉的人变成丧尸向你走来,你以为接下来会遭到攻击,结果他认出了你,最后给了你一个拥抱。 可以把它理解成一个围绕 Zombie Love Story (丧尸爱情故事)制作的 AI Zombie Video Generator 。 为什么做这个方向? 我觉得这个题材有意思的地方,是它能在很短的时间里完成一次情绪变化:从害怕,到认出彼此,再到拥抱。 AI Zombie Hug Trend 这种形式把恐怖场景和温情结尾放在一起,画面容易理解,也适合用自己、伴侣或宠物的照片去尝试。换一个主角,同样的故事就会有不同的感觉。 所以我做了一个流程比较集中的网站,希望用户从一张照片和一个故事想法出发,就能尝试制作自己的短片。 目前可以怎么玩? 网站采用 Photo to Video 的方式,上传参考照片,选择场景和时长,再提交生成。 目前提供了这些选项: 预设剧情:围绕“变成丧尸后依然记得你”fusheng0304
  • 16
    做了个 prlctl 风格的 VMware CLI
    先贴地址和安装...目前暂时只支持了 Homebrew 。手动安装可以自行编译或走 GitHub Release 。 开源地址: https://github.com/normal-coder/vmctl Homebrew 安装: brew install --cask normal-coder/tap/vmctl 为什么写这个 核心还是解决自己的使用问题(笑。 出于对环境纯粹的洁癖,一般各种新工具的尝试还是选择在干净的 OS 内去解决。 考虑到各种安全、隔离问题,有些环境不想/不适用用容器。于是常年在重装各种系统和各种初始化中来来去去,每次操作都相当耗费心神。 初始化系统的活儿交给 Agent 干,心里又不踏实😩。。 于是反复在各种老牌虚拟化方案和新晋虚拟机中来回捯饬。最终。。 对个人免费的 VMware 还是真香 😂😂😂 VMware 漫长的历史和博通的产品调性。让 VMware 比起 PD/OrbStack/Lima 一众产品,开发者友好程度不太够。 vmrun 的参数太反人类了——快照、克隆、往 guest 里拷个文件,每样都要记一长串路径参数,用完就忘;敲起來还费手 用惯了normalcoder
  • 17
    免费使用浏览器内置大模型来给自己的网页提供优化建议
    (可以使用 nano_v3_gpu_component 、gemma4_component 、gemma4_12b_component 、gemma4_4b_component 等) 原理是利用 Chrome 浏览器内置的 API prompt_api 等来免费使用大模型 这是效果图 现在介绍一下如何实现利用浏览器插件安装内置大模型来实现免费提网页建议 1. 安装插件,[插件正式版]( https://chromewebstore.google.com/detail/piokpdkhnfegkfpcmpjfndocaimepkgk?utm_source=v2ex_1005 ) 在审核中... 2. 可以先使用[Beta 版本]( https://github.com/task2money/taskChromePlugin/releases ) 来体验 3. 下载最新最新的 Release ,然后解压 zip 包,打开 [网页扩展程序安装页面]( chrome://extensions/ ) 打开`开发者模式`, 点击`打开未打包的扩展程序`, 选择刚才解压的目录,即可安装插件 4. [vnex
  • 18
    把自己放进加油站跳舞视频里:我做了一个 AI Gas Station Dance 小工具
    大家好,最近做了一个偏娱乐向的 AI 小工具,叫 AI Gas Station Dance ,现在已经上线,可以付费生成。 它的玩法很直接:把照片里的自己放进加油站跳舞视频,体验一把“这段视频的主角居然是我”。 这是一个围绕固定模板做的 AI Dance Video Generator 。不用写 Prompt ,也不用自己剪辑,上传照片、选择模式,生成完成后就能预览和下载 MP4 。 目前有两种玩法: Solo Mode:上传一张自己的照片,一个人出演跳舞、自拍和下车三个镜头。 Trio Mode:上传自己和两位朋友的照片,分别出演三个角色,做一段朋友之间的整活视频。 做这个项目时,我想把 Image to Video AI 变成一个更具体、也更容易上手的玩法。打开网站先看模板,觉得有意思,就把自己放进去,不需要先研究模型和参数。 生成的视频可以下载,用来发 TikTok 、Instagram Reels 、YouTube Shorts ,或者直接丢进朋友群里。采用一次性购买积分的方式,无需订阅。 项目主要面向英文用户,定位是一个专门做 Gas Station Dance AI Vidfusheng0304
  • 198
    做了个自动记录足迹的 iPhone App:小鹿足迹,发布了 100+ 版本
    小鹿足迹是我自己做的 iPhone App 。装上以后不用打卡,它会自己记下你每天去了哪、待了多久、路上怎么走的。 起因是有段时间工作很忙,到了年底回想这一年,每天去了哪、时间花在哪,几乎想不起来。手动记坚持不下来,就做了个自动记的。 过去 12 个月发了 100+ 个版本,应该很少比我更新更频繁的吧? 这是因为我和朋友们真的非常喜欢这个 App ! 下面是现在的几个主要功能。 自动时间轴 每天去过的地方、在每个地方待了多久、中间怎么过去的,自动排成一条时间轴,当天拍的照片也按时间插进去。 停留的地方记的是具体地名,不是一串坐标。你确认过、改过名字的地方,下次再去会优先认成它;离你停留的位置太远的候选不用,宁可显示「 XX 附近」让你自己挑,也不乱填一个。国内的地点认得比较准,欢迎拿常去的地方试试。 轨迹和足迹地图 走过的路线画在地图上,去过的城市都记着。 后台 GPS 的策略:移动时开着,记完整路线;在一个地方 85 米范围内待满 60 分钟,就自动关掉,同时在原地设一个 150 米的地理围栏,离开时系统把 App 叫醒,接着记。常驻 GPS 确实耗电,省电主要靠停着的时候不开它。不zhaokai112
  • 20
    [开源] ALTRun: 不到 1 MB 的 Windows 启动器, 操作方式参照 Alfred, 支持拼音首字母和 Everything
    大家好, 分享一个我自己每天在用的小工具: ALTRun, 一个 Windows 上的启动器 (类似 macOS 的 Alfred, 以及 Windows 上的 Listary, Wox、PowerToys Run、Raycast, ALTRun(Pascal)、RunZ)。 按 Alt+Space , 输入几个字母, 按 Enter : 打开程序、找文件、算数、搜网页、翻剪贴板历史, 都在一个窗口里完成。 为什么又做一个启动器 以前一直用老牌的 ALTRun (etworker 用 Pascal / Delphi 写的) 和 RunZ (AutoHotkey), 小巧顺手, 但我还想要拼音首字母、Everything 文件搜索、剪贴板历史、文字片段这些功能, 以及更现代的界面。也试过 Wox、PowerToys Run、Listary 等, 不是太大 (几十上百 MB, 常驻占内存), 就是中文支持一般, 或者和 Total Commander 配合不好。 所以用 AutoHotkey v2 重新写了一个: 名字沿用 ALTRun, 向原作致敬, 也借鉴了 RunZ 的设计; 操作方zhugecaomao
  • 21
    edgeTTS 适用于 STranslate 的语音合成插件
    前文: /t/1244818 现在,你可以在 [STranslate]( https://github.com/STranslate/STranslate ) 里面使用自托管的 [edgeTTS]( https://github.com/DejavuMoe/edgeTTS ) 语音合成 API https://github.com/DejavuMoe/STranslate.Plugin.Tts.edgeTTS https://imgur.com/a/z4QRo6EDejavuMoe
  • 2237
    [送码] 给 Navidrome 写的安卓播放器 Mu3ic:现代 UI、智能歌单、混音、断网也能听,基础版免费
    我的歌放在家里服务器上的 Navidrome 里,五千多首,标签都是自己整理的,上个月还让 Agent 批量标准化一遍。电脑上听没问题,手机上一直没找到用着顺手的客户端,于是便有了 Mu3ic 。 主页: https://mu3ic.xyz 直接下载 APK: https://dl.robb3n.site/mu3ic/Mu3ic-stable.apk GitHub 镜像: https://github.com/robb3n/mu3ic-releases/releases/latest 先说明一下:Mu3ic 是播放器,连的是你自己搭的服务器,不提供任何音乐。Navidrome 之外,兼容 Subsonic / OpenSubsonic 的服务端也能连。原生 Kotlin + Jetpack Compose ,安卓 7.0 以上,安装包 8 MB 左右。 为什么自己写 安卓上的 Subsonic 客户端其实不少,我前后装过好几个。 音流功能比较全,但界面不够现代,用起来不顺手。界面现代的是 Symfonium ,功能也全,可它同时要管本地文件、网盘、Plex 、Jellyfin ,对 Naslehx
  • 237
    做了个查 AI 用量的 App
    做了个 App 叫 usAge :连上账号,用了多少、什么时候重置、还剩多少钱,一屏看清;放个小组件在桌面,抬头就能看到。 支持哪些服务 Claude 、Codex 、Cursor 、智谱 GLM / Z.ai 、Kimi 、MiniMax 、Xiaomi MiMo 、Qoder 、OpenRouter 、DeepSeek (鸿蒙版的 Qoder 在下个版本)。 订阅制看已用比例和重置倒计时,按量付费看余额和花销 网页登录或者填 API Key 都能连 没有你在用的? App 里可以申请接入,直接回帖也行 主要功能 一屏看全部额度 :5 小时窗口、每周额度、Token 消耗、账号信息,点开就有 五种小组件 :基础、数码管、贡献图、LED 、卡包,小中大三种尺寸,一个最多放 4 个账号。小组件上能直接切换额度、刷新,Codex 有重置卡时也能在小组件上直接用掉 分享卡片 :Token 战绩、额度状态、AI 花销三种,可以拿来晒 多设备同步 :Apple 设备走 iCloud ,华为设备走云空间,手机上连一次,其他设备自动出现 Mac 版除了主窗口还有菜单栏,会读本机日志,显示今天 Codchenzhe
  • 243
    做了个开源的 plist 在线编辑器,不装 Xcode 也能打开二进制 plist
    各位 V 友好,分享一个自己做的小工具: OpenPlist ,可以直接在浏览器里查看、编辑和转换 Apple 的 plist 文件。 它想解决的需求很简单:有时候只是想看一眼配置、改几个字段,或者把二进制 plist 转成能读的 XML ,希望打开网页就能处理。在 Windows 、Linux 上也能用,不依赖 Mac 或 Xcode 。 在线使用: OpenPlist 源码: GitHub 目前主要支持: 查看和编辑 :打开 XML 、二进制( bplist00 )和 OpenStep 格式的 plist ,在树形视图里修改键、值和类型,也可以切到 XML / JSON 源码编辑。 格式转换 :XML 与二进制 plist 互转,以及 plist 和 JSON 互转。 日常操作 :搜索键和值、新增和复制条目、撤销重做、未保存提醒。 另外也做了一些 Apple 开发相关的小工具,比如查看 .mobileprovision 的有效期、团队和设备信息,编辑 .mobileconfig 、 .entitlements 、 .strings 、 .stringsdict 和 .xcconfipoppub
  • 254
    Tibo 的 28 天挑战追踪
    Tibo 今天的 X 上宣布:“在接下来的 28 天里,我们每天要么发布一个有明显改进且与大多数 Codex/工作用户相关的项目,要么进行一次完全重置。让改进开始吧。” 于是做了个页面追踪接下来 28 天,每天是改进还是重置: https://codex-resets.com/zh-CN/tibo-28wong2
  • 26
    最近趁着这波 Face Swap 的热度,趁热打铁做了两个小产品
    最近外网的 Face Swap AI 视频很火啊,刚好想测试一下我买的产品模板,这里就不打广告了,用的是 Cloudflare D1 和 Workers 的架构。 前几天看到一起做产品的几个群友,趁着这波热度上线了一些 Face Swap 产品,我看了下都是蹭音乐 MV 的热度,流量还不错的。所以我也想着试一下,看看用模板的情况下,多久能做出来一个 MVP 。于是我先后做了两个产品,分别是 https://raindanceaivideo.app/ 和 https://airapduo.net/ 结果发现,有模板的情况下,第一个产品用了 12 小时上线,基于第一个的经验,第二个产品只用了 4 小时就上线了。虽然都只是 MVP ,但是我认为在有模板的情况下,再迭代一下,是能够实现 3 小时以内做出来产品去蹭热度的。但是这毕竟不是正经的产品,制作的时候调模型提示词很累人,不是长久之计,所以我后续还是会回到以前那种打磨产品的方式。 目前两个产品还在迭代中,欢迎大家试用、拍砖!由于成本的问题,没法提供完整的免费预览视频,请大家多多包涵,有什么用得不顺手的地方,也欢迎大家提出意见,谢谢!zhengguge06
  • 271
    最近看到 Threshing Day 挺火,就用 AI 做了个小游戏
    这几天刷到 Threshing Day / Dragonkind 的次数有点多,感觉这个设定还挺有意思的。 本来只是想做点相关内容,后来觉得光写攻略有点无聊,就顺手用 AI 做了个能直接玩的小游戏: 地址: https://threshingdaygame.xyz/ 玩法很简单,就是连续选 8 次,最后看看会匹配到哪条龙。 现在一共放了 6 条龙,每条性格不太一样。玩完会出一张结果卡,也可以重新选,看看能不能把几条龙都刷出来。 后面做着做着又塞了点东西进去,比如排行榜、Dragon Wall 、Retry Timer ,还有一些游戏相关的资料。 不用登录,打开直接玩,完整走一遍大概几分钟。leeswal
  • 281
    献给所有还在人肉算裂缝刷新时间的打架人: AION 2 裂缝专属时间表
    相信很多老哥和我一样,国庆这几天沉迷《永恒之塔 2 》,最搞心态的几件事里,“算时空裂缝时间”绝对排得上前三: 时区换算搞到头秃:打国际服或者亚服/韩服,游戏内时间和本地时间永远差几个小时。每次公会问“下波裂缝几点开”,要么切出游戏算半天,要么看错夏令时直接扑个空。 到了地方只剩尾气:每次等系统通告弹出来再摇人传送,飞到地图点位时,对面大部队早就集结完毕,或者裂缝人数限制直接挤满,连汤都喝不上。 各种群文件/Excel 表格太麻烦:手机里存了一堆排班截图,比我工作值班还认真,每次查都要翻半天相册;群里的 bot 偶尔还会漏报或抽风。 为了不让自己和队友天天抓瞎,我顺手搭了一个轻量化的纯网页工具站: 🌐 在线工具: aion 2 rift timer 🛠️ 做了哪些针对性功能? 精准实时倒计时:不再需要去查“还有几小时”,打开页面第一眼就是距离下一场裂缝开启的毫秒级倒计时,直接挂在副屏或手机支架上即可。 自动识别本地时区:不管你在哪个地区玩哪个区服,系统自动将服务器刷新节点映射为你的当前电脑/手机时间,告别脑内时差换算。 多服务器快速切换:支持不同大区/服务器的独立循环时间表,切服即切,KIC
  • 292
    [开源] 做了个能让 AI 替你玩的三国 SLG 网页游戏, Claude / GPT / ZCODE / WorkBuddy 等无缝接入
    玩 SLG 最累的是要一直在线:半夜收资源、掐点出兵、提防被偷袭。所以我做了一款反过来的: 游戏本身就是给 AI 玩的 。 你可以自己上手建城、征兵、攻城,也可以在游戏里点一下「复制给 AI 」,把协议文档和你的专属令牌贴给 Claude 、ChatGPT ,或者你自己写的脚本,让它 7×24 小时替你运营。它会上报自己的计划,给战报写点评,你离线时还会写一份日报。 能玩什么 15 种建筑,11 个兵种,兵种之间互相克制;战斗分多回合,按射程和速度推进,每场都有战报 世界地图:占野地、抢金矿、攻 NPC 城,8 座名城首占可得名将,还能截击商队、设伏 武将、科技、全服「黄巾之乱」事件 玩家对抗有硬规则保护(新手保护、免战、大号打小号收益递减),不用熬夜守城 几个设计取舍 服务端不跑任何 AI ,智能全由玩家自己带;网页和 Agent 走同一套协议、同一套校验,没有给 AI 开的后门 Agent 只能用令牌登录,拿不到账号密码,令牌可以一键重置 协议文档由代码自动生成,协议更新后 Agent 登录时会收到提示 技术栈:Node + Fastify + 标准 WebSocket + Posxltc20
  • 30
    AI 参照网-给 AI 做网站的审美参照与收集万星 Skill
    网站与 AI 辅助开发心得 一、 网站审美与 AI 参照 在做网站过程中,我发现 AI 第一版做出来的网站,功能都还能慢慢调整,但网站的 审美是怎么调也难调整 。不如直接找一个好看的网站,让 AI 直接参照。 在解决了自己做网站审美的问题后,我将审美参照做成了一个网站,里面收录了万星的 Skill 以及五个好看的网站(前两个是聚合类网站,后三个是自己觉得好看的网站)。 AI 参照网 : https://helpai.okfew.com/ 二、 AI 做项目现阶段心得 1. 复杂项目务必先用(grill-me) 最近在做量化程序,让 AI 根据我的策略思路来写程序和回测: 第一版 :越改越差,容易陷入局部细节的死循环。 第二版 :使用了 grill-me ,总算大框架没有多大问题了。 经验总结 :做大一点的项目是真的要先用 grill-me 把需求和架构刨根问底式地问透,这是忙活了一周才换来的血泪经验。 2. 工具与模型搭配组合策略 本来想开通 Claude 会员,但网上一直反馈封号较严重,就打消了念头,现阶段用 谷歌反重力 也完全够用了。 执行层 :使用反重力进行代码主力编写与执行。shonky
  • 312
    分享一个自己做的 ChatGPT 图片批量下载 Chrome 扩展
    最近用 ChatGPT 生成图片比较多,每次一组图都要一张一张下载,感觉有点麻烦,所以顺手做了一个 Chrome 扩展。 主要功能比较简单: 可以一次勾选当前这一组 ChatGPT 生成的图片并批量下载 支持生成结果页和全屏图片查看器 可以预览、取消选择、失败重试 下载的是网页提供的原始图片,不做压缩和转换 图片只在浏览器本地处理,不会上传到其他服务器 GitHub: https://github.com/xin0907/gpt-image-batch-downloader Chrome Web Store 版本已经提交审核,目前可以从 GitHub Release 下载后手动安装。 第一次做这种小工具,如果大家使用过程中遇到问题或者有什么建议,欢迎提 Issue 。xinniun
  • 32
    因为最近 Hotel lobby 很火,创建了一个视频生成网站
    最近 Hotel Lobby 这类双人 AI 视频挺火,我也跟着做了一个小站 EasyVideoAI 。 https://easyvideoai.com 玩法很简单。上传两张单人照片,网站会把原视频里的两个人换成指定角色,尽量保留原片的动作和镜头,生成后再把原声合回去。 目前支持 5 、12 和 30 秒,可以选 480p 或 720p ,也能输出横屏、方形和竖屏视频。AI 生成的脸和口型偶尔还是会飘,这部分我还在继续调。 网站目前是英文版,第一版刚做完,很多地方可能还比较粗糙。发到 V2EX 想听听大家的真实意见,尤其是首页能不能让人一眼看懂,上传和生成流程用起来顺不顺。 欢迎拍砖,有问题我继续改。herojerry
  • 336
    问题我理解,讲给 AI 却要写八百字,怎么办?
    不知道大家用 AI 工具的时候,有没有遇到过类似的问题。 软件里某个设置找了半天,想让它帮忙看。菜单在哪、勾了什么,用语言讲清楚要写很长。 手头的活卡在屏幕上。对话里没有这层上下文,你得把现场再讲一遍,又慢又容易漏。 问题已经摆在眼前了,但说不清楚。你越补充,它越容易理解偏。 关键的内容在屏幕上,不在 AI 聊天里。有些场合靠语言补,特别费劲。 Lulu Clip 就是为这个做的。当前对话里打 /lulu-clip ,按 ⌘E ,拖一块区域。PNG 进这轮对话,它直接看图。截完热键松开。 仓库: https://github.com/lulufoo/lulu-clip 喜欢就试一试吧。namdamlmm
  • 341
    做了个照片 Headless CMS:照片在这管,网站让 AI 写
    业余时间折腾了个小东西,叫 Vivid Photos : https://vivid.photos 一句话描述: 照片在 Vivid 里管,网站让你的 AI 写。 用专业一点的术语讲,就是给照片用的 Headless CMS 。 为啥做这个 现在让 ChatGPT / Claude Code 一下午糊出个摄影作品集网站已经不难了,但照片这部分一直挺别扭: 几百张原图往仓库里塞?每张还得切几档尺寸、转 AVIF / WebP 、做加载占位图。AI 能写,但每个站都要写一遍,每次写得还不太一样 挑图、排序、写说明,这些活得盯着图看。打字跟 AI 说"把第三张富士山挪到最前面",属实难受 如果是给其他人做的站,人家想换张图、改个说明,还得回来找你 一不小心,EXIF 里的 GPS 就跟着原图挂到网上了 所以干脆拆成两半:照片让人类自己管,代码让 AI 写,之间用 API 网络请求连起来。其实就是沿用 CMS 的思路。 怎么用 在 Vivid 里上传照片、建相册、排好序、写描述 点 Publish 去 Connect 页复制一段提示词,贴给你用的 AI ( ChatGPT 、Claude Coheoizokdung
  • 35
    有个短域名不知道做啥,搭了短链和邮箱,可以当个备用邮箱
    主站域名: https://tftt.cc 邮箱站点: https://mail.tftt.cc/saltbo
  • 361
    做了个给文章自动配手绘图的小工具,整篇文章都是同一个角色
    大家好,独立开发,平时写公众号和博客。 一直有个痛点:文章写完还要配图,图库的图风格不统一,直接用 AI 生图又是一张一个画风,同一篇文章里扁平、3D 、写实轮番上阵,看着很割裂。最费时间的其实不是生成,而是想“这段该画什么、放哪”。 所以花了些时间做了这个: InkDoo https://inkdoo.app (中文界面 https://inkdoo.app/zh ) 它做的事情很简单: 贴一篇文章进去(中英文,约 12000 字以内),也可以直接贴公众号/博客链接或上传 .md/.docx 先用一个 LLM 当“美术指导”:挑出值得画的几个观点(不是每段都配),给每个观点选结构(流程/前后对比/隐喻等),想一个低科技的物理隐喻,再标出插在哪段后面 你可以改画面描述,然后用 GPT Image 2.5 出图,风格固定为白底黑线手绘 + 少量红橙蓝手写批注,图片自动托管,复制 Markdown 就能用 有一条我比较坚持的规则: 角色必须在干活 (摇筛子、搬箱子、拉拉杆),去掉角色画面还成立的图,规划器会重写。 角色现在有 6 个可选:阿嘟(独眼蛋)、墨墨(墨水滴)、铅头儿(铅笔头)、糯boisy
  • 379
    针对 icp 备案查询的 Chrome 扩展,有需求吗
    各位大佬好 现在 vibe coding 日盛,不同的小众需求也能得到满足。 之前有大佬制作了 icp query extension ,貌似近期已经不维护了。 于是我根据阿里云的收费 API ,自己制作了相同功能的 Chrome 扩展,他长这样。 企业名称旁边有小箭头,展开是这样的: 后台设置可以勾选显示信息与 API 厂家 这是我自己在用的版本,不知道此小众需求有没有市场呢? 我其实想做成收费版本,计划价格是每次查询 1 毛钱左右,各位大佬提提意见,多谢多谢liliang13
  • 38
    一键本地安装 jev 决策模型开源版 laya
    一键本地安装 jev 决策模型开源版 laya 项目地址: https://github.com/uu889/laya-workbenchuu889com
  • 3911
    让 AI 控制你的手机 -- ioscli
    让 AI 控制你的 iPhone: https://github.com/liuslevis/iosclidavidlau
  • 401
    全功能文件管理器 Zexor :从“找文件”到“用文件”,重新思考 Windows 文件管理器
    Zexor 官网下载: zex.leoog.com 用了这么多年的 Windows 文件管理器,你可能很少认真想过一个问题: 文件管理器,究竟应该只是“找文件”的工具,还是应该成为整个文件工作流的中心? 传统文件管理器的核心逻辑其实一直没有太大变化: 找到文件 → 打开文件 → 进行基础操作。 复制、移动、删除、重命名,这些当然都没问题。 但一旦进入真实的日常使用场景,很快就会发现, 真正和文件有关的工作,远远不止这些。 于是我们不得不不断切换软件: 用 Everything 搜索文件; 用 IDM 、qBittorrent 下载资源; 用 7-Zip 、WinRAR 压缩和解压; 用 FastCopy 复制和迁移大量文件; 用 Eagle 管理图片和素材; 用 PotPlayer 播放视频和音频; 用各种图片、视频、3D 工具查看和处理素材; 用各种磁盘工具分析空间、查找重复文件、维护硬盘…… 这些软件解决的问题都很专业,但它们有一个共同点: 它们最终处理的,其实都是同一个东西——文件。 文件明明没有变,却要在一个又一个独立的软件之间不断流转: 搜索工具 → 下载工具 → 解压工具kiii
  • 414
    做了个 Claude Code 多账号路由工具:撞上限自动切账号
    我自用好几个 Claude 订阅、API key 和中转站,Claude Code 一撞 5 小时限额, Fable 周限额就得手动改配置,很烦。所以做了 Kivo: 所有账号(订阅、API key 、中转)收进一个本地 endpoint 撞上限自动切到下一个,也可以负载均衡或固定用一个 每个账号的 5 小时 / 每周窗口、重置时间、token 和花费一眼看清 一键接入 Claude Code 、Claude Desktop 、T3 Code ,不用改配置文件 key 存在本机 下载: https://kivo.boringboring.designSTRRL
  • 422
    [问书] 自主学习网站
    简介:将任意电子书蒸馏知识为 skills ,然后对话提问学习,自行配置模型信息,可导出导入蒸馏后的 skills ,有本地书架功能 寻找免费电子书地址: https://z-library.biz/ 项目地址: https://github.com/ns2250225/ask-book 项目预览图:mqx
  • 431
    [开源] Precedent Loop:让 Agnet 换个会话也记得项目里踩过的坑
    用 Codex 和 Claude Code 写代码久了,最头疼的是它不记事。上周跟它一起查了一下午,根因找到了,方案也定了。这周开个新会话,它又从头猜一遍,有时还会把当初否掉的方案再提出来。 我试过两种办法,都不太顺手。 一种是写进 AGENTS.md / CLAUDE.md 。放"必须遵守的规则"没问题。但"这个接口为什么要做幂等""那个报错其实是连接池配置引起的"这类经验,一条条加进去,文件很快就几百行。每次会话都全量塞给模型,真正相关的那几句反而被淹没了。 另一种是用客户端自带的记忆。记什么由模型自己决定,我看不全,也不知道哪条在哪次起了作用,记错了也很难发现。 所以我做了 Precedent Loop ,思路很简单:经验让 Agent 来提,入不入库我说了算,用的时候按需去取。 实际用起来是这样一个循环: 方案定下来,或者根因查清楚的时候,Agent 会整理一条"候选",写明背景、结论和适用范围。 候选出现在桌面 App 里。我可以改,可以让 AI 重写,也可以直接拒掉。点了确认才会入库,入库的就是我看到的那一版。 之后的会话里,Agent 碰到相关任务会自己去查。一次最多拿sanwanzzz
  • 445
    测了 1000 个中文大站的 llms.txt,只有 30 个放了真正的文件
    前几天闲着没事,把 1000 个中文大站挨个抓了遍 /llms.txt ,想看看这帮大厂的 AI 准备工作做得咋样,结果挺有意思的。 1000 个站,真正放了 llms.txt 的,只有 30 个。3%。 剩下的是啥呢? 164 个返回 200 ,打开一看是网页壳——这个最坑,状态码看着没问题,AI 抓到的却是个壳,等于白给。412 个直接 404 。还有 390 个压根抓不到,WAF 拦的拦、超时的超时,这部分不算没有啊,别误会。 满分的有 9 个,B 站、Gitee 、魔搭、SHEIN 、TAPTap 、环球网这几个,确实做得认真。 说几个有意思的:百度,404 ,啥也没有。淘宝京东拼多多,返回 200 ,打开全是 HTML 壳。抖音,404 。字节的 Coze 倒是做了,但 50 分,74 个警告,链接重复一堆——做了跟做好是两码事。阿里系里面,唯一满分的是魔搭社区。 顺带还测了 100 个独立站,好一些,19% 有文件。不过博客圈只有 7%。毛病都差不多:链接光秃秃一个地址没描述,或者缺一句摘要,都是花半小时就能修好的小事。 测的时候顺手做了个小工具站 cetxt.com ,输belovedfreak
  • 4510
    看 YouTube 总要反复开关字幕?我做了个字幕插件,送大家一年 Pro 权益
    V 友们好啊,我最近做了一个专门用于 YouTube 的 Chrome 字幕管理插件 subtitle.im ,解决看视频时反复开关字幕的麻烦。 这次给 V 友准备了 200 个免费领取一年 Pro 的名额 ,活动开放一个月。也想请大家多用用,分享下真实使用体验,帮我们把插件打磨好。领取入口放在文末。 YouTube 字幕,该开就开,该关就关。 有些视频已经把字幕压在画面里,再打开 YouTube 字幕,就会出现两层字幕。另一些视频的画面字幕和 YouTube 字幕语言不同,两层都有用,又不一定想关掉。 subtitle.im 会在本机识别画面中的硬字幕,再按你的偏好处理可开关的软字幕。 1. 重复字幕,自动关闭 识别到重复字幕后,自动关闭多余的 YouTube 软字幕,保留画面中的硬字幕;需要时,也可以随时恢复软字幕。 对于有可用软字幕的视频,还可以自动开启字幕,减少每次打开视频后手动切换的操作。 2. 字幕语言不同,由你决定 比如画面里有日语字幕,同时打开了英语软字幕。你可以选择保留、先询问,或按设置自动关闭,让字幕处理符合自己的观看习惯。 3. 你的字幕,你的规则 直接在 Youzenoven
  • 4622
    [送码] macOS 的活动记录和回顾软件「日影」
    功能介绍 我是一个喜欢记录的人,通过记录,我可以减少生活里的虚无感,让自己多一点活过的实感。 出于自己的记录需求,我首先去网络上找了这方面的软件,但是 ActivityWatch、Qbserve 不怎么好看,Timing 太贵而且感觉比较复杂……于是起了自己做 macOS 上的时间记录 app「日影」的念头。 「日影」的基本功能是活动记录,我做了以日和月为单位的统计页面,可以看到自己用 Mac 的时间里都在做什么。 还可以看到 app 之间的关系: 除了统计,还做了一些别的功能,比如和系统日历的集成,日影可以自动把项目活动写入系统日历,这样的话就可以在日历里回顾自己的一天了。我喜欢把日历作为一个回顾用的软件。 基于对活动的记录,日影还有基于活动的提醒功能,比如站立提醒(使用很久电脑后提醒站立)、专注提醒(持续专注后提醒休息)等等。 隐私 记录是在本地进行的,不会上传任何记录数据(除非主动开启备份)。更详细的可以看官网的隐私政策说明。 官网链接和软件下载 https://hikage.app/zh-CN/ 送码 留下你的邮箱,我会为前 10 位发送邮件,用邮件里的激活码可以永久解锁日影的anojian
  • 471
  • 482
    [开源] 小伴:像给豆包打电话一样,打开浏览器就能和 AI 语音聊天
    做了个叫「小伴」的 AI 语音伙伴,交互是像给豆包打电话一样:点一下「开始通话」,直接开口说,它会用声音回答,你可以继续聊,也可以在它说到一半时打断。 现在 MIT 开源了,可以用自己的 API Key 在本机跑,也可以拿去改成自己的语音搭子。 源码: https://github.com/Peiiii/xiaoban 在线体验: https://xiaoban-voice.gemigo.app (需要登录,有用量限制;自己在本地跑不需要 GemiGo 账号) 通话时不用一直按住录音键,也不用一句一句点发送。想闲聊就闲聊,想梳理事情就说出来;切到英语模式,也能和它练口语。可以关麦、静音,换音色和语速;聊完点「结束通话」。 桌面和手机版式都做了,聊天记录保存在当前浏览器,可以导出或清空。 声音目前有两种模式:默认等一段回复的音频收齐再连续播放,网络到包不均匀时更容易完整听完,代价是开口前多等一会儿;也可以切成边收边播,先听到回答。网络太差时仍可能等待或断续,扬声器回声也受设备影响,建议先戴耳机试。 自己跑需要 Node.js 22+ 和已开通实时模型的百炼 Key: git clonePeiiii
  • 49
    开源 Bibo:成本极低,内置笔记、文件、任务和日历的 personal agent
    我把 Bibo 开源了,MIT 协议。先说最想做好的三件事: 成本极低。 日常使用不需要常驻电脑,也不用一直开着 Linux 容器。只有需要运行代码时,才启动沙箱。 内置个人管理工具。 笔记、文件、任务和日历都有专门的界面。你可以直接查看、编辑和管理,也可以让 AI 来做。 开源,可以自己部署。 用自己的 Cloudflare 账号和模型 API Key ,数据存在自己的部署里,代码也可以自己改。 GitHub: Peiiii/bibo 在线体验: app.bibo.bot 我希望它能成为每天都用得上的 personal agent 。想到什么可以随手记,需要做的事可以放进任务和日历,资料可以整理成文件;这些内容长期留着,之后还能接着用。 下面把界面都放出来。截图来自实际运行的 Bibo ,销售、订单和日程内容都是示例数据。 概览 打开就能看到笔记、任务、日程和待处理信息。 对话 让 Bibo 阅读销售数据、总结重点,也可以让它继续整理报告和安排后续工作。 笔记 笔记是可以直接编辑的 Markdown 文档。你自己写,或者让 Bibo 帮你整理,都能继续修改。 文件 有独立的文件目录,Peiiii
  • 50
    Aesthetic Bio Maker - 免费审美风 IG 简介生成器
    项目概述 Aesthetic Bio Maker 是一个免费的在线工具,用来生成适合 Instagram 、TikTok 、Discord 和 Linktree 的审美风简介( bio )。不需要注册,打开就能用。 在线地址: https://aestheticbios.com 目标用户: Instagram / TikTok 年轻人、内容创作者、想快速做出好看主页简介的人 核心功能 1. 五种风格 grunge / y2k / minimalist / vintage / classic aesthetic —— 每种风格都有独立页面、专属模板和生成器 2. 一键复制 输入名字和兴趣,自动组合模板生成成品简介,点一下复制就能粘贴到主页 3. 平台字符数自适应 自动按平台限制调整长度( Instagram 150 、TikTok 80 、Discord 200 ),粘贴不会截断 4. 免费字符计数器 附带一个检查任意文本是否符合 Instagram 150 字符限制的小工具 技术栈 TanStack Start + Cloudflare Workers + D1 数据库,纯前端生成无Gijela