 rui40000andClaude Opus 4.8
|
28fd14aaad
|
feat: 新增八方向序列拆分节点(8方向行走动画管线)
把每帧排布着 8 个朝向的雪碧图序列,一次拆成 8 条独立动画序列,
完成方向编号与分组。整条管线只有这一环缺失,其余复用现成实现:
视频转帧用 VHS 的 force_rate,透明 webm 用 VHS 的
format=video/webm + pix_fmt=yuva420p,序列帧用 SaveImage
(4 通道输入 PIL 会自动存成 RGBA)。
三个关键设计:
- 用固定网格而非连通区域拆分:连通区域按包围盒排序,角色走动时
位置浮动,跨过排序行界方向就错乱,上百帧错一帧整条动画就废;
且各自 bbox 裁剪导致尺寸不一无法合成视频
- 白底转透明用边缘连通性判断:角色常穿白衣服,按亮度一刀切会把
白衬衫掏空,故只把与画面边缘相连的白色判为背景
- 裁剪框取全序列并集:逐帧各自裁剪会尺寸不一且角色帧间跳动
另加碎片清理(按连通块面积比):网格切分会把相邻格探进来的手杖尖
切入本格,既难看又撑大裁剪范围。实测 E 方向 172x370 -> 150x335,
跨帧重心极差 8.0 -> 0.5 px。
实测 97 帧 834x1112 素材:拆分约 4 秒,导出 webm 回读透明像素占比
0.635 与素材一致。注意验证 webm 透明需显式 -c:v libvpx-vp9 解码,
内置 vp9 解码器不处理 alpha 边带,否则会误判为透明丢失。
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-07-29 18:48:50 +08:00 |
|
 rui40000andClaude Opus 4.8
|
b517c5714b
|
feat: 新增像素化节点(面向像素游戏资产,含 AI 伪像素图网格还原)
产出真实小分辨率、颜色数受控、边缘硬朗的 sprite,而非马赛克滤镜。
纯 numpy/PIL 自研实现,无额外依赖、无需模型权重。
三种模式:按目标宽度 / 按像素块大小 / 自动检测网格。第三种专治
AI 生成的伪像素图(看着像素风,实际网格歪斜、边缘抗锯齿、上千颜色)。
选型说明:Pixel Snapper(MIT)解决的是「伪像素图 → 完美像素图」,
而「普通图 → 像素画」是另一个问题,核心在降采样与调色板量化,
故两条路都做进同一节点。
网格检测处理了两类经典误判:
- 谐波(八度)错误:取得最高分后回查真约数(octave killer)
- 内容周期冒充像素周期:把最佳/最差相位的分差并入评分(anti-phase)
评分用单元内方差而非相邻差分——差分对模糊极敏感,实测会把 4 像素
网格判成 24~28;组内方差则天然压制过大的 s。
实测:干净放大图 k=2~16 共 27/27 全对零八度错误;非方形网格与相位
偏移全对;普通插画正确判为未检出;端到端把 32×32 放大 10 倍加模糊
噪点的图还原回 32×32,与真值 MAE 0.0049;整数倍放大为纯复制无插值。
调色板在 CIELAB 空间聚类(RGB 距离与人眼感受相差很远,会丢暗部层次),
降采样默认主导色(均值会造出新颜色并糊边),内置 PICO-8/Game Boy 等
可确认取值的复古调色板。
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-07-29 18:23:43 +08:00 |
|
 rui40000andClaude Opus 4.8
|
d47fd27062
|
feat: 新增 Lucida 抠图节点(BiRefNet_HR 微调,擅长文字/Logo/插画/玻璃)
模型 https://huggingface.co/egeorcun/lucida (MIT),220M 参数、885MB。
作者基准:文字/Logo 0.0091(商业参考 0.0123)、插画 0.0092、
伪装 0.0270、总体 0.0257。
- 模型代码(2250 行)内嵌 lucida/ 子包,不用 trust_remote_code:
那会在运行时拉取并执行远程代码,ComfyUI 场景既不该联网也不该如此;
构造传 bb_pretrained=False,避免联网拉 Swin 预训练权重
- 预处理规格与 BiRefNet 系一致,复用 FeyNobg 那份已验证实现;
输出适配 list 格式(eval 下 forward 返回各尺度预测,取 [-1])
- 权重加载严格校验,除窗口尺寸推出的确定性 buffer 外失配即中止
- 不开放分辨率选项:模型 Config.size=1024 且 decoder 走 patch split
示例工作流把 Lucida 与 FeyNobg 并联便于同图对照。实测两者差异
不是精度高低而是「前景」定义不同:同一张动漫插画上 FeyNobg 只抠人物
(前景占比 0.098),Lucida 还把半透明的云判为前景(0.391),
与其训练透明材质的目标一致,两者互补。
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-07-29 11:08:35 +08:00 |
|
 rui40000andClaude Opus 4.8
|
be93fd36a3
|
feat: FeyNobg 抠图开放半透明控制与长图形变补救参数
针对「主体整片半透明发灰」的实际反馈,模型侧无可调参数
(架构参数训练时已固化),故在后处理层开放:
- alpha_threshold / alpha_softness:以阈值为中心、柔和度为宽度
取一段区间线性拉伸到 [0,1],压掉灰雾同时保留边缘过渡。
默认 (0.5, 1.0) 区间恰为 [0,1],是恒等变换,行为与之前逐位一致;
实测 (0.35, 0.3) 半透明像素占比 1.49% -> 0.31%,主体均值几乎不变
- keep_aspect_ratio:模型固定吃 1024 方图,长图默认被拉伸压扁。
开启后改为等比缩放 + 边缘延展补边(不填黑,避免造出假轮廓),
推理后按有效区域裁掉补边
同步更新示例工作流的 widgets_values(widget 由 5 个增至 8 个,
不同步会导致参数错位)与 Note 说明。
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-07-29 10:10:10 +08:00 |
|
 rui40000andClaude Opus 4.8
|
01a26baea9
|
feat: 为水印与 FeyNobg 抠图节点补充示例工作流
example_workflow/FeyNobg抠图.json:
- 加载图像 → 抠图 → alpha 预览 / cutout 预览 / 透明 RGBA 保存
- 含 InvertMask 环节:JoinImageWithAlpha 内部会做 1-alpha,
不先反相会得到前景透明的反效果
example_workflow/满屏文字水印.json:
- 同一张图并联两组参数(常规白色半透明 vs 高密度黄色宽字距)便于对比
- Note 说明八个参数的调法,含密度与字号联动的换算关系
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-07-29 09:48:03 +08:00 |
|
 rui40000andClaude Opus 4.8
|
1bd90c71b6
|
feat: 新增满屏文字水印与 FeyNobg 抠图两个节点
满屏文字水印(watermark_node.py):
- 文案/字体/字号/旋转角度/密度/字间距/透明度/颜色 八项可调
- 交错网格平铺后整体旋转再从中心裁切,任意角度下四角均无空白
FeyNobg 抠图(feynobg_node.py + feynobg/):
- 内嵌 nobg 推理子集(Apache-2.0),全自动去背景,输出 alpha 与去背景图
- 重写预处理去掉对 transformers>=5.4 的依赖,4.x 环境可直接使用
- 修复权重键名与 transformers 4.x 的 SwinBackbone 命名不兼容:
不处理时 958 个参数仅 405 个对得上,backbone 形同随机初始化,
模型不报错但 alpha 几乎全黑;现按环境自动重映射并严格校验,
除确定性 buffer 外任何失配都直接中止
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-07-29 09:26:05 +08:00 |
|
 rui40000andClaude Fable 5
|
9dd4fbd890
|
fix: ZenMux 节点自适应参数重试,兼容弃用 temperature 等模型
用户实测 anthropic/claude-sonnet-5 报 400:`temperature` is deprecated。
根因:节点无条件把 temperature/top_p/seed/max_tokens 塞进请求体,而 ZenMux
聚合的部分模型弃用/不支持这些采样参数,规则各家不一且随模型迭代变化。
- 新增 _diagnose_param:从 400 错误消息识别是哪个采样参数导致失败
- 请求改为重试循环:命中即剔除该参数(或把 max_tokens 改名为
max_completion_tokens,适配 gpt-5 reasoning 系)后重试
- 只动可选采样参数,绝不触碰 model/messages;非参数类 400 不重试、不死循环
- 正常请求零额外开销;剔除动作打印到控制台,最终仍失败时提示已剔除项
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
|
2026-07-24 14:30:57 +08:00 |
|
 rui40000andClaude Fable 5
|
eff089c771
|
feat: 新增多行文本框(原样输出)节点,修复 Markdown 标题被上游节点吞掉的问题
用户实测发现标题行缺失,根因并非渲染:WAS Node Suite 的「Text Multiline」
会把 "#" 开头的行当注释删除(WAS_Node_Suite.py text_multiline),Markdown
的 #/## 标题在进入本套件节点前就已被丢弃。
- 新增 RuiTextBox 节点:多行文本一字不动透传,关闭 dynamicPrompts,
专门配合 Markdown转图片 使用
- README 在 Markdown 节点文档加警示,说明勿用 WAS Text Multiline 喂 Markdown
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
|
2026-07-24 13:54:08 +08:00 |
|
 rui40000andClaude Fable 5
|
d419f9262c
|
feat: 新增 Markdown 转图片节点(阅读器级排版渲染)
- 纯 PIL 自研排版引擎(mdimg/ 子包:解析器+字体管理+渲染器),零新增依赖
- 视觉对标 GitHub/Typora:标题层级字号与 h1/h2 底线、引用左竖条、
代码块圆角底色+等宽字体+语言标签、表格圆角外框/表头底色/斑马纹/
列对齐/超宽自动压缩换行、任务清单勾选框、列表三级项目符号
- 彩色 Emoji(系统 seguiemj,正文与表格内均可);代码中的中文自动回退正文字体
- 尺寸:9 种常用预设快选 + custom 精确宽高;浅色/深色/米色三主题
- 各级字号(正文+H1~H6)、字间距、行间距、单行字数上限均支持 auto/手动,
auto 字号二分搜索恰好优雅填满画布,超高裁剪并控制台提示
- 字体下拉扫描 font/ 目录,粗体真字重自动配对(msyh->msyhbd),
空目录回退系统字体;字体二进制因版权与体积不入库(见 font/README.md)
- 修复解析器对单列表格的死循环,14 例边角输入鲁棒性测试通过
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
|
2026-07-24 13:03:46 +08:00 |
|
 rui40000andClaude Fable 5
|
e09930ea45
|
feat: usage_stats 增加输出文字数量统计
统计模型返回文本的字符数(含标点),插入为第二行:
token消耗,输入:XXX,输出:XXX
输出文字数量:XXX
模型类型:...
价格换算,美元:XXX,人民币:XXX
请求失败或无正文时记 0。
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
|
2026-07-24 12:06:32 +08:00 |
|
 rui40000andClaude Fable 5
|
0a87ba7813
|
feat: ZenMux 节点新增 usage_stats 输出,统计单次运行 token 消耗与费用
- 第三输出 usage_stats(STRING),三行格式:
token消耗,输入:XXX,输出:XXX
模型类型:openai/gpt-5.4-nano [入$0.2/M 出$1.25/M]
价格换算,美元:XXX,人民币:XXX
- 费用 = 响应 usage 的 token 数 × 快照单价(USD/百万token)
- 新增可选参数 usd_to_cny(默认 7.2)供人民币换算,可按当日牌价调整
- 请求失败记 0 消耗;usage 缺失或单价未知的项显示 "?"
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
|
2026-07-24 10:23:07 +08:00 |
|
 rui40000andClaude Fable 5
|
cc5852dc18
|
refactor: ZenMux 节点移除 vendor 参数,模型下拉直接全量选择
- 模型列表本身按厂商排序聚类,配合 ComfyUI 下拉搜索(输入 "qwen/" 等
前缀过滤)已能满足筛选需求,vendor 下拉冗余
- 一并移除只为级联服务的前端脚本 web/zenmux_cascade.js 与 WEB_DIRECTORY
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
|
2026-07-21 13:33:42 +08:00 |
|
 rui40000andClaude Fable 5
|
c8c546a873
|
fix: ZenMux 节点导入加保护,异常时不连累其余节点加载
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
|
2026-07-21 12:22:29 +08:00 |
|
 rui40000andClaude Fable 5
|
ca61c48dbd
|
feat: 新增 ZenMux API 连接节点(厂商→模型级联选择,选项含价格标注)
- 一个节点调用 ZenMux 聚合平台全部文本类模型(20 厂商 / 138 模型)
- vendor→model 二级下拉:前端 web/zenmux_cascade.js 按厂商实时收窄模型列表
- 模型选项后缀标注输入/输出价格(USD/百万token),如 [入$0.2/M 出$1.25/M]
- 默认模型 openai/gpt-5.4-nano;具备 api_key/system/user prompt/seed/
temperature/top_p/max_tokens/多模态图像×6/detail/base_url/proxy 等完整参数
- 模型清单随包分发(models_snapshot.json),离线可列出;
build_snapshot.py 可随时重拉最新价格
- VALIDATE_INPUTS 宽松校验:价格快照更新后旧工作流的模型标签仍可解析执行
- base_url 默认值沿用仓库约定不含 "://",规避 ComfyUI 前端吞协议片段的老问题
- 导出 WEB_DIRECTORY 以装载前端级联脚本
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
|
2026-07-21 11:37:00 +08:00 |
|
rui40000
|
a826b42576
|
feat: 增加 SDMatte 示例工作流
包含 BiRefNet 出粗遮罩 -> SDMatte 精细化 -> 合成透明背景 RGBA 的完整链路,
并附 Note 节点说明易踩的坑:
- is_transparent:抠玻璃/水/纱/烟雾必须打开。实测关闭时 84.8% 的像素落在
半灰区间(背景浮灰雾),打开后降到 27.7%
- image 直接接 LoadImage 原图,而非 BiRefNet 的 image 输出(后者为 RGBA,
虽经通道收敛后等价,但直连原图的数据流更清晰)
- InvertMask 不可省:JoinImageWithAlpha 内部会做 alpha = 1 - alpha
- BiRefNet 的 process_detail 保持关闭:SDMatte 只取其外接框,细化是浪费
|
2026-07-16 12:01:16 +08:00 |
|
rui40000
|
aebbe87c16
|
docs: 标注 caption 与 point_mask 的权重差异,并加运行时警告
实测发现 SDMatte 与 SDMatte*(plus) 两个权重能力不同,根源是官方 README
所载的训练集差异:前者含 RefMatte(指代表达式抠图,点/文本提示的来源),
后者用 COCO-Matte 替换了它。
实测(官方效果图羊驼,MAD 越低越好):
- point_mask:SDMatte 正常(0.0135);SDMatte_plus 输出全黑(max 仅 0.079)
- caption :SDMatte 上语义有效,'alpaca' 0.01072 优于留空 0.01120、'tree' 0.01111;
SDMatte_plus 上语义失效甚至反向,'alpaca' 0.01160 反差于 'tree' 0.01119,
即仅为 cross-attention 的噪声扰动
据此:
- 补全 caption / point_radius / prompt_type 的 tooltip,写明各自的适用权重与含义
- README 增列两个权重的能力对照表与 caption 实测数据
- point_mask 输出接近全黑时打印警告 —— 该情形不报错,只会悄悄给出空结果
|
2026-07-16 11:48:35 +08:00 |
|
rui40000
|
c6acb9f7d4
|
fix: 修复 RGBA 输入导致的通道数报错
抠图类节点(BiRefNet Ultra V2、RMBG 等)的 image 输出为 4 通道 RGBA,
此前节点直接把它喂给 VAE 编码器,触发:
Given groups=1, weight of size [128, 3, 3, 3],
expected input[1, 4, 1024, 1024] to have 3 channels, but got 4 channels instead
现按 ComfyUI 惯例收敛输入通道:RGBA 丢弃 alpha、灰度扩成三通道、
其余通道数给出可读报错而非让 VAE 抛形状错误。
BiRefNetUltraV2 的 image 输出由 RGB2RGBA(原图, mask) 合成,RGB 三通道
未被 premultiply,因此丢弃 alpha 后即还原原图 —— 实测 RGBA 与 RGB 输入
的输出逐像素完全一致(最大差异 0.00000000),该接法无需调整工作流。
|
2026-07-16 11:26:09 +08:00 |
|
 rui40000andClaude Opus 4.8
|
e1a575fcda
|
feat: 新增 SDMatte 精细抠图节点,实测复现官方效果
基于 SDMatte(vivo 相机研究院,ICCV 2025)的交互式抠图节点,
擅长发丝、绒毛、玻璃、烟雾等常规抠图模型处理不好的边缘。
实现要点:
- 严格照搬官方 configs/SDMatte.py 的推理配置(bbox 视觉提示、fp32、1024 分辨率),
不做任何启发式后处理,输出即模型原始 alpha
- 内置官方 LongfeiHuang/SDMatte 的配置文件,无需下载 SD 2.1 权重,也无需联网。
官方 load_weight=False 只用 config 搭骨架,全部权重由 checkpoint 覆盖;
原版 SD 2.1 的 config 缺 bbox_time_embed_dim 等三个专有字段,缺字段时直接报错而非猜测
- 同时支持官方 .pth(12.1GB)与社区 .safetensors(5.19GB)。两者模型权重实测
逐像素完全相同,pth 多出的 6.5GB 是 detectron2 的优化器状态;读 pth 时以受限
Unpickler 只解析 model 段,内存占用与 safetensors 相当
- 自动适配 transformers 5.x 移除 text_model 包装层导致的键名漂移,
避免 text_encoder 的 372 个权重被静默丢弃
- 加载后校验 1316 个张量全部对齐,有任何未覆盖/未使用的权重即中止报错
- 默认开启注意力分片,1024 下显存峰值由约 15.5GB 降至 9.1GB,速度反而略快
实测(官方效果图中的羊驼,对比官方公布 alpha):MAD=0.0113。
同图同权重下 ComfyUI-SDMatte 为 MAD=0.0884,相差 7.8 倍,主因是其
aux_input="trimap" —— 官方 aux_input_list 只含 point_mask/bbox_mask/mask,
trimap 从未作为视觉提示参与训练,且该分支坐标恒为 [0,0,1,1]、定位信息丢失。
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
|
2026-07-16 11:16:36 +08:00 |
|
rui40000
|
1e42521fec
|
refactor: Align UTF8ConverterNode logic with fix_encoding.py for robust cleaning
|
2026-04-08 16:14:18 +08:00 |
|
rui40000
|
ac8c6eb58d
|
feat: Add LoadImageWithName node to output filename without extension
|
2026-04-08 14:11:17 +08:00 |
|
rui40000
|
8382783022
|
feat: Add seed parameter to Sprite Splitter nodes to force execution on cloud platforms
|
2026-04-08 11:09:26 +08:00 |
|
 rui40000andClaude Opus 4.6
|
4254f1d887
|
fix: 彻底重写OpenAI节点,根除URL被ComfyUI前端吞掉的问题
核心问题:ComfyUI的前端会将STRING/下拉框中的 :// 及后续内容
当作注释吞掉,导致URL丢失主机名。之前两次修复都没解决,因为
下拉框值 "https://" 本身也含有 :// 。
彻底重写方案 —— 所有控件值中不出现 :// :
- protocol下拉框: ["https", "http"] 纯单词,不含任何特殊字符
- api_url默认值: "api.openai.com/v1/chat/completions" 不含协议
- proxy_url: 用户只需填 IP:端口,代码自动补协议
- _build_full_url() 在纯Python中拼接 "://" ,唯一产生此字符串的位置
- _sanitize_url() 清理各种可能的协议残留碎片
- _build_proxy_url() 智能处理代理地址格式
其他改进:
- 无图像时正常调用API进行纯文本对话
- 细分异常类型:连接失败/超时/HTTP错误分别提示
- 超时时间从60s提升到120s
- 清理 __pycache__ 确保新代码生效
Co-Authored-By: Claude Opus 4.6 <noreply@anthropic.com>
|
2026-04-01 15:14:38 +08:00 |
|
 rui40000andClaude Opus 4.6
|
830e829108
|
fix: 彻底解决OpenAI节点URL被ComfyUI前端吞掉的问题
根因:ComfyUI的动态提示系统或第三方扩展(如cg-use-everywhere)
会将STRING控件中的'//'视为注释语法,导致'://'及其后的
主机名+路径被彻底丢弃,仅靠补回'//'无法恢复已丢失的内容。
解决方案:
- 将原来的单个api_url输入拆分为protocol下拉框 + 地址字符串
- protocol下拉框提供 https:// 和 http:// 选项(下拉框不受文本处理影响)
- api_url默认值不再包含'://',从根源避免被吞
- 新增_build_url()函数智能拼接URL,兼容多种用户输入格式
- 即使地址被完全清空也会回退到OpenAI默认地址
- 添加控制台日志输出实际请求地址,便于调试
Co-Authored-By: Claude Opus 4.6 <noreply@anthropic.com>
|
2026-04-01 14:06:30 +08:00 |
|
 rui40000andClaude Opus 4.6
|
4b61f92262
|
fix: OpenAI节点URL被截断报错及无图像时不调用API的问题
1. 修复ComfyUI前端吞掉URL中'//'导致 Invalid URL 'https:' 报错
- 新增 _fix_url() 函数,在请求前自动补回被吞的'//'
2. 修复无图像输入时节点直接返回user_prompt而不调用API的问题
- 有图像时:多模态格式(image_url+text)发送请求
- 无图像+有prompt时:纯文本模式正常调用API对话
- 无图像+无prompt时:返回明确的中文错误提示
Co-Authored-By: Claude Opus 4.6 <noreply@anthropic.com>
|
2026-04-01 13:53:53 +08:00 |
|
rui40000
|
a62c731252
|
Remove compiled cache file from repository
|
2026-04-01 13:40:38 +08:00 |
|
rui40000
|
4e30f26112
|
Fix OpenAI multi-image node to process mixed image sizes independently
|
2026-04-01 13:40:05 +08:00 |
|
rui40000
|
d5abaddd3a
|
Remove compiled cache files from repository
|
2026-04-01 13:25:23 +08:00 |
|
rui40000
|
4ec1ad1fea
|
Update OpenAI node docs for multi-image input and remove Xmiles-nanobanana node
|
2026-04-01 13:24:54 +08:00 |
|
rui40000
|
387b1b1616
|
Sync: enhance logs with uniqueId_sent; retain queued passthrough behavior
|
2026-03-31 09:56:57 +08:00 |
|
rui40000
|
0b36551043
|
Xmiles-nanobanana: add on_queued behavior (passthrough/empty, default passthrough) + generic Poller node for async completion
|
2026-03-31 09:41:31 +08:00 |
|
rui40000
|
7445eddd64
|
OSS upload: normalize https endpoint, optional proxy for oss2, CNAME fallback via oss_url_prefix
|
2026-03-31 09:27:02 +08:00 |
|
rui40000
|
36b7266dc9
|
Xmiles-nanobanana: add OSS upload path + inputs; switch inlineData to URL when use_oss=true; add oss2 dep
|
2026-03-31 09:18:39 +08:00 |
|
rui40000
|
d7b2dc5d4f
|
Add verbose runtime logging to Xmiles-nanobanana nodes
|
2026-03-27 14:00:53 +08:00 |
|
rui40000
|
9cd61aa63f
|
update
|
2026-03-27 11:58:27 +08:00 |
|
rui40000
|
5585ecbff2
|
Remove local test artifacts (test_binary_null.txt) and clean cached files
|
2026-03-27 11:25:07 +08:00 |
|
rui40000
|
3188ddb9aa
|
update
|
2026-03-27 10:54:04 +08:00 |
|