首页
沸点
课程
APP
AI用量
作品广场
专家标注
搜索历史
清空
创作者中心
写文章
发沸点
写笔记
写代码
草稿箱
创作灵感
查看更多
登录
注册
evan2020
掘友等级
获得徽章 0
动态
文章
专栏
沸点
收藏集
关注
赞
0
文章 0
沸点 0
赞
0
返回
|
搜索文章
evan2020
1月前
关注
OpenDataLoader 开源 PDF 解析工具 懒人整合包
OpenDataLoader 简介 OpenDataLoader 是一个面向 AI 文档处理的开源 PDF 解析工具(由 Hancom 相关团队开源维护)。它的核心使命是将...
0
评论
分享
evan2020
2月前
关注
FLUX.2 [klein] 4B 轻量级 AI 图像生成 懒人整合包
FLUX.2 [klein] 4B 是 Black Forest Labs(BFL) 推出的轻量级 AI 图像生成模型,也是 FLUX.2 klein 系列中最小、速度最快...
0
评论
分享
evan2020
2月前
关注
DeOldify:旧照片上色 懒人整合包
DeOldify:基于深度学习的黑白照片与老电影自动上色神器 DeOldify 是一个基于深度学习的黑白照片与老电影自动上色(Colorization)开源项目。它能够将黑...
0
评论
分享
evan2020
2月前
关注
GFPGAN:开源人脸修复与增强 懒人整合包
GFPGAN:开源人脸修复与增强 AI 模型 GFPGAN(Generative Facial Prior GAN)是由腾讯 ARC 实验室提出的人脸图像修复模型(论文发表...
0
评论
分享
evan2020
2月前
关注
Real-ESRGAN:经典开源 AI 图像与视频超分辨率 懒人整合包
Real-ESRGAN:经典开源 AI 图像与视频超分辨率修复引擎 Real-ESRGAN 是一个基于深度学习的图片超分辨率与修复模型,旨在将低分辨率、模糊、有噪声的图片提...
0
评论
分享
evan2020
2月前
关注
Marker:高质量 PDF 转 Markdown 懒人整合包
Marker:高质量 PDF 转 Markdown 的开源神器 Marker 是一个开源的文档转换工具,旨在将 PDF 文件转换为 Markdown、JSON 或 HTML...
0
评论
分享
evan2020
2月前
关注
Tesseract OCR:经典开源离线文字识别引擎 懒人整合包
Tesseract OCR:经典开源离线文字识别引擎 Tesseract OCR 是一个开源的光学字符识别(OCR)引擎,用于将图片、扫描文档中的文字转换为可编辑的文本。它...
0
评论
分享
evan2020
2月前
关注
RapidOCR cpu可用 懒人整合包
RapidOCR:轻量、高速、跨平台的开源 OCR 引擎 RapidOCR 是由 RapidAI 社区维护的开源 OCR(光学字符识别)工具库。它旨在将现代深度学习 OCR...
0
评论
分享
evan2020
2月前
关注
MOSS-TTS-Nano ONNX:轻量级离线语音合成 懒人整合包
MOSS-TTS-Nano ONNX:轻量级离线语音合成方案 MOSS-TTS-Nano 是由 MOSI.AI 与 OpenMOSS 团队推出的开源轻量级 TTS(文本转语...
0
评论
分享
evan2020
2月前
关注
Vosk:开源离线语音识别 懒人整合包
认识 Vosk:轻量级开源离线语音识别引擎 Vosk 是一个开源的离线语音识别(ASR)工具包。简单来说,它可以让你的电脑、服务器、树莓派等设备,在完全断网的情况下,实时将...
0
评论
分享
evan2020
2月前
关注
Piper TTS 离线语音合成 懒人整合包
Piper TTS 简介 官方仓库(已归档): piper 当前维护仓库: piper1-gpl ⚙️ 基本原理与文件结构 🔄 工作流程 Piper 的核心语音合成链路非...
0
评论
分享
evan2020
2月前
关注
边缘端语音全能王 sherpa-onnx 懒人整合包
边缘端语音全能王:Sherpa-ONNX 深度介绍 sherpa-onnx 是一个基于 ONNX Runtime 的高性能离线语音 AI 推理框架,专注于提供语音识别(AS...
0
评论
分享
evan2020
4月前
关注
Qwen3 ASR 流式转写 Docker 懒人整合包
前言 本文是第二个docker懒人包,依旧是win兼容问题,不得不用docker 这个懒人包有40GB左右,在docker容器里,环境依赖和模型都在,界面为官方的流式dem...
0
评论
分享
evan2020
4月前
关注
sam3 提示词 图片分割和视频分割 docker 懒人整合包
前言 因为win兼容性问题,改为docker懒人包 第一次把镜像打包了,一些第三方依赖不在,依旧报错 第二次才把带环境的容器打包,这样一个极简的可以正常的工作的docker...
0
评论
分享
evan2020
4月前
关注
SAM3 提示词 视频分割 ComfyUI 懒人整合包
前言 上期记录了SAM3 提示词 图片分割 本文更新SAM3 提示词 视频分割 但是在视频分割遇到一些兼容性问题 报错 easy sam3VideoSegmentation...
0
评论
分享
evan2020
5月前
关注
SAM3 提示词 图片分割 ComfyUI 懒人整合包
SAM3 github地址: https://github.com/facebookresearch/sam3 Meta AI SAM 3 模型介绍 Meta AI 开源的...
0
评论
分享
evan2020
5月前
关注
Qwen3-ASR 多语言语音音乐歌曲识别 懒人整合包 重新安装
前言 从之前的fastapi转gradio界面,已经重新打包了3个左右的懒人包 核心是为了把编程api转为可视化操作交互网页,更加方便,同时也是为了重新优化项目结构,方便后...
0
评论
分享
evan2020
5月前
关注
PaddleOCR-VL-1.5 PDF转MD 懒人整合包 界面微调
前言 本期依旧是把fastapi的界面改为gradio界面 原来的fastapi适合api调用,现在的gradio适合界面交互操作 本期的更新为 只保留PDF转MD和图片转...
0
评论
分享
evan2020
5月前
关注
paddleocr PP-StructureV3 pdf转md 懒人整合包 gpu可用
前言 上一期内容记录了paddleocr PP-StructureV3 pdf转md 懒人整合包 cpu可用 本文主要是记录把paddleocr PP-StructureV...
0
评论
分享
evan2020
5月前
关注
paddleocr PP-StructureV3 pdf转md 懒人整合包 cpu可用 交互界面调整
前言 本文依旧是懒人包的优化更新 之前最大的问题就是使用fastapi这种偏向编程交互的操作方式 适合api调用,不太适合gui界面可视化操作,现在统一把fastapi改为...
0
评论
分享
下一页
个人成就
文章被点赞
213
文章被阅读
151,504
掘力值
2,555
关注了
0
关注者
50
收藏集
1
关注标签
139
加入于
2017-07-16