当前位置: 首页 > wzjs >正文

如何投稿小说到各大网站图片优化

如何投稿小说到各大网站,图片优化,深圳宝安网站推广,wordpress首页怎么设置一、项目介绍 SAiD是一种基于扩散模型的语音嘴型同步方法,通过一段语音就可以生成包含32个blendshape参数的数据,通过制作对应的数字人面部blendshape进行映射,能够实现嘴型同步功能。 效果展示: SAiD嘴型同步效果 模型框架图为…

一、项目介绍

SAiD是一种基于扩散模型的语音嘴型同步方法,通过一段语音就可以生成包含32个blendshape参数的数据,通过制作对应的数字人面部blendshape进行映射,能够实现嘴型同步功能。
效果展示:

SAiD嘴型同步效果

模型框架图为:
在这里插入图片描述
输出的blendshape列表为:
在这里插入图片描述

二、项目部署

1.下载项目

项目链接:https://github.com/yunik1004/SAiD

2.创建环境及安装需要的库

(1)安装依赖的库

在这里插入图片描述

(2)成功安装

在这里插入图片描述

3.判断cuda是否安装成功

(1)没有成功安装cuda,大概率是版本不对,查询自己电脑所适配的cuda版本,重新安装

安装失败
在这里插入图片描述
卸载当前的cuda版本
在这里插入图片描述
查询自己电脑所适配的cuda版本,尽量越接近越好
在这里插入图片描述
到官网选择适合自己电脑的cuda版本,并复制下载网址,官网:https://pytorch.org/get-started/locally/
在这里插入图片描述
进行cuda安装
在这里插入图片描述
安装成功
在这里插入图片描述
能够正常调用cuda
在这里插入图片描述

4.下载好预训练的模型,并放在合适的位置

模型下载地址:https://huggingface.co/yunik1004/SAiD
在这里插入图片描述

5.进行blendshape数据生成

在这里插入图片描述
生成的数据最好不要低于60帧,低于60帧嘴型同步效果不好
在这里插入图片描述
开始运行,运行失败,出现问题
在这里插入图片描述

6.解决ImportError: cannot import name ‘cached_download’ from ‘huggingface_hub’ (D:\anaconda3\envs\said1\lib\site-packages\huggingface_hub_init_.py)

原因:在huggingface_hub 0.26 中移除了该函数
解决方法:将huggingface_hub版本回退到0.25.2
在这里插入图片描述

7.重新进行生成

仍存在问题
在这里插入图片描述

8.解决ImportError: cannot import name ‘metric’ from partially initialized module ‘said’ (most likely due to a circular import) (D:\anaconda3\envs\said1\lib\site-packages\said_init_.py)

问题:在模块导入过程中发生了循环依赖或者模块初始化过程中的某些问题
解决方法:将一整个said文件夹复制一份到script文件夹中
在这里插入图片描述

9.继续生成

成功生成
在这里插入图片描述
查看生成的数据
在这里插入图片描述

三、API调用

1.基于Flask实现api调用

封装方法,实现接口调用

import argparse
import os
from diffusers import DDIMScheduler
import torch
import numpy as np
from said.model.diffusion import SAID_UNet1D
from said.util.audio import fit_audio_unet, load_audio
from said.util.blendshape import (load_blendshape_coeffs,save_blendshape_coeffs,save_blendshape_coeffs_image,
)
from dataset.dataset_voca import BlendVOCADatasetdef infer_blendshape_from_audio(audio_path: str,weights_path: str = r"D:\G\AIAgentHub\文档\技术方案文档\网页端数字人\project\SAiD-main\script\ModelWeight\SAiD.pth",output_path: str = r"D:\G\AIAgentHub\文档\技术方案文档\网页端数字人\project\SAiD-main\script\Output\test_ch.csv",device: str = "cuda:0",fps: int = 60,num_steps: int = 1000,strength: float = 1.0,guidance_scale: float = 2.0,guidance_rescale: float = 0.0,eta: float = 0.0,prediction_type: str = "epsilon",divisor_unet: int = 1,unet_feature_dim: int = -1,init_sample_path: str = None,mask_path: str = None,save_intermediate: bool = False,intermediate_dir: str = "./interm",save_image: bool = False,output_image_path: str = "./out.png",
) -> np.ndarray:"""从音频中推理生成 blendshape 数据"""# 加载初始样本和 maskinit_samples = (load_blendshape_coeffs(init_sample_path).unsqueeze(0).to(device)if init_sample_path else None)mask = (load_blendshape_coeffs(mask_path).unsqueeze(0).to(device)if mask_path else None)# 加载模型said_model = SAID_UNet1D(noise_scheduler=DDIMScheduler,feature_dim=unet_feature_dim,prediction_type=prediction_type,)said_model.load_state_dict(torch.load(weights_path, map_location=device))said_model.to(device)said_model.eval()# 加载并预处理音频waveform = load_audio(audio_path, said_model.sampling_rate)fit_output = fit_audio_unet(waveform, said_model.sampling_rate, fps, divisor_unet)waveform = fit_output.waveformwindow_len = fit_output.window_sizewaveform_processed = said_model.process_audio(waveform).to(device)# 模型推理with torch.no_grad():output = said_model.inference(waveform_processed=waveform_processed,init_samples=init_samples,mask=mask,num_inference_steps=num_steps,strength=strength,guidance_scale=guidance_scale,guidance_rescale=guidance_rescale,eta=eta,save_intermediate=save_intermediate,show_process=True,)# 获取结果result = output.result[0, :window_len].cpu().numpy()save_blendshape_coeffs(coeffs=result,classes=BlendVOCADataset.default_blendshape_classes,output_path=output_path,)return resultfrom flask import Flask, request, jsonify
from flask_cors import CORS  # ✅ 添加这行
import tempfile
import os
import script.MyInference  # 你自己的推理模块app = Flask(__name__)
CORS(app)  # ✅ 允许所有来源跨域访问
# 或者更安全的写法:CORS(app, origins=["http://localhost:5173"])@app.route('/audio2bs', methods=['POST'])
def audio2bs():if 'audio' not in request.files:return jsonify({"error": "No audio file uploaded"}), 400audio_file = request.files['audio']print("收到请求:", audio_file.filename)# 临时保存上传的文件with tempfile.NamedTemporaryFile(delete=False, suffix=".mp3") as tmp:audio_file.save(tmp)tmp_path = tmp.nametry:# 执行推理result = script.MyInference.infer_blendshape_from_audio(tmp_path)print(result)# 转为 list 以便 jsonifyblendshape_data = result.tolist()return jsonify({"blendshape": blendshape_data})except Exception as e:return jsonify({"error": str(e)}), 500finally:os.remove(tmp_path)if __name__ == '__main__':# 默认监听 5000 端口,可改为 host='0.0.0.0' 供局域网访问app.run(debug=True, port=5000)

存放路径
在这里插入图片描述

http://www.dtcms.com/wzjs/9046.html

相关文章:

  • wordpress不能放大图片网站seo顾问
  • 新闻源网站怎么做网址搜索
  • 网站logo图怎么做的可以直接进入的舆情网站
  • 淘宝联盟网站推广怎么做贺贵江seo教程
  • 成都彩票网站建设自己开发网站
  • 山西省建设主管部门网站白云区最新疫情
  • 设计师工作室网站网站提交入口大全
  • 网站做等保三级建设推广引流图片
  • 做文案选图片素材的网站seo广告优化多少钱
  • 做网站要备案吗 要几天新闻源
  • 什么网站可以做自考试题狠抓措施落实
  • 物理机安装虚拟机做网站好处百度广告管家
  • 淮安 做网站 app如何网上免费做推广
  • 经营阅读网站需要怎么做网络seo啥意思
  • wordpress 增加内存网站优化排名软件哪些最好
  • 常见网站架构域名大全免费网站
  • 哪个网站做平面能兼职推广普通话主题手抄报
  • 17一起广州做网站网络服务合同纠纷
  • 做网站暴利小红书seo优化
  • 西安网站设计建设公司 概况百度网盘app下载安装
  • 怎么做门户网站设计搜索引擎名词解释
  • 网页设计与网站建设报告书济南网站推广优化
  • 洛阳网络公司西安seo外包服务
  • 鄂州网站开发怎么制作网站教程步骤
  • wordpress get_field网络搜索引擎优化
  • 曲阜市网站建设能打开各种网站的浏览器下载
  • 上海网上做鸭子的网站怎么进行网站关键词优化
  • 成都网页设计与网站建设代运营服务
  • 专做品牌网站头条搜索
  • 百度网盟推广官网入口漳州seo网站快速排名