当前位置: 首页 > wzjs >正文

域名手机网站源码90后做网站

域名手机网站源码,90后做网站,网站建设如何创业,找人做淘宝网站需要多少钱vLLM 是一款专为大语言模型推理加速而设计的框架,实现了 KV 缓存内存几乎零浪费,解决了内存管理瓶颈问题。 更多 vLLM 中文文档及教程可访问 →https://vllm.hyper.ai/ *在线运行 vLLM 入门教程:零基础分步指南 源码 examples/offline_inf…

vLLM 是一款专为大语言模型推理加速而设计的框架,实现了 KV 缓存内存几乎零浪费,解决了内存管理瓶颈问题。

更多 vLLM 中文文档及教程可访问 →https://vllm.hyper.ai/

*在线运行 vLLM 入门教程:零基础分步指南

源码 examples/offline_inference/cpu_offload_lmcache.py

# SPDX-License-Identifier: Apache-2.0"""
该文件演示了 CPU 卸载的示例用法
与 LMCache。
请注意,运行此示例需要 "pip install lmcache"。
在 https://github.com/LMCache/LMCache 中了解有关 LMCache 的更多信息。
"""
import os
import timefrom lmcache.experimental.cache_engine import LMCacheEngineBuilder
from lmcache.integration.vllm.utils import ENGINE_NAMEfrom vllm import LLM, SamplingParams
from vllm.config import KVTransferConfig# 与 LMCache 相关的环境变量
# 在 LMCache 中使用实验功能
os.environ["LMCache_USE_EXPERIMENTAL"] = "True"
# LMCache 设置为每块使用256个 token
os.environ["LMCache_CHUNK_SIZE"] = "256"
# 在 LMCache 中启用本地 CPU 后端
os.environ["LMCache_LOCAL_CPU"] = "True"
# 将本地 CPU 内存限制设置为 5.0 GB
os.environ["LMCache_MAX_LOCAL_CPU_SIZE"] = "5.0"# 此示例脚本以共享前缀运行两个请求。
shared_prompt = "Hello, how are you?" * 1000
first_prompt = [shared_prompt + "Hello, my name is",
]
second_prompt = [shared_prompt + "Tell me a very long story",
]sampling_params = SamplingParams(temperature=0, top_p=0.95, max_tokens=10)ktc = KVTransferConfig.from_cli('{"kv_connector":"LMCacheConnector", "kv_role":"kv_both"}')
# 将 GPU 内存利用设置为 0.8,用于 40GB 显存的 A40 GPU。
# 如果您的 GPU 的内存较少,则降低值。
# 请注意,LMCache 目前与块预填充不兼容。
llm = LLM(model="mistralai/Mistral-7B-Instruct-v0.2",kv_transfer_config=ktc,max_model_len=8000,enable_chunked_prefill=False,gpu_memory_utilization=0.8)outputs = llm.generate(first_prompt, sampling_params)
for output in outputs:generated_text = output.outputs[0].textprint(f"Generated text: {generated_text!r}")
print("First request done.")time.sleep(1)outputs = llm.generate(second_prompt, sampling_params)
for output in outputs:generated_text = output.outputs[0].textprint(f"Generated text: {generated_text!r}")
print("Second request done.")# 清理 LMCache 后端
LMCacheEngineBuilder.destroy(ENGINE_NAME)
http://www.dtcms.com/wzjs/585959.html

相关文章:

  • 手机h5网站模板下载秦皇岛海三建设工程集团
  • 自动化网站建设红色网站建设的作用和意义
  • 自己怎么做百度网站空间wordpress 编辑分类目录
  • 民治营销网站wordpress注册地址
  • 网站建设费用计入固定资产那个网站做精防手机
  • 网站流量超网站开发代理报价表
  • 做网站要不要服务器深圳比较好的设计公司有哪些
  • ppt插件 网站网站建设wangzhii
  • 做公益的网站wordpress导航菜单函数
  • 青岛网站设计哪家好哪里有网站建设电话
  • 培训方案网站建设哪里有做app软件开发
  • 沈阳网站推广有什么技巧个人如何建立公司网站
  • 安徽省建设工程信息网站6wordpress+判断手机
  • 设备网站开发软装设计培训一般多少钱
  • 东莞网站建设选高科技中小企业网络管理员实战完全手册
  • 做网站和平台多少钱wordpress无法安装
  • 专业app网站建设延庆手机网站建设
  • 网站编辑器是怎么做的天眼查 企业查询
  • 网站怎么做电子合同二维码生成器下载
  • 网站建设培训 店项城网站
  • 站长工具国产2023网站产品推广制作
  • 民族建设集团有限公司官方网站企业网站建设基本思路
  • 我的网站设计联盟能免费创建网站吗
  • 重庆制作网站速成班wordpress拼图
  • 中国网络营销网站企业网站源码生成
  • 做网站需要多少带宽宁晋网站建设公司
  • 织梦wordpress建站wordpress浏览器
  • 网站设计和程序员怎么弄一个自己的链接
  • 哪些企业需要做网站宝丰网站制作效果好
  • 门户网站建设公司流程网站如何创建首页