自媒体维基
  • 首页
  • 热榜
  • 其他导航
    • 前沿科技
    • 前往摸鱼
    • 摄影必备
    • 设计导航
    • 站长导航
    • 产品经理
    • 旅途臻选
    • 博客大全
    • 软件宝库
      • 未登录
        登录后即可体验更多功能
    • 简体中文
      • 简体中文简体中文
      • 繁體中文繁體中文
      • EnglishEnglish
      • 日本語日本語
      • 한국어한국어
    • 前沿科技
    • 专业摸鱼
    • 设计导航
    • 站长导航
    • 探索驿站
    • 摄影导航
    • 产品经理
    • 软件仓库
    未登录
    登录后即可体验更多功能

    显存优化

    共 3 篇文章
    排序
    发布更新浏览点赞
    模型太大跑不动?聊聊大模型量化的门道

    模型太大跑不动?聊聊大模型量化的门道

    模型太大跑不动?聊聊大模型量化的门道 说实话,这几年大模型发展太快了,快到普通开发者都有点跟不上的感觉。我记得两年前GPT-3的1750亿参数还让人觉得遥不可及,现在国内很多团队都在训千亿级别的模型...
    软件科技# 显存优化# 权重矩阵# 模型压缩
    4个月前
    1.3K
    VoxCPM:一个让中文大模型训练「降本增效」的开源利器

    VoxCPM:一个让中文大模型训练「降本增效」的开源利器

    VoxCPM是清华大学NLP团队(OpenBMB)开源的中文大模型训练框架,专为解决百亿参数模型训练中的显存不足、训练缓慢和成本失控三大痛点而设计。通过PyTorch FSDP参数分片技术,VoxCP...
    软件科技# Flash Attention优化# FlashAttention2# FSDP分布式训练
    4个月前
    1.3K
    50%显存削减仅损失3.1%性能:这项研究重新定义了大模型推理的效率边界

    50%显存削减仅损失3.1%性能:这项研究重新定义了大模型推理的效率边界

    50%显存削减仅损失3.1%性能:这项研究重新定义了大模型推理的效率边界 大模型推理的显存焦虑,可能即将迎来一个被忽视的解法。 当所有人都在讨论如何通过量化、剪枝来压缩模型体积时,一篇来自工业界的研究...
    软件科技# GQA# KV cache# MQA
    4个月前
    1.3K
    没有了
    自媒体维基
    自媒体导航,集各行业所需优选网址、资讯、工具于一体的导航,简约优雅的设计风格,全面的前端用户功能,简单的模块化配置,欢迎您的体验!
    • ✅更新日志
    • 💡广告合作
    • 💕关于我们
    • ✨内容相关
      • 💬网址投递
      • 🔞内容举报
      • 💯满意度调查
      • 📌BUG反馈
    QQ交流群(密码zmt.wiki)自媒体维基
    QQ交流群(密码zmt.wiki)

    Copyright © 2022 个人的笔记 浙ICP备14038291号-6    

    本站由酷盾安全酷盾安全提供高防CDN安全防护服务

      
    网址
    网址文章软件书籍
      ↵ENTER↓↑NAV