国产开源大模型性价比突围:美企选择 Qwen 等模型时的成本与性能权衡海外开发者圈子里,关于“要不要试试中国开源大模型”的讨论,已经从技术尝鲜变成了实打实的成本核算。Airbnb、Coinbase 这些名字出现在国产模型的采用名单里,本身就是一个信号:当性能差距缩小到个...AI智能# 医疗# 团队协作# 微调1个月前1600
华为全液冷超充方案:鲲鹏与昇腾在不同行业的适配指南面向行业智能化的算力采购,难点从来不只是“选一台性能更高的服务器”。政务系统看重稳定与数据边界,医疗场景需要兼顾业务连续性和模型辅助能力,制造企业往往同时存在现场推理与中心训练需求,金融机构则更关注高...AI智能# 人工智能# 医疗# 图像识别1个月前1650
开源AI模型本地化部署:从Muse Glimmer到LoRA微调的实操步骤随着Meta开源Muse Glimmer模型的发布,开源AI开发者迎来将大型模型部署到本地的全新机遇。Muse Glimmer作为30B参数的开源模型,采用Apache 2.0协议,专为本地常驻Age...AI智能# 微调# 推理加速# 显存2个月前1700
模型量化与蒸馏在推理加速中的权衡与部署方案:跟朋友聊聊怎么落地本文面向AI工程师,深入对比模型量化与蒸馏在推理加速中的原理、收益与代价,分析量化误差、蒸馏训练成本等关键权衡,并提供量化感知训练、蒸馏后量化等混合部署方案,帮助你在实际项目中做出合理选型并顺利落地。AI智能# 推理加速# 模型部署# 模型量化2个月前1260
从算力芯片到普惠应用:跨越预训练、推理加速、量化压缩与端侧部署,拥抱人人可及的智能新时代说实话,这两年聊人工智能,大家张口闭口都是大模型、算力、参数规模,好像谁不提几个英文缩写就显得落伍了,但作为一个天天跟技术稿件打交道的编辑,我其实更关心另一件事,这些听起来高深莫测的东西,到底什么时候...AI视频# 从算力芯片到普惠应用# 拥抱人人可及的智能新时代# 推理加速2个月前2030