Gitee AI 联合沐曦首发全套 DeepSeek R1 千问蒸馏模型,全免费体验
2025-02-05 15:43:45 AI 27观看
摘要 2 月 3 日消息,Gitee AI 昨日宣布上线 DeepSeek-R1-Distill-Qwen-1.5B、DeepSeek-R1-Distill-Qwen-7B、DeepSeek-R1-Distill-Qwen-14B、DeepSeek-R1-Distill-Qwen-32B 四个较小尺寸的 DeepSeek 模型。更值得关

2 月 3 日消息,Gitee AI 昨日宣布上线 DeepSeek-R1-Distill-Qwen-1.5B、DeepSeek-R1-Distill-Qwen-7B、DeepSeek-R1-Distill-Qwen-14B、DeepSeek-R1-Distill-Qwen-32B 四个较小尺寸的 DeepSeek 模型。更值得关注的是,本次上线的四个模型均部署在国产沐曦曦云 GPU 上。k6B28资讯网——每日最新资讯28at.com

k6B28资讯网——每日最新资讯28at.com

与全尺寸 DeepSeek 模型相比,较小尺寸的 DeepSeek 蒸馏版本模型更适合企业内部实施部署,可以降低落地成本。k6B28资讯网——每日最新资讯28at.com

同时,这次Deepseek R1 模型 + 沐曦曦云 GPU + Gitee AI 平台,更是实现了从芯片到平台,从算力到模型全国产研发。k6B28资讯网——每日最新资讯28at.com

注:DeepSeek R1 是一款大型混合专家(MoE)模型,拥有 6710 亿个参数,支持 128000 个 Token 的大输入上下文长度。k6B28资讯网——每日最新资讯28at.com

本次部署在沐曦曦云 GPU 上的是四个 DeepSeek R1 蒸馏模型,号称以更小参数量的资源占用,实现了性能与大参数模型“旗鼓相当”。k6B28资讯网——每日最新资讯28at.com

k6B28资讯网——每日最新资讯28at.com

目前 Gitee AI 上的 DeepSeek-R1-Distill 系列模型现已面向全体开发者免费使用。k6B28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-10448-0.htmlGitee AI 联合沐曦首发全套 DeepSeek R1 千问蒸馏模型,全免费体验

声明:本网页内容旨在传播知识,不代表本站观点,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

显示全文

上一篇:郭明錤称 DeepSeek 爆红加速 AI 模型“设备端化”趋势

下一篇:DeepSeek 威胁下,OpenAI 称考虑开源旧 AI 模型

最新热点