微信扫码
添加专属顾问
我要投稿
这是关于 DeepSeek-R1 系列模型的重磅解读,没有之一。 核心内容: 1. DeepSeek-R1 系列模型的诞生背景与推理能力 2. 创新训练方式及面临的挑战 3. 模型开源成果及超越竞品的表现
.01
DeepSeek-R1-Zero | ? HuggingFace |
DeepSeek-R1 | ? HuggingFace |
DeepSeek-R1-Distill-Qwen-1.5B | ? HuggingFace |
DeepSeek-R1-Distill-Qwen-7B | ? HuggingFace |
DeepSeek-R1-Distill-Llama-8B | ? HuggingFace |
DeepSeek-R1-Distill-Qwen-14B | ? HuggingFace |
DeepSeek-R1-Distill-Qwen-32B | ? HuggingFace |
DeepSeek-R1-Distill-Llama-70B | ? HuggingFace |
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费场景POC验证,效果验证后签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2025-04-04
OpenAI 免费 “AI 补习班”:教你偷偷变强!『OpenAI Academy』
2025-04-03
4天开发,1700万美元融资:开源的Browser Use为啥这么火?
2025-04-03
为什么大模型本地部署后“没了下文”?
2025-04-03
35k star,一款颠覆性的文本转语音神器,已开源!
2025-04-03
阿里搞了个大新闻!这AI能听会看还会实时唠嗑,科幻片都不敢这么拍?
2025-04-03
GitHub 重磅开源!GPT-Crawler:一键爬取网站知识库,打造专属AI大脑!
2025-04-02
兼顾推理效率和代码效果的Ling-Coder-Lite解读
2025-04-02
大模型提供商:Xinference和ollama有什么区别
2025-01-01
2024-07-25
2025-01-21
2024-05-06
2024-09-20
2024-07-20
2024-06-12
2024-07-11
2024-08-13
2024-12-26
2025-04-03
2025-04-03
2025-04-03
2025-04-01
2025-03-31
2025-03-25
2025-03-25
2025-03-24