DeepSeek
深度求索(DeepSeek),成立于2023年,专注于研究世界领先的通用人工智能底层模型与技术,挑战人工智能前沿性难题。
工具介绍
深度求索(DeepSeek),成立于2023年,专注于研究世界领先的通用人工智能底层模型与技术,挑战人工智能前沿性难题。基于自研训练框架、自建智算集群和万卡算力等资源,深度求索团队仅用半年时间便已发布并开源多个百亿级参数大模型,如DeepSeek-LLM通用大语言模型、DeepSeek-Coder代码大模型,并在2024年1月率先开源国内首个MoE大模型(DeepSeek-MoE),各大模型在公开评测榜单及真实样本外的泛化效果均有超越同级别模型的出色表现。
真人测评
1. 收费情况
网页端和 App 端对话目前完全免费,日常使用基本零成本。API 按量计费,V3 模型输入 1 元/百万 token、输出 2 元,R1 推理模型输入 4 元、输出 16 元,在同级别模型里算白菜价。新用户注册就送额度,而且缓存命中后输入价格能再打一折,高频重复调用的场景特别划算。
2. 核心优点
代码和数学推理是真的强,写 Python、debug、算法题解题这块体验远超大部分国产模型,很多时候比 GPT-4o 还利索。128K 超长上下文也是实打实的,扔一整篇论文或者几十页合同进去,能准确抓关键信息不乱飘。中文理解自然不做作,不像某些模型一股翻译腔。更难得的是模型开源、支持本地部署,对数据安全敏感的企业用户来说这一点是刚需。
3. 不足之处
创意写作和闲聊是明显短板,写小说、编段子、日常唠嗑都比较干巴,风格偏“理工直男”。多模态能力薄弱,目前还是纯文本模型,不能直接识别图片内容。产品交互偏工程师审美,Web 端偶尔卡顿,App 的体验也远不如 ChatGPT 那般顺滑。偶尔回答过于“严谨”,废话解释偏多,不如直接给结论痛快。
4. 适合人群
程序员和技术从业者用它辅助写代码、Debug、学新技术栈简直绝配。科研人员和研究生拿它读论文、推公式、辅助写作也很顺手。需要私有化部署的企业团队,DeepSeek 的开源 + 低成本组合是目前国产最优解。但如果你主要是写营销文案、做情感陪伴聊天,可能会觉得它“不够有趣”。
星级评价
⭐⭐⭐⭐☆
核心功能
- 多轮对话理解
- 知识问答
- 内容创作
- 代码生成
- 文件处理