DeepSeek大模型概述及应用
DeepSeek基本概况
DeepSeek是由杭州深度求索人工智能基础技术研究有限公司开发的一系列人工智能模型,拥有数以亿计的参数,通过海量文本数据预训练,支持智能对话、翻译、写作、编程、解题和文件解读等功能。其“深度思考”和“联网搜索”功能能全面理解用户问题并提供准确答案。
公司成立于2023年7月17日,专注于开发大语言模型(LLM),主要使用数据蒸馏技术降低成本。DeepSeek-R1、V3、Coder等系列模型已上线国家超算互联网平台,在代码和数学任务上表现优异,超越部分开源模型。DeepSeek以高性价比著称,如DeepSeek-V3训练成本仅557.6万美元,远低于OpenAI训练GPT-4的成本,且团队规模更小。
在审计领域,DeepSeek能帮助审计人员高效处理多源异构数据、识别风险、提升审计质量,通过自动化数据处理、智能化风险识别和定制化报告生成等功能,降低人工成本、提高审计质量和效率。
DeepSeek主要版本
DeepSeek核心版本包括DeepSeek-V3、DeepSeek-R1、JanusPro,特点如下:
- DeepSeek-V3:参数量671B,适用于长文本处理。
- DeepSeek-R1:参数量671B,适用于复杂逻辑推理。
- JanusPro:适用于多模态任务。
原始模型权重已开源,国内用户可通过镜像(https://hf-mirror.com/)获取。DeepSeek-V3和R1参数量较大,直接部署需1.3~2TB显存。为方便用户,DeepSeek团队蒸馏了6款小模型(1.5B~70B),但蒸馏和量化会降低模型能力。
DeepSeek审计能力
- 数据采集与预处理:支持多种数据源接入,自动清洗、转换和整合数据。
- 数据分析与挖掘:提供趋势分析、比率分析、异常检测等工具,识别潜在风险。
- 自定义分析模型:用户可自定义分析模型,针对特定场景设定参数。
- 风险识别与评估:基于预设规则和机器学习模型自动识别和排序风险。
- 审计证据收集与管理:生成详细审计底稿,支持电子化存储和管理。
- 可视化与报告生成:提供可视化图表,自动生成标准化审计报告。
DeepSeek部署方法
使用DeepSeek主要有三种渠道:
- 官方渠道:网页版和移动版,功能相同,需注册后使用。
- 第三方渠道:硅基流动&华为云、纳米AI搜索、阿里云、百度智能云、火山引擎等,提供稳定可靠的替代方案,收费模式多样。
- 本地部署:适合需要保证数据安全、对性能忍受度高的用户,需下载ollama并安装合适版本,推荐R1模型。
DeepSeek审计助手
- 基础操作场景:访问官网注册后使用,需注意提示词技巧,如明确需求、提供背景等。
- 审计工作辅助:生成审计工作清单、解析审计文档、模拟审计访谈等。
- 审计学习考试:提供智能错题本、CPA审计训练、学习路径辅导等功能。
- 其他提示:支持隐私保护、效率技巧,并提供常见问题库。
附录:常见问题解答
- 模型选择与部署:Q1涉及模型选择场景,Q2提供本地部署硬件配置,Q3说明第三方平台收费。
- 性能与优化:Q4分析量化模型性能下降情况,Q5提供提升本地模型响应速度的方案。
- 错误与故障排除:Q6、Q7、Q8分别针对部署报错、服务器繁忙、数据安全问题提供解决方案。
- 其他高频问题:Q9、Q10涉及技术支持和模型更新问题。