news 2026/9/3 2:51:22

SpringAI+Deepseek大模型应用开发实战笔记

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
SpringAI+Deepseek大模型应用开发实战笔记

Spring AI + DeepSeek 大模型应用开发实战笔记(2026年最新实践总结)

目前(2026年初)Spring AI 集成国产最强推理模型DeepSeek(尤其是DeepSeek-R1DeepSeek-V3)已经非常成熟,主要有以下几种主流打法,按推荐度排序:

排名接入方式优点缺点/限制推荐场景难度
1OpenAI兼容接口(最推荐)配置最简单、切换模型方便、生态最全需要联网,费用(但非常便宜)生产环境、企业项目★☆☆☆☆
2Ollama本地部署完全免费、私有化、无网络依赖硬件要求高、响应速度慢(尤其是大模型)开发测试、内网、隐私要求极高★★★☆☆
3阿里云百炼/硅基流动中转高可用、限速宽松、可选很多模型多了一层转发、偶尔延迟预算充足、追求稳定★★☆☆☆
4Spring AI 官方DeepSeek starter(快照版)原生支持、最优雅目前还是快照版,不够稳定尝鲜党、追求最新特性★★☆☆☆

方式一:最常用、最推荐 - OpenAI兼容模式(硅基流动/DeepSeek官方/阿里百炼)

目前绝大多数生产项目都在用这种方式

spring:ai:openai:# 下面三选一(强烈推荐硅基流动,新用户有超多免费token)# 1. 硅基流动(最推荐,性价比最高)base-url:https://api.siliconflow.cn/v1api-key:sk-xxxxxxxxxxxxxxxxxxxxxxxx# 2000w免费token# 2. DeepSeek官方# base-url: https://api.deepseek.com# api-key: sk-xxxxxxxxxxxxxxxxxxxxxxxxchat:options:# 目前最强组合(2026年1月主流选择)model:deepseek-ai/DeepSeek-R1# 最强推理(类o1)# model: deepseek-ai/DeepSeek-V3 # 最强通用/性价比之王# model: deepseek-ai/DeepSeek-R1-Distill-Qwen-32B # 蒸馏版,速度更快temperature:0.6max-tokens:8192top-p:0.95

最常用代码模板(ChatClient流式写法)

@RestController@RequestMapping("/ai")@RequiredArgsConstructorpublicclassAiController{privatefinalChatClientchatClient;// Spring AI 自动注入// 普通调用@GetMapping("/chat")publicStringsimpleChat(@RequestParamStringmsg){returnchatClient.prompt().user(msg).call().content();}// 流式返回(前端打字机效果,必用!)@GetMapping(value="/stream",produces=MediaType.TEXT_EVENT_STREAM_VALUE)publicFlux<String>streamChat(@RequestParamStringmsg){returnchatClient.prompt().user(msg).stream().content();}// 带历史记忆(最实用)@GetMapping("/memory")publicStringchatWithMemory(@RequestParamStringsessionId,@RequestParamStringmsg){returnchatClient.prompt().system("你是一位精通Spring Boot和AI的高级架构师,用结构化markdown回答").user(msg).advisors(MessageChatMemoryAdvisor.builder().chatMemory(newInMemoryChatMemory()).build()).call().content();}}

方式二:本地私有化(Ollama + DeepSeek-R1)——适合内网/演示/毕设

步骤概览(2026最新流程)

  1. 安装 Ollama(官网一键安装)
  2. 拉取模型(显存够就直接上7B,显存少就用1.5B蒸馏版)
ollama run deepseek-r1:1.5b# 极轻量,1.5B蒸馏版,推理速度快# 或ollama run deepseek-r1:7b# 强推理,推荐16G+显存
  1. Spring Boot 配置(只需改下面几行)
spring:ai:ollama:base-url:http://localhost:11434# 本机默认chat:options:model:deepseek-r1:1.5b# 必须与ollama pull的tag一致

R1模型最大亮点:原生思维链(可以看到完整思考过程)

// 让R1把思考过程完整返回(效果非常震撼)Stringprompt=""" 请用最严谨的逻辑,一步一步思考并解决这个问题: xxx数学/算法/推理题xxx 请按照以下格式严格输出: <thinking> 完整的思考过程(多步、自我质疑、验证)... </thinking> <answer> 最终答案 </answer> """;chatClient.prompt(prompt).call().content();

快速进阶功能对比表(生产必备)

功能实现方式难度推荐指数
流式打字机效果.stream().content()★☆☆★★★★★
会话记忆MessageChatMemoryAdvisor★★☆★★★★★
RAG(知识库问答)+ PGVector / Milvus / Elasticsearch★★★★★★★★☆
Function Calling@Tool/FunctionCallback★★★★★★★☆
Agent(智能体)AiServices.create()★★★★★★★☆☆
结构化输出BeanOutputConverter / Json模式★★★★★★★☆
多模态(图文)目前DeepSeek暂不支持,需等待V3后续-★★☆☆☆

2026年一句话总结(最实用组合推荐)

生产环境首选
Spring Boot 3.3+ / Spring AI 1.0+

  • 硅基流动/DeepSeek官方 OpenAI兼容接口
  • deepseek-ai/DeepSeek-R1(复杂推理) / DeepSeek-V3(万能)
  • ChatClient流式 + MemoryAdvisor + 结构化输出

演示/学习/内网
Ollama + deepseek-r1:7b(或1.5b)

  • Spring AI Ollama starter

需要我针对某个具体场景(智能客服、RAG知识库、代码生成、Agent工具调用、结构化输出…)给出更详细的代码模板吗?
直接告诉我你的需求方向~ 😄

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/2 14:32:05

StretchSense获230万美元融资,推动XR训练手套全球扩张

StretchSense获230万美元融资&#xff0c;推动XR训练手套全球扩张 可穿戴技术公司StretchSense已成功筹集230万美元资金&#xff0c;本轮融资由PXN Ventures领投&#xff0c;某机构提供支持。该公司目前已通过三轮外部融资筹集了总计近2000万美元。 StretchSense成立于2012年&a…

作者头像 李华
网站建设 2026/9/2 23:43:23

2024最新大数据架构趋势:云原生与湖仓一体实战指南

2024大数据架构趋势深度解析&#xff1a;云原生与湖仓一体实战指南 一、引言&#xff1a;为什么说“云原生湖仓一体”是2024大数据的“必选项”&#xff1f; 1.1 一个真实的痛点&#xff1a;企业数据架构的“两难困境” 某零售企业的技术负责人最近很头疼&#xff1a; 数据分散…

作者头像 李华
网站建设 2026/9/2 22:53:36

大数据领域中 RabbitMQ 的消息压缩技术

大数据场景下RabbitMQ消息压缩实战:从原理到落地的全攻略 摘要/引言 在大数据时代,高吞吐量、大体积消息已成为RabbitMQ的常见挑战:比如电商系统的交易日志(每条10KB+)、物联网的传感器数据(每秒10万条)、数据同步中的全量备份(单条100KB+)。这些场景下,未压缩的消…

作者头像 李华
网站建设 2026/9/2 23:57:01

2. 训练 vs 推理:真正烧钱的是哪一步

作者&#xff1a;HOS(安全风信子) 日期&#xff1a;2026-01-17 来源平台&#xff1a;GitHub 摘要&#xff1a; 2026年&#xff0c;AI行业的成本结构已经发生根本性转变。本文通过云厂商真实数据揭示&#xff0c;推理的累计成本已超过训练10倍以上&#xff0c;成为真正烧钱的环节…

作者头像 李华
网站建设 2026/9/2 19:51:49

5. vLLM 出现前的推理地狱

作者&#xff1a;HOS(安全风信子) 日期&#xff1a;2026-01-17 来源平台&#xff1a;GitHub 摘要&#xff1a; 2023年vLLM出现之前&#xff0c;大模型推理面临着显存碎片化、低效调度和高延迟等诸多挑战&#xff0c;被称为"推理地狱"。本文通过回顾pre-vLLM时代的痛点…

作者头像 李华
网站建设 2026/9/2 21:30:55

7. 为什么云厂商集体选择 vLLM

作者&#xff1a;HOS(安全风信子) 日期&#xff1a;2026-01-17 来源平台&#xff1a;GitHub 摘要&#xff1a; 2026年&#xff0c;AWS、阿里云、字节跳动等全球顶级云厂商纷纷选择vLLM作为其大模型推理的核心框架。本文深入分析了云厂商集体选择vLLM的原因&#xff0c;包括高吞…

作者头像 李华