长路的AI领域技术博客汇总文档
·
前言
博主介绍:✌目前全网粉丝4W+,csdn博客专家、Java领域优质创作者,博客之星、阿里云平台优质作者、专注于Java后端技术领域。
涵盖技术内容:Java后端、大数据、算法、分布式微服务、中间件、前端、运维等。
博主所有博客文件目录索引:博客目录索引(持续更新)
CSDN搜索:长路
视频平台:b站-Coder长路
AI后端技术博客汇总文档
0)AI理论基础篇
1)AI大模型层
本地化部署
LM Studio
| 文章链接 | 文章内容 | |
|---|---|---|
| LM Studio 本地部署大模型 | 详解如何在Mac(M1/M2/M3/M4)用LM Studio零配置本地运行Llama、DeepSeek、Qwen等开源大模型,支持MLX极速格式与OpenAI兼容API,16GB内存即可流畅体验,全程离线保护隐私。 | |
| 部署模型平台选型指南:LM Studio vs Xinference | 对比LM Studio与Xinference在大模型商业部署中的许可证、性能与扩展性差异,指出LM Studio因禁止大规模商用及缺乏生产级功能而不适合商业场景,Xinference凭借Apache 2.0协议与分布式架构成为企业安全高效部署开源大模型的首选,同时提醒务必审查模型许可证以确保合规。 |
VLLM
| 文章链接 | 文章内容 |
|---|---|
| 快速了解VLLM推理引擎 | 本文详细解释了Xinference作为模型部署平台与vLLM高性能推理引擎的关系。Xinference支持多种推理引擎(包括vLLM、SGLang、llama.cpp),通过统一的OpenAI兼容API提供灵活的模型服务。文章介绍了Xinference的工作原理、引擎选择策略及实际使用方法,并提供了完整的API测试命令和响应示例,帮助开发者在不同场景下选择最优推理方案。 |
LocalAI
| 文章链接 | 文章内容 |
|---|---|
| LocalAI快速本地部署大模型 | LocalAI是一款开源AI框架,可在本地电脑部署运行各类AI模型。文章介绍了其核心特点:隐私安全、成本效益、离线运行、兼容OpenAI接口、低硬件要求及多模型支持。详细说明了快速一键部署、Docker部署及Mac电脑部署方式,并提供了CPU机器全流程部署教程,帮助用户在消费级硬件上轻松运行大模型。 |
2)AI应用层
向量数据库
Milvus
| 文章链接 | 文章内容 |
|---|---|
| Milvus向量库Java对接使用指南 | 系统梳理Milvus向量数据库的核心概念与实战技巧,涵盖Collection Schema设计、索引类型选型、内存估算、过滤/分组/混合搜索调优及MilvusClientV2升级注意事项,助力高召回低延迟的向量检索落地。 |
| 快速本地部署搭建milvus向量数据库 | 本文详细介绍了Milvus向量数据库的完整部署流程,包括Docker镜像代理配置、docker-compose.yml文件下载、密码设置、服务启动及可视化工具Attu的安装使用。文章提供了具体的配置步骤和命令,涵盖了Web UI访问、数据管理操作以及查询表达式编写,帮助开发者快速搭建和管理向量数据库环境。 |
| Milvus系列之01、Spring boot快速集成Milvus | 本文详细介绍了如何在SpringBoot项目中快速集成Milvus向量数据库,实现RAG(检索增强生成)应用。内容涵盖Milvus集合加载、Schema定义、向量索引配置及完整的CRUD操作实现,提供了从基础搭建到实战应用的完整技术方案。 |
| Milvus系列之02、Spring+Milvus实现RAG检索增强 | 本文详细介绍了企业知识库构建中的关键步骤:使用Apache Tika解析多格式文档,通过HanLP和LangChain4j实现智能文本分片,最终将分割后的文本向量化存储到Milvus向量数据库。同时介绍了Spring AI的Advisors API在RAG(检索增强生成)中的应用,实现大模型与向量数据库的无缝集成。 |
ai框架
langchain4j(Java实现)
| 文章链接 | 文章内容 |
|---|---|
| 01、LangChain4j 系统化知识学习笔记(接入模型、AiService、持久化记忆、增强RAG) | LangChain4j简化大语言模型与Java集成,支持多种大模型,提供便捷API,助力智能应用开发。 |
| 02、Langchain4j tools原理与核心实践(含自定义http插件) | 本文详解LangChain4j中Function Calling的四种实现方式:注解快速集成、手动注册Tools、自定义ToolSpecification及HTTP插件扩展。涵盖Spring Boot整合、源码原理剖析与Serper搜索插件实战,提供完整代码示例与前端对接方案,助力开发者构建具备工具调用能力的AI智能体。 |
| 03、LangChain4j的stream流式tool前后机制调用 | 深入解析LangChain4j流式调用场景下的Tool工具调用机制,涵盖AiServiceStreamingResponseHandler执行逻辑、同步/异步执行模式、beforeToolExecutionHandler与toolExecutionHandler前后钩子处理流程及Handler初始化机制。 |
| 04、LangChain4j快速对接VL视觉理解模型 | 本文详细介绍了如何使用LangChain4j框架对接阿里云qwen3-vl-plus视觉理解模型,支持图片URL和本地文件两种多模态交互方式,包含完整的Java代码示例与iflow平台免费模型调用实践。 |
Spring AI(Java框架)
| 文章链接 | 文章内容 |
|---|---|
| SpringAI快速搭建mcp sse client & server服务 | 本文详细介绍了基于Spring AI的MCP(Model Context Protocol)SSE Server服务构建方案,重点介绍了如何快速搭建基于WebFlux的MCP Server与Client服务。详细展示了Tools工具实现、配置文件设置、以及完整的链路追踪验证过程,为Java AI Agent系统提供了MCP协议集成的完整技术方案。 |
Spring Ai alibaba(Java框架)
jmanus:
| 文章链接 | 文章内容 |
|---|---|
| spring ai alibaba-jmanus 智能体动态问答全流程梳理 | 本文详细解析了JManus智能体平台的架构与实现原理,重点介绍了基于Spring AI Alibaba的OpenManus Java实现。详细梳理了计划创建、任务执行和链路追踪的完整流程,包括DynamicAgent的think/act循环机制、工具调用策略以及terminate终止条件,为AI Agent系统的开发提供了完整的参考架构。 |
langchain(Python实现)
Qwen-Agent(Python实现)
| 文章链接 | 文章内容 |
|---|---|
| Qwen-Agent 开源项目理解学习 | 本文深入探讨了Qwen3-14B-AWQ量化模型的function calling实现问题,分析了AWQ量化技术对模型精确格式输出的影响,并提供了基于xinference和LocalAI的部署方案对比。重点介绍了如何通过正确的参数配置和prompt设计实现可靠的工具调用功能,为中文大模型应用提供了实践指导。 |
一站式开发平台
dify(开源平台)
| 文章链接 | 文章内容 |
|---|---|
| dify系列之01、快速本地一键搭建dify | 本文详细介绍了Dify AI工作流平台的部署方案,包括不同配置级别的资源需求、Docker环境配置、国内镜像优化以及快速启动步骤。重点讲解了如何在本地或云服务器上搭建Dify环境,实现LLMOps全流程管理,适用于企业团队协作和生产环境部署。 |
3)Agent中间层
理论篇
| 文章链接 | 文章内容 |
|---|---|
| 何为ReAct模式 & Plan+Act框架 | 深度解析Manus多智能体框架如何借ReAct模式破解复杂任务“工具乱舞”难题,实现Thought-Act-Observation循环,端到端成功率提升4-6倍,并给出LangChain4j落地示例与开源替代方案。 |
造轮子篇
AI Chat项目
前端优化篇
| 文章链接 | 文章内容 |
|---|---|
| 优化篇之AI Chat响应换行渲染效果不生效 | 本文解决了AI对话框中JSON内容展示时换行失效的问题,通过在前端对换行符进行处理,确保JSON格式在Markdown渲染器中正确显示,提升用户体验。 |
Agent中间层设计实现
通用Agent设计:ReAct Agent设计
| 文章链接 | 文章内容 |
|---|---|
| 长任务场景下 ReAct Agent 的可靠终止机制设计与实现 | 本文深入剖析ReAct框架的历史设计缺陷,提出通过封装FinishTool优化长任务停止判断机制。详细讲解系统提示词设计、AI消息检测逻辑及AgentSettings参数配置,帮助开发者解决AI Agent在长任务场景中无法可靠终止的问题。 |
Agent插件设计实现
对接HTTP接口:
| 文章链接 | 文章内容 |
|---|---|
| 适配AI平台的HTTP插件系统设计 | 本文详细介绍了基于LangChain4j的AI插件系统设计与实现,重点展示了如何通过HTTP接口快速构建插件工具并集成到AI大模型中。详细讲解了从语雀文档知识库对接到联网搜索插件的实战案例,包括插件配置、CURL解析器实现、以及与AI多轮对话的function calling机制,为AI Agent系统提供了完整的插件化解决方案。 |
实战项目篇
手写实战项目篇
| 文章链接 | 文章内容 |
|---|---|
| langchain4j+ai模型 硅谷小智 智慧医疗实战项目案例 | 本文详细讲解基于Java+LangChain4j框架构建医疗AI智能体硅谷小智的完整实现,涵盖通义千问模型接入、MongoDB记忆持久化、Function Calling预约功能、Pinecone向量数据库RAG增强及流式输出等核心技术,提供从0到1的企业级大模型应用开发实战指南。 |
4)AI前置数据预训练处理
data-juicer
| 文章链接 | 文章内容 |
|---|---|
| data-juicer篇-01、认识一站式数据处理系统 data-juicer | 本文详细介绍了Data-Juicer多模态数据处理系统的设计原理与实现,对比了与火山引擎算子的定位差异,重点阐述了其在LLM训练数据准备中的核心价值。详细分析了系统架构、算子体系、分布式处理等关键技术,以及在ModelScope-Sora计划中的应用成效,为AI数据处理提供了完整的多模态解决方案。 |
| data-juicer篇-02、初步使用data-juicer | 本文详细介绍了Data-Juicer的安装配置和使用方法,通过创建虚拟环境、配置Python环境以及完整的Demo演示展示了数据清洗流程。重点介绍了如何通过配置文件定义数据处理流程,实现文本清理、去重、长度过滤和语言识别等功能,为LLM训练数据准备提供了完整的实践指南。 |
资料获取
大家点赞、收藏、关注、评论啦~
精彩专栏推荐订阅:在下方专栏👇🏻
- 长路-文章目录汇总(算法、后端Java、前端、运维技术导航):博主所有博客导航索引汇总
- 开源项目Studio-Vue—校园工作室管理系统(含前后台,SpringBoot+Vue):博主个人独立项目,包含详细部署上线视频,已开源
- 学习与生活-专栏:可以了解博主的学习历程
- 算法专栏:算法收录
更多博客与资料可查看👇🏻获取联系方式👇🏻,🍅文末获取开发资源及更多资源博客获取🍅
更多推荐
所有评论(0)