长路的AI领域技术博客汇总文档

前言

博主介绍:✌目前全网粉丝4W+,csdn博客专家、Java领域优质创作者,博客之星、阿里云平台优质作者、专注于Java后端技术领域。

涵盖技术内容:Java后端、大数据、算法、分布式微服务、中间件、前端、运维等。

博主所有博客文件目录索引:博客目录索引(持续更新)

CSDN搜索:长路

视频平台:b站-Coder长路

AI后端技术博客汇总文档

0)AI理论基础篇

1)AI大模型层

本地化部署

LM Studio
文章链接文章内容
LM Studio 本地部署大模型详解如何在Mac(M1/M2/M3/M4)用LM Studio零配置本地运行Llama、DeepSeek、Qwen等开源大模型,支持MLX极速格式与OpenAI兼容API,16GB内存即可流畅体验,全程离线保护隐私。
部署模型平台选型指南:LM Studio vs Xinference对比LM Studio与Xinference在大模型商业部署中的许可证、性能与扩展性差异,指出LM Studio因禁止大规模商用及缺乏生产级功能而不适合商业场景,Xinference凭借Apache 2.0协议与分布式架构成为企业安全高效部署开源大模型的首选,同时提醒务必审查模型许可证以确保合规。
VLLM
文章链接文章内容
快速了解VLLM推理引擎本文详细解释了Xinference作为模型部署平台与vLLM高性能推理引擎的关系。Xinference支持多种推理引擎(包括vLLM、SGLang、llama.cpp),通过统一的OpenAI兼容API提供灵活的模型服务。文章介绍了Xinference的工作原理、引擎选择策略及实际使用方法,并提供了完整的API测试命令和响应示例,帮助开发者在不同场景下选择最优推理方案。
LocalAI
文章链接文章内容
LocalAI快速本地部署大模型LocalAI是一款开源AI框架,可在本地电脑部署运行各类AI模型。文章介绍了其核心特点:隐私安全、成本效益、离线运行、兼容OpenAI接口、低硬件要求及多模型支持。详细说明了快速一键部署、Docker部署及Mac电脑部署方式,并提供了CPU机器全流程部署教程,帮助用户在消费级硬件上轻松运行大模型。

2)AI应用层

向量数据库

Milvus
文章链接文章内容
Milvus向量库Java对接使用指南系统梳理Milvus向量数据库的核心概念与实战技巧,涵盖Collection Schema设计、索引类型选型、内存估算、过滤/分组/混合搜索调优及MilvusClientV2升级注意事项,助力高召回低延迟的向量检索落地。
快速本地部署搭建milvus向量数据库本文详细介绍了Milvus向量数据库的完整部署流程,包括Docker镜像代理配置、docker-compose.yml文件下载、密码设置、服务启动及可视化工具Attu的安装使用。文章提供了具体的配置步骤和命令,涵盖了Web UI访问、数据管理操作以及查询表达式编写,帮助开发者快速搭建和管理向量数据库环境。
Milvus系列之01、Spring boot快速集成Milvus本文详细介绍了如何在SpringBoot项目中快速集成Milvus向量数据库,实现RAG(检索增强生成)应用。内容涵盖Milvus集合加载、Schema定义、向量索引配置及完整的CRUD操作实现,提供了从基础搭建到实战应用的完整技术方案。
Milvus系列之02、Spring+Milvus实现RAG检索增强本文详细介绍了企业知识库构建中的关键步骤:使用Apache Tika解析多格式文档,通过HanLP和LangChain4j实现智能文本分片,最终将分割后的文本向量化存储到Milvus向量数据库。同时介绍了Spring AI的Advisors API在RAG(检索增强生成)中的应用,实现大模型与向量数据库的无缝集成。

ai框架

langchain4j(Java实现)
文章链接文章内容
01、LangChain4j 系统化知识学习笔记(接入模型、AiService、持久化记忆、增强RAG)LangChain4j简化大语言模型与Java集成,支持多种大模型,提供便捷API,助力智能应用开发。
02、Langchain4j tools原理与核心实践(含自定义http插件)本文详解LangChain4j中Function Calling的四种实现方式:注解快速集成、手动注册Tools、自定义ToolSpecification及HTTP插件扩展。涵盖Spring Boot整合、源码原理剖析与Serper搜索插件实战,提供完整代码示例与前端对接方案,助力开发者构建具备工具调用能力的AI智能体。
03、LangChain4j的stream流式tool前后机制调用深入解析LangChain4j流式调用场景下的Tool工具调用机制,涵盖AiServiceStreamingResponseHandler执行逻辑、同步/异步执行模式、beforeToolExecutionHandler与toolExecutionHandler前后钩子处理流程及Handler初始化机制。
04、LangChain4j快速对接VL视觉理解模型本文详细介绍了如何使用LangChain4j框架对接阿里云qwen3-vl-plus视觉理解模型,支持图片URL和本地文件两种多模态交互方式,包含完整的Java代码示例与iflow平台免费模型调用实践。
Spring AI(Java框架)
文章链接文章内容
SpringAI快速搭建mcp sse client & server服务本文详细介绍了基于Spring AI的MCP(Model Context Protocol)SSE Server服务构建方案,重点介绍了如何快速搭建基于WebFlux的MCP Server与Client服务。详细展示了Tools工具实现、配置文件设置、以及完整的链路追踪验证过程,为Java AI Agent系统提供了MCP协议集成的完整技术方案。
Spring Ai alibaba(Java框架)

jmanus:

文章链接文章内容
spring ai alibaba-jmanus 智能体动态问答全流程梳理本文详细解析了JManus智能体平台的架构与实现原理,重点介绍了基于Spring AI Alibaba的OpenManus Java实现。详细梳理了计划创建、任务执行和链路追踪的完整流程,包括DynamicAgent的think/act循环机制、工具调用策略以及terminate终止条件,为AI Agent系统的开发提供了完整的参考架构。
langchain(Python实现)
Qwen-Agent(Python实现)
文章链接文章内容
Qwen-Agent 开源项目理解学习本文深入探讨了Qwen3-14B-AWQ量化模型的function calling实现问题,分析了AWQ量化技术对模型精确格式输出的影响,并提供了基于xinference和LocalAI的部署方案对比。重点介绍了如何通过正确的参数配置和prompt设计实现可靠的工具调用功能,为中文大模型应用提供了实践指导。

一站式开发平台

dify(开源平台)
文章链接文章内容
dify系列之01、快速本地一键搭建dify本文详细介绍了Dify AI工作流平台的部署方案,包括不同配置级别的资源需求、Docker环境配置、国内镜像优化以及快速启动步骤。重点讲解了如何在本地或云服务器上搭建Dify环境,实现LLMOps全流程管理,适用于企业团队协作和生产环境部署。

3)Agent中间层

理论篇

文章链接文章内容
何为ReAct模式 & Plan+Act框架深度解析Manus多智能体框架如何借ReAct模式破解复杂任务“工具乱舞”难题,实现Thought-Act-Observation循环,端到端成功率提升4-6倍,并给出LangChain4j落地示例与开源替代方案。

造轮子篇

AI Chat项目
前端优化篇
文章链接文章内容
优化篇之AI Chat响应换行渲染效果不生效本文解决了AI对话框中JSON内容展示时换行失效的问题,通过在前端对换行符进行处理,确保JSON格式在Markdown渲染器中正确显示,提升用户体验。
Agent中间层设计实现
通用Agent设计:ReAct Agent设计
文章链接文章内容
长任务场景下 ReAct Agent 的可靠终止机制设计与实现本文深入剖析ReAct框架的历史设计缺陷,提出通过封装FinishTool优化长任务停止判断机制。详细讲解系统提示词设计、AI消息检测逻辑及AgentSettings参数配置,帮助开发者解决AI Agent在长任务场景中无法可靠终止的问题。
Agent插件设计实现

对接HTTP接口:

文章链接文章内容
适配AI平台的HTTP插件系统设计本文详细介绍了基于LangChain4j的AI插件系统设计与实现,重点展示了如何通过HTTP接口快速构建插件工具并集成到AI大模型中。详细讲解了从语雀文档知识库对接到联网搜索插件的实战案例,包括插件配置、CURL解析器实现、以及与AI多轮对话的function calling机制,为AI Agent系统提供了完整的插件化解决方案。

实战项目篇

手写实战项目篇
文章链接文章内容
langchain4j+ai模型 硅谷小智 智慧医疗实战项目案例本文详细讲解基于Java+LangChain4j框架构建医疗AI智能体硅谷小智的完整实现,涵盖通义千问模型接入、MongoDB记忆持久化、Function Calling预约功能、Pinecone向量数据库RAG增强及流式输出等核心技术,提供从0到1的企业级大模型应用开发实战指南。

4)AI前置数据预训练处理

data-juicer

文章链接文章内容
data-juicer篇-01、认识一站式数据处理系统 data-juicer本文详细介绍了Data-Juicer多模态数据处理系统的设计原理与实现,对比了与火山引擎算子的定位差异,重点阐述了其在LLM训练数据准备中的核心价值。详细分析了系统架构、算子体系、分布式处理等关键技术,以及在ModelScope-Sora计划中的应用成效,为AI数据处理提供了完整的多模态解决方案。
data-juicer篇-02、初步使用data-juicer本文详细介绍了Data-Juicer的安装配置和使用方法,通过创建虚拟环境、配置Python环境以及完整的Demo演示展示了数据清洗流程。重点介绍了如何通过配置文件定义数据处理流程,实现文本清理、去重、长度过滤和语言识别等功能,为LLM训练数据准备提供了完整的实践指南。

资料获取

大家点赞、收藏、关注、评论啦~

精彩专栏推荐订阅:在下方专栏👇🏻

更多博客与资料可查看👇🏻获取联系方式👇🏻,🍅文末获取开发资源及更多资源博客获取🍅

Logo

腾讯云面向开发者汇聚海量精品云计算使用和开发经验,营造开放的云计算技术生态圈。

更多推荐