CSDN 全文镜像
这里收录作者 CSDN 博客最新 30 篇公开文章的站内全文镜像。正文主体保持原文内容,站内仅增加 Frontmatter、来源说明和分区索引,方便按照本站的 LLM 学习地图继续阅读。
阅读建议
镜像文章按原文发布时间排序,并按主题归入 Agent、Prompt、RAG、MCP、Training、Multimodal 与工程实践。若你想系统学习,建议先读所在模块的概述页,再读对应镜像文章。
最新 30 篇总表
Agent
什么是 BFF?从前后端解耦到微服务与 Agent 架构中的实践
- 原文日期:2026-08-26
- 主题归类:BFF 与 Agent 架构
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/164094876
- 摘要:BFF 并不是什么复杂的新技术。前端需要的数据,与后端提供的业务能力之间存在天然差异。Frontend↓BackendFrontend↓十几个 Microservices服务发现接口聚合数据转换异常处理权限拼装业务编排系统边界会越来越混乱。Frontend↓BFF↓Gateway……
Agent 到底该怎么评?从 RAG 指标到科学的 Agent Evaluation 体系
- 原文日期:2026-08-26
- 主题归类:Agent Evaluation
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/164094411
- 摘要:这个 Agent 到底怎样才算完成任务?case:input:messages:content: "帮我退掉订单 A123"order🆔 A123expected:outcome:required:forbidden:response:- 应告知用户需要退货- 不得承诺立即……
从 Agent Run 到 Agent LongTask:以 Coding Agent 为例理解长时复杂任务的执行架构
- 原文日期:2026-08-12
- 主题归类:Agent LongTask
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163697628
- 摘要:摘要:Agent LongTask 与普通 Agent Run 的本质区别 本文深入探讨了 Agent 系统中 LongTask 与普通 Run 的核心差异。关键结论是:LongTask 并非简单的时间延长版 Agent Run,而是系统执行抽象的质变。 核心区别: 关注点不同:……
从 Subagent 到 MAS:深入理解多 Agent 协作、任务分工与并行执行
- 原文日期:2026-08-12
- 主题归类:Subagent 与 MAS
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163701731
- 摘要:本文讨论了Agent系统中的三个关键概念:Subagent(子智能体)、MAS(多智能体系统)和Multi-Agent Parallelism(多智能体并行)。Subagent指由主Agent委派执行边界清晰的子任务,并返回结果的智能体,其核心价值在于Context Isolat……
为什么流式接口经常返回 streamUrl:从一次 Agent 请求理解流式任务架构
- 原文日期:2026-08-10
- 主题归类:Agent Stream URL
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163633108
- 摘要:文章摘要:文章探讨了复杂Agent系统中streamUrl的设计原理。传统聊天系统采用单请求流式响应,而Agent系统将任务创建(POST /runs)与事件订阅(GET /events)分离,通过streamUrl实现执行与观察的解耦。这种架构支持任务后台持续运行,允许页面刷新……
深入理解 Agent Runtime:智能体真正运行起来的核心执行引擎
- 原文日期:2026-08-10
- 主题归类:Agent Runtime
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163638436
- 摘要:文章摘要: Agent Runtime 是大模型应用的核心执行系统,负责管理 Agent 任务的完整生命周期,而不仅仅是简单的“LLM + Tool”调用。生产级 Agent 任务可能涉及多工具调用、子任务协调、人工审批、上下文管理等复杂流程,需要 Runtime 提供状态控制……
从 Chat UI 到 Agent UI:如何设计一个真正可用的智能体交互界面
- 原文日期:2026-08-05
- 主题归类:Agent UI
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163493846
- 摘要:文章摘要: 随着AI Agent的发展,传统聊天界面(Chat UI)已无法满足复杂任务需求。本文分析了Chat UI与Agent UI的本质差异:Chat UI围绕消息展开,适合简单问答;而Agent UI需处理持续运行的任务执行过程,涉及计划制定、工具调用、用户确认等多个环节……
Agent 对话中的 SSE 状态恢复:切换页面、重新进入与刷新后如何继续流式输出
- 原文日期:2026-08-04
- 主题归类:Agent SSE 状态恢复
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163478430
- 摘要:本文探讨了AI Agent对话系统中SSE(Server-Sent Events)的设计挑战与解决方案。主要问题在于如何应对用户切换会话、页面刷新、网络中断等场景导致的状态丢失问题。作者提出"快照+事件日志+实时流"的三层架构:通过数据库快照恢复完整状态,事件日志补发断线事件,S……
OpenAI-wire 与 Anthropic-wire 的差异:从 Function Calling 协议看 Agent 框架的 Provider 适配设计
- 原文日期:2026-05-19
- 主题归类:Provider 工具调用适配
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/161193006
- 摘要:摘要 本文探讨了AI Agent框架中不同大模型厂商工具调用格式的差异问题。OpenAI和Anthropic采用完全不同的消息格式(分别称为OpenAI-wire和Anthropic-wire),主要差异体现在工具调用的放置位置、参数格式、消息角色定义等方面。为保持Agent核心……
AI Agent 工程化实践:Skill as Prompt 与渐进式加载机制
- 原文日期:2026-05-19
- 主题归类:Skill as Prompt
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/161198674
- 摘要:本文探讨了AI Agent系统中Prompt管理失控的问题,并提出Skill体系解决方案。传统方式将所有能力集中在一个系统Prompt中,导致上下文浪费、能力污染等问题。Skill体系将能力拆分为独立模块,每个Skill包含元数据和提示词正文,采用渐进式披露原则按需加载。这种设计……
大语言模型智能体架构深度解析:为什么必须通过 Tool Result 注入外部数据而非篡改 System Prompt
- 原文日期:2026-03-17
- 主题归类:Tool Result 注入
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/159167780
- 摘要:摘要: 大语言模型(LLM)智能体设计中,工具执行结果(Tool Result)不应直接拼接至系统提示词(System Prompt),而是需通过标准 tool_result 注入。这一架构原则基于以下核心原因: 分词器与注意力机制:系统提示词和工具结果在底层分词时被赋予不同控制……
Ralph 架构深度解析报告:自主代理循环与软件工程的确定性重构
- 原文日期:2026-02-03
- 主题归类:Ralph 自主代理循环
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/157689181
- 摘要:《Ralph架构:AI自主编程的范式革新》摘要 Ralph架构代表AI辅助编程从"副驾驶"到"自主代理"的范式转移。该开源架构通过无限循环和即时反馈机制,使AI能独立完成需求分析、编码、测试到提交的全流程。其核心创新包括: 1)"Human-on-the-loop"模式,人类仅定……
构建下一代语境感知型 AI Agent:AGENTS.md 与 SKILL.md 发现系统的深度工程架构报告
- 原文日期:2026-02-03
- 主题归类:AGENTS 与 SKILL 发现
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/157685083
- 摘要:摘要: Agent技术正从对话式转向自主行动能力,其效能核心在于项目语境获取。行业通过标准化协议解决"语境孤岛"问题:AGENTS.md定义治理规则(宪法),SKILL.md封装可执行能力(技能包)。报告详细解析了构建此类Agent的完整技术路线,包括文件系统遍历、AST解析、M……
Prompt
GEO 到底怎么做?从 Prompt 研究到 AI Citation 的完整落地方法
- 原文日期:2026-08-24
- 主题归类:GEO 与 AI Citation
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/164029172
- 摘要:用户真正会问什么?↓AI 现在怎么回答?↓AI 为什么引用这些 Source?↓为什么竞争对手有,我没有?↓↓修改之后重新跑 Dataset↓Research↓Measure↓Analyze↓Optimize↓Evaluate↓Learn↓Repeat这才是我认为目前最合理的 G……
从 SEO 到 GEO:当搜索引擎开始直接回答问题,内容优化发生了什么?
- 原文日期:2026-08-24
- 主题归类:SEO 到 GEO
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/164025027
- 摘要:SEO 是让机器找到你。GEO 是机器找到你以后,愿不愿意选择你。因此真正值得研究的,并不是:怎么在文章里多塞几个 GEO 技巧?为什么当 AI 需要回答这个问题的时候,我应该成为它最值得使用的信息源之一?最终决定这件事情的,很可能并不是某一个神奇标签、某一个关键词密度,或者某一……
大模型输出 JSON 不完整怎么办?从 Prompt 问题到工程稳定性治理
- 原文日期:2026-07-09
- 主题归类:结构化输出稳定性
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/162718633
- 摘要:文章摘要:大模型输出JSON不完整是一个常见的工程稳定性问题,表现为语法不完整或内容缺失。原因包括输出长度限制、输入上下文过长、Schema设计复杂等。解决方案需从多层面治理:优先使用结构化输出能力,避免一次性生成大JSON,建立JSON修复机制,设计Schema校验,实施业务完……
RAG
RAG 优化实践:别让分块毁掉你的知识库
- 原文日期:2026-06-10
- 主题归类:RAG 文档分块
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/161868156
- 摘要:RAG优化实践:保护Markdown文档结构的三个关键点 本文针对RAG系统中Markdown文档处理面临的三大问题提出解决方案: 表格截断问题:提出"原子语义块"概念,建议小表格整体保留,大表格按行分组并重复表头,同时生成语义摘要辅助检索。 代码块丢失问题:强调代码块应整体识别……
新一代知识图谱与检索增强生成技术全景解析
- 原文日期:2026-04-03
- 主题归类:知识图谱与 RAG
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/159792606
- 摘要:摘要 本文探讨了新一代检索增强生成(RAG)技术如何通过知识图谱与本体论优化解决传统RAG的局限性。GraphRAG利用层次化社区发现实现全局检索,LightRAG通过双层网络兼顾效率与推理能力,KAG则专注于专业领域的逻辑推理。文章对比了各架构在计算成本、动态更新等方面的表现……
MCP
从 LSP 到 MCP、ACP:AI Agent 时代的协议体系设计详解
- 原文日期:2026-05-20
- 主题归类:Agent 协议体系
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/161224325
- 摘要:AI Agent 时代,协议会变得越来越重要。AI ClientIDEAgentToolResourcePrompt这些组件之间如果没有统一协议,就会变成大量脆弱的胶水代码。JSON-RPC:消息格式底座stdio / HTTP / SSE:传输方式LSP:IDE 调语言能力MC……
Training
从一次请求到整套推理集群:彻底理解大模型的 QPS、TPM、并发与性能指标
- 原文日期:2026-08-05
- 主题归类:大模型推理指标
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163510719
- 摘要:摘要:大模型性能指标解析 本文系统阐述了大模型服务中的关键性能指标及其相互关系。核心内容包括: 请求生命周期:大模型请求经历Prefill(处理输入)和Decode(生成输出)两个关键阶段,分别影响首字延迟和输出流畅度。 业务压力指标: QPS/RPM反映请求数量,但需结合平均T……
对象存储架构演进与AI大模型时代的深度融合:从S3基础到万亿参数训练的技术全景
- 原文日期:2026-02-02
- 主题归类:对象存储与 AI 训练
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/157654512
- 摘要:摘要: 生成式AI和大语言模型的爆发推动云计算基础设施转向对象存储(如Amazon S3),其无限扩展性和扁平化命名空间更适配AI工作负载的I/O特征。相比传统块存储和文件存储,对象存储解决了海量小文件的元数据瓶颈,并通过强一致性模型支持分布式训练。报告深入解析了S3的架构创新……
Multimodal
实时 3D 数字人落地全记录:SDK 深拆、接大模型、7 个坑、开源工程一键部署
- 原文日期:2026-08-17
- 主题归类:实时 3D 数字人
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163828282
- 摘要:本文介绍了如何利用魔珐星云具身驱动SDK实现"会说话的3D数字人"项目。核心采用"参数流+AI端渲"架构,通过下发音频、表情、动作等多路参数实现本地实时渲染,具有低延迟、轻量化的优势。文章详细解析了speak接口的流式调用、SSML动作控制、事件系统、状态管理、签名鉴权等关键技术……
5 分钟,让网页里站着一个会说话的 3D 数字人
- 原文日期:2026-08-17
- 主题归类:网页 3D 数字人
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163828144
- 摘要:本文介绍了如何通过魔珐星云SDK在网页中实时渲染3D数字人,实现文本驱动语音、表情和动作同步。主要内容包括:效果展示(非预录视频,而是实时AI渲染)、接入步骤(引入SDK、创建实例、调用speak方法)、开源控制台项目封装(支持即兴对话/舞蹈/流式播报等交互功能),以及技术优势(……
工程实践
从分布式系统到 Celery + Redis:一篇文章讲清异步任务工作流程
- 原文日期:2026-08-04
- 主题归类:异步任务架构
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163476127
- 摘要:异步任务处理:Celery + Redis 解决方案 本文介绍了在Web系统中处理耗时任务的异步解决方案。传统同步模式在处理PDF解析、OCR识别、批量邮件等长时间任务时存在超时、连接断开和服务阻塞等问题。通过Celery和Redis构建的分布式任务系统可以有效解决这些问题: 核……
Playwright 深度解析:从浏览器自动化到动态爬虫、自动化测试与 AI Agent
- 原文日期:2026-07-30
- 主题归类:Playwright 自动化
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163335924
- 摘要:Playwright 是一个由微软开发的开源浏览器自动化框架,支持Chromium、Firefox和WebKit三大浏览器引擎,提供多语言接口。它不仅能用于Web自动化测试,还能处理动态网页采集、自动登录、iframe操作等复杂场景。相比传统爬虫工具,Playwright能模拟真……
数据库连接池详解:从连接复用、参数配置到生产故障排查
- 原文日期:2026-07-28
- 主题归类:数据库连接池
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/163277365
- 摘要:应用程序想要访问 MySQL、PostgreSQL 等数据库,首先需要建立一条数据库连接。创建 TCP 连接;完成数据库协议握手;进行用户名和密码认证;初始化会话状态;设置字符集、时区、事务隔离级别等参数;等待应用发送 SQL;执行 SQL 并返回结果。但这一行代码背后,实际上发……
文件上传一致性:为什么对象存储直传不是一个简单的 Upload 接口
- 原文日期:2026-07-07
- 主题归类:对象存储直传一致性
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/162658023
- 摘要:文件上传一致性问题与对象存储直传架构解析 摘要 本文深入探讨了文件上传服务在生产环境中的复杂性,指出对象存储直传架构下的核心挑战。文章分析了数据库与对象存储的分工(前者保存元数据与状态,后者存储文件内容),重点阐述了直传模式下的关键问题:数据库事务无法回滚对象存储操作,导致潜在不……
一个 URL 参数,为什么可能打穿你的内网?
- 原文日期:2026-06-10
- 主题归类:SSRF 安全
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/161862209
- 摘要:SSRF,全称是 Server-Side Request Forgery,中文通常叫“服务端请求伪造”。它的核心问题是:攻击者无法直接访问某个目标资源,但可以诱导服务端替他访问。用户输入 URL↓服务端请求该 URL↓服务端把内容返回给用户攻击者↓业务服务器↓内网服务 / 本机端……
现代文件上传架构权威指南:从二进制流到分布式对象存储的深度剖析
- 原文日期:2026-02-02
- 主题归类:文件上传架构
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/157654994
- 摘要:《文件上传技术的深度解析与架构设计》摘要:本文深入探讨了文件上传在互联网基础设施中的复杂性与技术挑战。从HTTP协议层分析了传统编码方式的效率瓶颈,详细解读了multipart/form-data标准及其边界检测算法。重点阐述了服务器端流式处理架构设计,包括内存管理优化、TCP背……
权威指南:企业级文档权限管理架构深度解析——从 ACL 到 RBAC 及未来的演进
- 原文日期:2026-02-02
- 主题归类:权限管理架构
- 原文链接:https://blog.csdn.net/m0_63309778/article/details/157654566
- 摘要:摘要 本文系统探讨了企业文档权限管理的技术演进与核心机制。从基础权限三要素(主体、客体、操作)出发,深入剖析了ACL与RBAC两大模型的原理及实现:NTFS通过安全描述符和ACE实现精细控制但面临管理复杂性;Linux ACL创新引入掩码机制;而RBAC通过角色抽象层解决了大规模……