MCP Sampling Server 与 Client 实现
两种开发视角Server 与 Client 实现1. MCP Server发起 sampling主动调用 LLMtypescript运行// server 主动向client请求LLM生成 const result await client.request({ method: sampling/createMessage, params: { messages: [{ role: user, content: { type: text, text: 分析日志报错 } }], systemPrompt: 你是运维专家, maxTokens: 800, modelPreferences: { hints: [{ name: gemini-2.0-flash }] } } }); // result 就是标准 SamplingResult console.log(result.content.text, result.stopReason);2. MCP Client注册采样处理器你之前写的代码typescript运行// Client 注册接收 sampling/createMessage 的处理器 mcp.setRequestHandler(CreateMessageRequestSchema, async (request) { // 1. 预处理request.params.messages 所有对话 // 2. 调用本地LLMVercel AI SDK streamText/generateText // 3. 返回标准 SamplingResult 结构 return { role: assistant, model: gemini-2.0-flash, stopReason: endTurn, content: { type: text, text: 模型生成内容 } }; });你写的代码属于Client 侧采样拦截处理器负责接管所有sampling/createMessage请求对接 Gemini 完成生成。为什么负责接管所有 sampling/createMessage 请求因为sampling/createMessage本身就是 MCP 规范中 Server 向 Client 发起请你调用一个 LLM的唯一请求。当你注册mcp.setRequestHandler(CreateMessageRequestSchema, async (request) { ... });实际上是在告诉 MCP Client以后只要任何 MCP Server 发来sampling/createMessage请求都交给这个 handler 处理。所以它看起来像接管所有 sampling/createMessage 请求。MCP 的通信方向很多人第一次看都会觉得奇怪因为平时都是Client | | request v Server但是 Sampling 是反过来的。createMessage Server ---------------------- Client | | 调 LLM | ------------------------------- SamplingResult也就是说Server 不知道怎么调用 GPT、Gemini、Claude。它只知道Client请帮我生成一段文本。为什么不是 Server 自己调用这是 MCP 的设计。Server 负责工具。Client 负责模型。例如VS Code Copilot里面已经登录了 GitHub Copilot。已经有GPT-5ClaudeGemini的权限。MCP Server 根本不知道这些 API Key。于是 Server 发送{ method: sampling/createMessage, params: { messages: [ ... ] } }Client 收到以后哦 让我调用一下 Gemini。然后Gemini API ↓ 得到回复 ↓ 返回给 ServerServer 根本不知道 Gemini 的存在。setRequestHandler为什么能处理所有SDK 内部维护了一张method ↓ handler的映射。类似于handlers { sampling/createMessage: createMessageHandler, roots/listChanged: rootsHandler, logging/setLevel: loggingHandler, }当收到一条请求{ method: sampling/createMessage, ... }SDK 就会const handler handlers[sampling/createMessage]; await handler(request);所以mcp.setRequestHandler( CreateMessageRequestSchema, handler );实际上就是注册sampling/createMessage ↓ handler以后所有这个 Method 的请求都会进入这里。为什么说接管所有因为一个 Client 对于某个 Request Method 通常只能注册一个处理器。例如mcp.setRequestHandler( CreateMessageRequestSchema, handler1 ); mcp.setRequestHandler( CreateMessageRequestSchema, handler2 );通常第二个会覆盖第一个具体行为取决于 SDK 实现但一般不支持多个并行处理器。因此对于sampling/createMessage这一种请求Client 的这一处 handler 就是统一入口。在这里你可以async (request) { // ① 读取所有 messages const messages request.params.messages; // ② 做 Prompt 修改 ... // ③ 选择模型 ... // ④ 调用本地 LLM const result await generateText(...); // ⑤ 返回 SamplingResult return { role: assistant, model: ..., stopReason: endTurn, content: { type: text, text: result.text } }; }无论是哪一个 MCP Server 发起了sampling/createMessage请求只要它们连接到这个 Client都会经过这一入口。因此它不是“接管所有 MCP 请求”而是统一处理所有sampling/createMessage类型的请求。其他请求如tools/call、resources/read、prompts/get等仍然由各自对应的 handler 处理不会经过这个函数。

相关新闻

DeepSeek帮你做PPT:不是替代你思考,是帮你把思考表达出来

DeepSeek帮你做PPT:不是替代你思考,是帮你把思考表达出来

用DeepSeek做PPT,就像用计算器算账。计算器不会替你决定这笔钱该不该花,但它能让你把精力花在决策上,而不是加减乘除的运算上。二狗PPT基于DeepSeek做的也是这件事——它不替你想,它帮你说。 AI做PPT的常见误解 AI做PPT的常见误解…

2026/7/21 16:43:23 阅读更多 →
深入解析MCSPI控制器:从SPI协议基础到寄存器配置与驱动实战

深入解析MCSPI控制器:从SPI协议基础到寄存器配置与驱动实战

1. SPI通信协议基础与核心原理如果你在嵌入式领域摸爬滚打了一段时间,那么SPI(Serial Peripheral Interface)对你来说绝对不陌生。它就像电子设备之间说的一种“方言”,简单直接,效率极高。我最早接触SPI是在驱动一块F…

2026/7/21 16:43:23 阅读更多 →
“每天晚饭后7点散步30分钟。”

“每天晚饭后7点散步30分钟。”

一句简单的行动指令,背后其实包含了一个完整的人生系统设计。它看起来只是: “散步30分钟。”但它已经完成了从: 愿望 → 系统 → 行为 的转换。第一层:为什么这句话可以执行? 因为它包含了行动的五个要素:…

2026/7/21 16:43:23 阅读更多 →

最新新闻

Unity开发Pico4 MR应用:从环境搭建到核心功能实现

Unity开发Pico4 MR应用:从环境搭建到核心功能实现

1. 项目概述:为什么Pico4 MR是Unity开发者的新蓝海? 最近在开发者圈子里,Pico4 MR(混合现实)的热度持续攀升,尤其是结合Unity引擎进行实战开发。很多朋友问我,现在入局MR开发是不是一个好时机&a…

2026/7/21 21:17:44 阅读更多 →
RTX5060Ti 8G显卡性能解析与AI应用实测

RTX5060Ti 8G显卡性能解析与AI应用实测

1. RTX5060Ti 8G显卡核心参数解析作为NVIDIA在2025年推出的中高端显卡,RTX5060Ti 8G采用了全新的Ada Lovelace架构升级版,其核心代号为GN22-X6。从实测数据来看,这款显卡在1080P和2K分辨率下都能提供出色的游戏体验。基础频率为1560MHz&#…

2026/7/21 21:17:44 阅读更多 →
苹果与谷歌AI合作背后的技术博弈与行业影响

苹果与谷歌AI合作背后的技术博弈与行业影响

1. 事件背景:苹果AI战略的"矛盾"操作 2023年Q2季度财报电话会议上,苹果CEO蒂姆库克首次确认与谷歌达成协议,将在iPhone系统内置谷歌Gemini AI引擎。这一决定立即引发科技圈震动——作为全球研发投入最高的科技企业(2023…

2026/7/21 21:17:43 阅读更多 →
机器学习生产化:模型上线后的系统稳定性与治理实践

机器学习生产化:模型上线后的系统稳定性与治理实践

1. 项目概述:当模型走出笔记本,真正开始“呼吸”现实世界你有没有经历过这样的时刻?花了三个月时间调参、优化、交叉验证,AUC冲到0.92,老板拍着桌子说“这模型太棒了”,团队在Jupyter里跑通最后一个cell&am…

2026/7/21 21:17:43 阅读更多 →
React 18并发渲染机制与性能优化解析

React 18并发渲染机制与性能优化解析

1. React 18 核心架构变革:并发渲染机制深度解析 当React团队在2022年3月正式发布React 18时,最引人注目的变化莫过于全新的并发渲染(Concurrent Rendering)机制。这不仅仅是API层面的改进,而是React核心渲染模型的一次…

2026/7/21 21:17:43 阅读更多 →
Heapify高级技巧:如何优化大规模数据处理中的优先级调度

Heapify高级技巧:如何优化大规模数据处理中的优先级调度

Heapify高级技巧:如何优化大规模数据处理中的优先级调度 【免费下载链接】heapify The fastest JavaScript priority queue out there. Zero dependencies. 项目地址: https://gitcode.com/gh_mirrors/he/heapify 在当今数据驱动的世界中,优先级队…

2026/7/21 21:16:43 阅读更多 →

日新闻

Octane Render与C4D汉化版安装与优化指南

Octane Render与C4D汉化版安装与优化指南

1. Octane Render与C4D的黄金组合:为什么选择这个方案?在三维创作领域,渲染器的选择往往决定了作品的最终呈现质量和工作效率。作为Cinema 4D(C4D)用户,Octane Render的GPU加速特性与实时预览功能&#xff…

2026/7/21 0:00:19 阅读更多 →
GPMC接口设计:异步/同步模式与多路复用配置实战

GPMC接口设计:异步/同步模式与多路复用配置实战

1. GPMC接口设计:从硬件连接到软件配置的全局视角在嵌入式系统开发中,尤其是基于TI Sitara系列如AM263x这类高性能微控制器的项目里,外部存储器的扩展几乎是绕不开的一环。无论是存放大量非易失性代码的NOR Flash,还是作为高速数据…

2026/7/21 0:00:19 阅读更多 →
UE5 GAS框架下RPG被动技能系统:从核心原理到实战实现

UE5 GAS框架下RPG被动技能系统:从核心原理到实战实现

1. 项目概述:UE5 GAS RPG被动技能的核心价值在UE5里用GAS(Gameplay Ability System)做RPG游戏,主动技能像是你手里的武器,按一下打一下,逻辑直接,反馈也快。但被动技能,它更像是你身…

2026/7/21 0:00:19 阅读更多 →

周新闻

Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/21 8:48:31 阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/21 5:34:47 阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/21 8:25:39 阅读更多 →

月新闻