共5篇
文章标签:AI
人工智能
给文本模型装上眼睛:用 Skill 委托视觉识别图片
纯文本大模型看不见图片,但把看图封装成一个 Skill、委托给外部视觉模型,就能让它参与图像任务。本文给出一个零依赖的 Python 实现与配置方法,并用一次真实的三方对比实验——原生多模态、Skill 委托视觉、程序化验证——分析这种方案的能力边界:委托视觉...
纯文本大模型看不见图片,但把看图封装成一个 Skill、委托给外部视觉模型,就能让它参与图像任务。本文给出一个零依赖的 Pyth...
AI Agent 评测,到底在测什么?
从能力边界、稳定性、安全性、成本效益四个维度,聊聊如何科学地评测一个 AI Agent,而不是靠感觉。
从能力边界、稳定性、安全性、成本效益四个维度,聊聊如何科学地评测一个 AI Agent,而不是靠感觉。
MCP 协议无状态化:从 Session 黏性到分布式架构的设计演进
MCP 协议最新版本 2026-07-28 完成了协议核心的无状态化改造,砍掉了 initialize 握手机制和 Session-Id,每个请求自包含身份信息。本文从分布式系统架构视角,分析有状态与无状态设计的权衡,以及这次升级对 AI 工具调用生态的实际影...
MCP 协议最新版本 2026-07-28 完成了协议核心的无状态化改造,砍掉了 initialize 握手机制和 Sessio...
大模型技术演进:从 Scaling Law 到推理优化的七场关键战役
从 Transformer 到 MoE,从模型量化到推理优化,这篇文章按技术演进的时间线梳理了大模型七大关键技术——Scaling Law、量化、MoE、推理优化、长上下文、对齐技术,每项技术的核心原理和工程意义。
从 Transformer 到 MoE,从模型量化到推理优化,这篇文章按技术演进的时间线梳理了大模型七大关键技术——Scalin...
大模型命名规则完全指南:一眼看懂模型名
大模型的名字里藏着家族、版本、参数量、架构等信息。本文拆解 Qwen3-235B-A22B、DeepSeek-V3-671B、Llama-3.1-8B-Instruct 等常见命名规则,帮你建立一套解码能力,看到任何模型名都能快速定位它的基本信息。
大模型的名字里藏着家族、版本、参数量、架构等信息。本文拆解 Qwen3-235B-A22B、DeepSeek-V3-671B、L...