BLOG

知识分享

技术文章、实战教程、经验心得

共找到 465 篇文章 · 第 1 页/39
Code AgentFunction CallingTool System

Code Agent 解剖(05):模型怎么知道有哪些工具可以用?Function Calling 如何实现?

跟着一次 tool_call 从头走到尾:工具如何注册进 Registry、Registry 如何生成 function schema 告知模型、模型触发 tool_calls 后 Orchestrator 如何分批执行、ToolExecutor 的权限/乐观锁/熔断管道、ToolResult 协议为什么要内外分离、以及观测结果怎么截断写回 history。

·约 11 分钟阅读
Code AgentSkills热更新

Code Agent 解剖(06):agent 的能力怎么用 Skills 动态扩展?

深入 MyCodeAgent 的 Skills 动态扩展机制:一个只需要放一个 Markdown 文件就能让 agent 获得新能力的系统。完整走过定义→扫描→注入→调用→执行的生命周期,理解零代码扩展、按需加载、热更新背后的设计。

·约 11 分钟阅读
企业知识库QAnythingLightRAG

企业知识库系列(02):经典向量 RAG 实测——QAnything vs LightRAG

同一套 89 道测试题,分别对 QAnything v2 和 LightRAG 1.5.6 跑评测。本文记录从部署到出数据的完整过程,包括 Docker GPU 挂载、Milvus 崩溃恢复、user_id 隔离坑等真实踩坑,以及两个框架在单跳、多跳、边界拒答三个维度上的真实对比数据。

·约 9 分钟阅读
Code AgentReAct状态机

Code Agent 解剖(02):agent 是怎么一轮一轮思考和行动的?

深入 MyCodeAgent 的 ReAct 主循环:不可变状态机、双层循环结构、完成门三态判决、模型错误恢复机制。理解 agent 为什么不是「调一次模型拿结果」,而是一个有反馈、有保障、有明确终止条件的控制系统。

·约 10 分钟阅读
Code AgentLLMOpenAI Compatible

Code Agent 解剖(03):各家 LLM 格式不一样,agent 怎么统一对接?

深入 MyCodeAgent 的 LLM 接口层:零依赖 HTTP 传输、provider 路由表、五元组响应归一化。理解 agent 为什么不直接绑某一家 SDK,而是把「发请求」和「读响应」拆成稳定边界,让 ReAct 循环只看到统一结构。

·约 8 分钟阅读
Code AgentSystem PromptPrompt Engineering

Code Agent 解剖(04):系统提示词是怎么组装的,agent 的「人格」从哪来?

深入 MyCodeAgent 的提示词组装层:Constitution / Tool Contracts / Project Rules / Runtime Signals 四层 system 消息,以及它们如何与历史投影拼成发给模型的 Model View。理解 agent 的行为约束不是「一段超长 prompt」,而是可缓存、可指纹、可热更新的分层装配。

·约 7 分钟阅读
open-sourceclaude-codeskill

开源项目第190期:claude-video — 给 Claude 装上「眼睛」看视频,一条命令分析 YouTube/Loom/本地视频,字幕优先零下载、场景感知帧去重、Token 预算自动管理

Brad Bonanno 出品的 Claude Code 技能插件,通过 /watch 命令让 Claude 分析任意视频。7 步流水线:yt-dlp 下载→ffmpeg 提取帧→Whisper 转录→送入 Claude 上下文。字幕优先优化(有字幕直接用,零下载)、16×16 缩略图 MAD 算法帧去重、按视频时长自动调整帧预算。四档精度模式:transcript/efficient/balanced/token-burner。支持 Claude Code、Codex、Cursor、Copilot、Gemini CLI 等 50+ Agent 宿主。15.2k Stars,MIT。

·约 7 分钟阅读
open-sourceclaude-codeskill

开源项目第191期:gstack — YC CEO Garry Tan 开源的 AI 虚拟工程团队,23 个专家角色 slash command,从产品构思到上线发布的完整研发流程

Y Combinator CEO Garry Tan 开源的 Claude Code 技能集,把 Claude Code 变成一支有分工的工程团队。23 个专业角色命令覆盖规划、设计、审查、测试、发布全流程:/office-hours(YC 风格产品挑战)、/plan-ceo-review、/design-shotgun(4-6 个设计变体对比)、/qa(真实 Playwright 浏览器测试)、/cso(OWASP + STRIDE 安全审计)、/ship(同步→测试→审计→推送→PR)。技能间上下文传递,支持 10-15 个并发 sprint,跨 Claude Code/Codex/Cursor 等 10 种 Agent。128k Stars,MIT。

·约 9 分钟阅读
Code AgentLLM AgentReAct

Code Agent 解剖(01):用户输入一句话,agent 内部发生了什么?

从 python main.py 到回答输出,完整追踪一条用户输入在 MyCodeAgent 中的数据流。覆盖 CLI 入口、依赖组装、ReAct 主循环三个阶段,建立后续深入各模块的整体地图。

·约 10 分钟阅读
open-sourceAI-agentcoding-agent

开源项目第187期:Pi — 哲学驱动的极简 AI Coding Agent,86k Stars,30+ LLM 提供商,无限扩展

极简哲学驱动的 AI coding agent harness。5 个 npm 包:统一 LLM API(30+ 提供商)、agent 运行时、TUI 库、coding agent CLI、遥测合约。四种模式(交互/打印/JSON/RPC/SDK),会话分支树,TypeScript 扩展系统,Skills/Prompt Templates/Pi Packages 生态。刻意不内置 MCP、子 agent、权限弹窗、计划模式。TypeScript,MIT,86k Stars。

·约 11 分钟阅读
open-sourceAI-agentbook

开源项目第188期:深入理解 AI Agent — 李博杰开源的 AI Agent 完整技术书,10章95实验,35k Stars

李博杰著《深入理解 AI Agent:设计原理与工程实践》全书开源。核心公式:Agent = LLM + 上下文 + 工具。10章层层递进:上下文工程、用户记忆与知识库、MCP工具协议、Coding Agent、评估体系、模型后训练(SFT/RL)、持续进化、多模态交互、多Agent协作。95个配套实验,13种语言版本,PDF/EPUB免费下载。Python,Apache-2.0,35k Stars。

·约 11 分钟阅读
open-sourceAI-agentRAG

开源项目第189期:DeepTutor — Agent 原生的终身个性化学习工作台,三层记忆+多引擎RAG+Partners,33k Stars

香港大学数据智能实验室出品的 AI 学习工作台。核心:单一 agent 循环驱动所有模式(Chat/Quiz/Research/Visualize/Solve/Mastery Path)。三层记忆(L1事件追踪/L2曲面摘要/L3跨曲面综合),可视化记忆图谱,每条合成结论可追溯到原始事件。多引擎知识库:LlamaIndex/PageIndex/GraphRAG/LightRAG/Obsidian。Partners:持久 AI 伴侣,带 IM 通道(Slack/Discord/Telegram/微信/飞书等)。My Agents:驱动本地 Claude Code/Codex 作为子 agent。Python+Next.js,Apache-2.0,33k Stars。

·约 12 分钟阅读