AI人工智能

覆盖大模型部署、推理调优、RAG 知识库、模型微调、AI Coding、智能体与生产治理的实战文章。

14
篇文章
79
阅读量
LiteLLM AI Gateway 生产实战:多模型路由、Fallback、预算、限流与可观测性

LiteLLM AI Gateway 生产实战:多模型路由、Fallback、预算、限流与可观测性

以稳定模型别名统一多供应商调用,落地虚拟密钥、预算、RPM/TPM、能力路由、有限重试、Fallback、隐私、指...

TY
2026-09-28 · 40 分钟
AI 应用评测与可观测性:Ragas、OpenTelemetry、质量门禁与回归测试

AI 应用评测与可观测性:Ragas、OpenTelemetry、质量门禁与回归测试

从版本化黄金集、Ragas 分层指标到 OpenTelemetry GenAI 链路,建立隐私安全的离线评测、CI 门禁、在线 SLO...

TY
2026-09-26 · 28 分钟
多模态 RAG 实战:Docling 解析 PDF、表格、图片、OCR 与可追溯问答

多模态 RAG 实战:Docling 解析 PDF、表格、图片、OCR 与可追溯问答

用 Docling 保留 PDF、Office、扫描件、表格和图片结构,构建稳定块 ID、ACL 检索、重排、引用校验、分层评...

TY
2026-09-26 · 29 分钟
Agent Skills 工程化实战:SKILL.md、渐进披露、脚本与可重复验收

Agent Skills 工程化实战:SKILL.md、渐进披露、脚本与可重复验收

以发票审计 Skill 为完整示例,讲清 SKILL.md、scripts、references、assets 的职责,渐进披露、最小权限、...

TY
2026-09-26 · 28 分钟
MCP v2 生产级服务实战:Tools、Resources、OAuth、幂等与安全治理

MCP v2 生产级服务实战:Tools、Resources、OAuth、幂等与安全治理

基于 MCP 2026-07-28 与 TypeScript SDK v2,从工具、资源和提示模板开始,实现身份、租户隔离、幂等、人工...

TY
2026-09-26 · 34 分钟
生产级 LLM 平台:安全、可观测性、成本控制与故障演练

生产级 LLM 平台:安全、可观测性、成本控制与故障演练

构建生产级 LLM 服务的指标、追踪、容量、缓存、成本、安全、灰度、降级和故障演练体系,让质量与运行风险...

TY
2026-09-23 · 18 分钟
AI Agent 工具调用实战:结构化参数、权限、幂等与人工审批

AI Agent 工具调用实战:结构化参数、权限、幂等与人工审批

从只读工具开始构建安全 Agent:使用严格 schema、服务端鉴权、幂等键、预算限制、人工审批和审计记录隔离...

TY
2026-09-23 · 23 分钟
AI Coding 高质量开发流程:需求拆解、最小补丁、测试与代码审查

AI Coding 高质量开发流程:需求拆解、最小补丁、测试与代码审查

建立可审计的 AI Coding 工作流:先读项目规则和测试,限定变更范围,再生成最小补丁、验证回归、安全审查...

TY
2026-09-23 · 17 分钟
LoRA/QLoRA 微调实战:数据构建、PEFT/TRL 训练与效果验收

LoRA/QLoRA 微调实战:数据构建、PEFT/TRL 训练与效果验收

从是否该微调、数据清洗与隔离、LoRA/QLoRA 配置、TRL 训练,到过拟合诊断、适配器保存合并和独立验收的完...

TY
2026-09-23 · 26 分钟
降低大模型幻觉:检索证据、引用校验、拒答与系统化评测

降低大模型幻觉:检索证据、引用校验、拒答与系统化评测

把“幻觉”拆成可诊断的知识、检索、生成和工具错误,通过证据门禁、引用校验、拒答策略与分层评测降低风险。

TY
2026-09-23 · 17 分钟
企业 AI 知识库实战:文档解析、切分、Qdrant 混合检索与重排

企业 AI 知识库实战:文档解析、切分、Qdrant 混合检索与重排

从文档权限、解析与切分开始,搭建 Qdrant 向量索引、关键词与向量混合检索、重排、引用和增量更新的企业 R...

TY
2026-09-23 · 33 分钟
大模型推理参数调优:Temperature、Top-p、Token 与可复现评测

大模型推理参数调优:Temperature、Top-p、Token 与可复现评测

解释常用解码参数的作用与交互关系,并用固定评测集、参数网格和结构化记录完成可复现调优,避免凭感觉改参...

TY
2026-09-23 · 19 分钟