Younis AI LabAI 应用开发、RAG、Agent 与工程化实践笔记
首页文章时间线项目证据关于简历账户

Tags

技术标签

从具体技术栈和问题域进入文章。

  • 背压
  • 本地部署
  • 部署评测
  • 产品工程
  • 成本归因
  • 成本评测
  • 成本治理
  • 持久队列
  • 持久化
  • 代码审查
  • 代码生成
  • 代码智能
  • 单位经济性
  • 多 Agent
  • 多模态
  • 多租户
  • 多租户 ACL
  • 个人 Agent
  • 工具调用
  • 工具化推理
  • 工具授权
  • 故障恢复
  • 混合检索
  • 混合推理
  • 结构化输出
  • 拒答
  • 开放权重
  • 开源项目
  • 开源治理
  • 可复现实验
  • 可观测性
  • 可用性边界
  • 幂等性
  • 模型部署
  • 模型路由
  • 模型评测
  • 模型选型
  • 模型蒸馏
  • 内容工作流
  • 评测
  • 评测归因
  • 企业 AI
  • 强化学习
  • 权限控制
  • 权限网关
  • 权限治理
  • 人工接管
  • 人工审查
  • 容量规划
  • 软件工程
  • 软件工程评测
  • 软件供应链
  • 软件交付
  • 沙箱
  • 商业化
  • 上下文工程
  • 身份传播
  • 审计
  • 审计重放
  • 生产评估
  • 实时交互
  • 视觉理解
  • 视频生成
  • 数据完整性
  • 数据治理
  • 私有部署
  • 推理部署
  • 推理成本
  • 推理服务
  • 推理模型
  • 推理时计算
  • 系统架构
  • 协议互操作
  • 协议设计
  • 信息检索
  • 许可证
  • 训练成本
  • 延迟
  • 异步任务
  • 引用核验
  • 隐藏测试
  • 云端沙箱
  • 长期记忆
  • 长任务
  • 长上下文
  • 蒸馏
  • 证据门禁
  • 中文模型
  • 重复投递
  • 状态机
  • 自托管
  • A2A
  • AAIF
  • Agent
  • Agent 安全
  • Agent 产品
  • Agent 控制面
  • Agent 评测
  • Agent RL
  • Agent2Agent
  • Agentic RAG
  • Agents SDK
  • AGENTS.md
  • AI
  • AI 安全
  • AI 变革
  • AI 评测
  • Anthropic
  • API 设计
  • Artifacts
  • Benchmark
  • BM25
  • Browser Agent
  • Claude
  • Claude 3.5 Sonnet
  • Claude 3.7 Sonnet
  • Claude 4
  • Claude Code
  • codex-1
  • Coding Agent
  • Collector
  • Computer Use
  • Computer-Using Agent
  • Content
  • Continuous Batching
  • DeepSeek
  • DeepSeek-R1
  • DeepSeek-V2
  • DeepSeek-V3
  • Deployment
  • Docker
  • Embedding
  • ENOSPC
  • Evaluation
  • Extended Thinking
  • FP8
  • Gateway
  • Gemini
  • Gemini 2.0
  • Gemini 2.5
  • GenAI Observability
  • General AI Agent
  • GPT-4.1
  • GPT-4o
  • GPT-5
  • GPT-5.4
  • gpt-oss
  • GPU
  • GUI Agent
  • Harmony
  • Hermes Agent
  • Inference
  • Interview
  • Jaeger
  • JSON Schema
  • LangChain
  • Linux
  • Llama
  • Llama 3
  • Llama 3.1
  • LLM
  • Manus
  • MCP
  • MLA
  • Model Context Protocol
  • MoE
  • Multimodal Live API
  • MXFP4
  • Native Tool Use
  • o4-mini
  • Ollama
  • OpenAI
  • OpenAI Codex
  • OpenAI Deep Research
  • OpenAI o1
  • OpenAI o3
  • OpenAI Operator
  • OpenAI Realtime API
  • OpenClaw
  • OpenTelemetry
  • OTLP
  • PII
  • Portfolio
  • Project
  • Prompt
  • Prompt Injection
  • Qwen
  • Qwen Code
  • Qwen2
  • Qwen2.5
  • Qwen3
  • Qwen3-Coder
  • RAG
  • RAG 评测
  • Research Agent
  • Responses API
  • Sampling
  • SBOM
  • SLO
  • Sora
  • TCO
  • Tool Calling
  • Tool Search
  • Tracing
  • VAD
  • VectorDB
  • vLLM
  • Voice Agent
  • WebSocket
  • Workflow
© 2026 Younis Zhang
项目复用清单LLMs