AI 推理工程 / 性能评测

本地推理容量规划工具

先按总参数与位宽估算名义权重存储,再固定 Ollama 模型 digest、生成参数和结构化任务采集质量、TTFT、总耗时与吞吐,为本地推理建立可复查容量基线。

2026-07 - 持续迭代已独立复现
5 篇关联文章2 个固定工件
  • Node.js
  • Ollama
  • Qwen3
  • Streaming HTTP
  • Node Test Runner
  • JSON

全栈开发 / AI 系统工程

Agent 权限与未知终态恢复工作台

用真实 MCP 协议网关和确定性故障状态机验证 Agent 写操作的可信身份、租户隔离、一次性审批、审计、幂等意图与未知终态恢复。

2026-07 - 持续迭代已独立复现
5 篇关联文章2 个固定工件
  • Node.js
  • MCP TypeScript SDK
  • Zod
  • Node Test Runner
  • JSON
  • GitHub

全栈开发 / AI 内容工程

AI 工程技术博客与内容交付平台

以 GitHub Markdown 为权威内容源,使用 Astro、Fastify、PostgreSQL、Pagefind 和版本化 Docker 镜像完成研究归档、静态发布、读者交互与受控部署。

2026-06 - 至今真实运行已验证
4 篇关联文章2 个固定工件
  • Astro
  • TypeScript
  • Fastify
  • PostgreSQL
  • Markdown
  • Pagefind

AI 工程评测 / 开发者工具

Coding Agent 交付评测工具链

用固定任务、可见测试、评分器保留断言、路径边界、证据重放和历史仓库 Runner 校准 Coding Agent 补丁是否达到可合并交付标准。

2026-07 - 持续迭代已独立复现
3 篇关联文章2 个固定工件
  • Node.js
  • Node Test Runner
  • Git
  • TAP
  • Codex CLI
  • Ollama

AI 平台工程 / 可观测性与可靠性

GenAI 可观测性与故障恢复实验台

用 OpenTelemetry SDK、Collector、Jaeger、持久队列和可控故障代理验证 GenAI trace 合同、业务结果关联、重复投递、partial success、容量、磁盘与恢复边界。

2026-07 - 持续迭代已独立复现
11 篇关联文章11 个固定工件
  • OpenTelemetry SDK
  • OpenTelemetry Collector
  • Jaeger
  • Node.js
  • Docker Compose
  • bbolt

AI 应用评测 / 检索工程

RAG 检索与 Agentic 工作流评测台

基于 Node.js 固定语料和查询标签,比较 BM25、显式查询扩展、字符检索、RRF 与有状态自适应检索,并验证 ACL、拒答、预算和单位正确成本。

2026-07 - 持续迭代已独立复现
3 篇关联文章2 个固定工件
  • Node.js
  • BM25
  • Character n-grams
  • Reciprocal Rank Fusion
  • Node Test Runner
  • JSON