Younis AI LabAI 应用开发、RAG、Agent 与工程化实践笔记
首页文章时间线项目证据关于简历账户

Tag

评测

共 2 篇文章。

模型原理与推理

OpenAI o3 与 o4-mini 首发复盘:工具化推理不能替代业务控制面

o3 与 o4-mini 首发把推理、视觉输入和工具选择连成任务循环;生产价值仍取决于外置身份与权限、幂等执行、结果验证、完整轨迹评测和每个合格任务的成本。

发布 2025/04/19更新 2025/05/16
  • OpenAI o3
  • o4-mini
  • 工具化推理
  • 多模态
  • Agent

模型原理与推理

Gemini 1.5 Pro 的 1M 上下文意味着什么:长上下文没有自动终结 RAG

1M token 实验窗口证明长上下文成为新的系统变量,却没有证明整库直塞比检索更准、更便宜;选型必须比较完整任务的召回、干扰、延迟和缓存复用。

发布 2024/02/17更新 2024/03/22
  • Gemini
  • 长上下文
  • RAG
  • MoE
  • 评测
© 2026 Younis Zhang
项目复用清单LLMs