Younis AI LabAI 应用开发、RAG、Agent 与工程化实践笔记
首页文章时间线项目证据关于简历账户

Tag

Agent 评测

共 2 篇文章。

AI 产品与商业化

OpenAI Deep Research 首发复盘:研究 Agent 的交付物必须是可审计证据

Deep Research 首发把搜索、浏览、分析与带引用报告做成 5 至 30 分钟的异步任务,但当时只向 Pro 用户提供有限额度;商业价值取决于证据账本、时间边界、人工核验和每份被接受报告的成本,而不是答案长度。

发布 2025/02/04更新 2025/03/08
  • OpenAI Deep Research
  • Research Agent
  • 信息检索
  • 引用核验
  • Agent 评测

Agent 实践

OpenAI Operator 首发复盘:浏览器 Agent 的价值不在自动点击,而在可验证交付

Operator 首发把截图理解与鼠标键盘动作连成的浏览器 Agent 带入研究预览,但它当时只面向美国 Pro 用户,CUA API 仍是未来计划;生产价值取决于外置权限、关键动作审批、未知终态恢复和每个经验证任务的成本。

发布 2025/01/26更新 2025/02/07
  • OpenAI Operator
  • Browser Agent
  • Computer-Using Agent
  • 权限控制
  • 人工接管
© 2026 Younis Zhang
项目复用清单LLMs