Coginers' Library · 持续更新
为你的产品与技术决策提供依据
围绕 AI、Agent、LLM 工程化、SaaS 产品与开发工具,从一手资料中提炼事实、证据与可复用的工程判断。
最近更新
2026-08-23
按主题进入
最近收录
新的材料,可靠的判断依据
每篇都尽量拆清:来源说了什么、代码证明什么、还有哪些尚未验证。
真实工程案例 · Multi-Agent
LendingTree 房贷多 Agent:97% containment 不等于 97% 正确率
从三 Agent 编排、双层安全和持久状态出发,厘清 1,960 个会话指标与真正上线门禁之间的距离。阅读文章 ↗02最新工程实践 · Feature Store
Jumio 实时 Feature Store:P95 16.9 ms 只证明读路径
拆解流式与离线双路径、迟到事件、训练—服务一致性,以及成本数据应该如何被审慎解读。阅读文章 ↗03新产品能力 · LLM Gateway
Google API Gateway 模型路由:统一接口之后,证据链还缺什么
把默认回退、协议转码、目标模型回执、网络边界与双层成本账本放在同一张工程地图里。阅读文章 ↗精选索引
先找到问题,再进入文章
全部收录 1,392 篇,可通过“全部文章”查看完整目录。
从三 Agent 编排、双层安全和持久状态出发,厘清 1,960 个会话指标与真正上线门禁之间的距离。
AWSLangGraphMCP02记忆、数据、评测与可观测性Jumio 实时 Feature Store:P95 16.9 ms 只证明读路径拆解流式与离线双路径、迟到事件、训练—服务一致性,以及成本数据应该如何被审慎解读。
FlinkIcebergSageMaker03Agent 运行时、沙箱与控制平面Google API Gateway 模型路由:统一接口之后,证据链还缺什么把默认回退、协议转码、目标模型回执、网络边界与双层成本账本放在同一张工程地图里。
Google CloudRoutingOpenAI API04记忆、数据、评测与可观测性NVIDIA AVO:ARC-AGI-3 公开集 100 分,但不是模型从 30% 跳到 100%从公开集得分、6,624 个动作与持久记忆出发,讨论完整系统归因和可审计 Harness 评测合同。
NVIDIAARC-AGI-3Evaluation05记忆、数据、评测与可观测性Meta GEM 训练:端到端 MFU 翻倍至 20–25%,但仓库不是完整训练系统拆解五维并行、SM-free 通信和 E2E MFU,并把官方披露、开源代码与可复现范围分开呈现。
MetaGPUTraining06记忆、数据、评测与可观测性Spotify LLM A/B 测试:原始预测只找回 39% 人类效应用公开实验拆解 surrogacy、comparability 与历史诊断边界,避免把预测一致性等同于新干预效果。
SpotifyA/B TestingCausal Inference07Agent Harness 与应用框架Harvey Tenet:法律 Agent 任务接近翻倍,但发布页没有权重下载入口从后训练、all-pass、Harness 可比性和权重交付四条线,判断能力主张究竟能被验证到哪一步。
HarveyGSPOLegal AI08Agent 协议与交互入口GPT Transcribe:实时转写先管理可修订文本,再谈自动化拆清 partial、final、confirmed 三层状态,以及持续音频、VAD、上下文提示和兼容性边界。
TranscriptionRealtimeState09浏览器、前端与开发工作流Loom Video Prompts:把录屏编译成 Action Plan,但它不是执行授权从 transcript、keyframes 与点击轨迹到可审查计划,分清信息提取、任务建议和真正的执行门禁。
LoomVideoAction Plan10Agent 运行时、沙箱与控制平面Cloudflare AIChatAgent:浏览器断线不等于取消区分浏览器连接、对象进程恢复与外部业务结果三道状态边界,并给出显式取消和恢复预算。
CloudflareDurable ObjectsRecovery我们优先使用一手资料,区分官方主张、代码证据与尚未验证的部分,帮助读者形成自己的判断。
