Cogine AI技术 / 产品图书馆全部文章

Coginers' Library · 持续更新

为你的产品与技术决策提供依据

围绕 AI、Agent、LLM 工程化、SaaS 产品与开发工具,从一手资料中提炼事实、证据与可复用的工程判断。

浏览精选

最近更新
2026-08-23

按主题进入

最近收录

新的材料,可靠的判断依据

每篇都尽量拆清:来源说了什么、代码证明什么、还有哪些尚未验证。

01

真实工程案例 · Multi-Agent

LendingTree 房贷多 Agent:97% containment 不等于 97% 正确率

从三 Agent 编排、双层安全和持久状态出发,厘清 1,960 个会话指标与真正上线门禁之间的距离。阅读文章
02

最新工程实践 · Feature Store

Jumio 实时 Feature Store:P95 16.9 ms 只证明读路径

拆解流式与离线双路径、迟到事件、训练—服务一致性,以及成本数据应该如何被审慎解读。阅读文章
03

新产品能力 · LLM Gateway

Google API Gateway 模型路由:统一接口之后,证据链还缺什么

把默认回退、协议转码、目标模型回执、网络边界与双层成本账本放在同一张工程地图里。阅读文章

精选索引

先找到问题,再进入文章

本页精选10 篇精选

全部收录 1,392 篇,可通过“全部文章”查看完整目录。

01Agent Harness 与应用框架LendingTree 房贷多 Agent:97% containment 不等于 97% 正确率

从三 Agent 编排、双层安全和持久状态出发,厘清 1,960 个会话指标与真正上线门禁之间的距离。

AWSLangGraphMCP
02记忆、数据、评测与可观测性Jumio 实时 Feature Store:P95 16.9 ms 只证明读路径

拆解流式与离线双路径、迟到事件、训练—服务一致性,以及成本数据应该如何被审慎解读。

FlinkIcebergSageMaker
03Agent 运行时、沙箱与控制平面Google API Gateway 模型路由:统一接口之后,证据链还缺什么

把默认回退、协议转码、目标模型回执、网络边界与双层成本账本放在同一张工程地图里。

Google CloudRoutingOpenAI API
04记忆、数据、评测与可观测性NVIDIA AVO:ARC-AGI-3 公开集 100 分,但不是模型从 30% 跳到 100%

从公开集得分、6,624 个动作与持久记忆出发,讨论完整系统归因和可审计 Harness 评测合同。

NVIDIAARC-AGI-3Evaluation
05记忆、数据、评测与可观测性Meta GEM 训练:端到端 MFU 翻倍至 20–25%,但仓库不是完整训练系统

拆解五维并行、SM-free 通信和 E2E MFU,并把官方披露、开源代码与可复现范围分开呈现。

MetaGPUTraining
06记忆、数据、评测与可观测性Spotify LLM A/B 测试:原始预测只找回 39% 人类效应

用公开实验拆解 surrogacy、comparability 与历史诊断边界,避免把预测一致性等同于新干预效果。

SpotifyA/B TestingCausal Inference
07Agent Harness 与应用框架Harvey Tenet:法律 Agent 任务接近翻倍,但发布页没有权重下载入口

从后训练、all-pass、Harness 可比性和权重交付四条线,判断能力主张究竟能被验证到哪一步。

HarveyGSPOLegal AI
08Agent 协议与交互入口GPT Transcribe:实时转写先管理可修订文本,再谈自动化

拆清 partial、final、confirmed 三层状态,以及持续音频、VAD、上下文提示和兼容性边界。

TranscriptionRealtimeState
09浏览器、前端与开发工作流Loom Video Prompts:把录屏编译成 Action Plan,但它不是执行授权

从 transcript、keyframes 与点击轨迹到可审查计划,分清信息提取、任务建议和真正的执行门禁。

LoomVideoAction Plan
10Agent 运行时、沙箱与控制平面Cloudflare AIChatAgent:浏览器断线不等于取消

区分浏览器连接、对象进程恢复与外部业务结果三道状态边界,并给出显式取消和恢复预算。

CloudflareDurable ObjectsRecovery
C
把事实、证据与边界分开

我们优先使用一手资料,区分官方主张、代码证据与尚未验证的部分,帮助读者形成自己的判断。

编辑原则