惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

IT之家
IT之家
Microsoft Azure Blog
Microsoft Azure Blog
人人都是产品经理
人人都是产品经理
博客园 - 聂微东
博客园_首页
阮一峰的网络日志
阮一峰的网络日志
V
V2EX
小众软件
小众软件
F
Fortinet All Blogs
Microsoft Security Blog
Microsoft Security Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
H
Hackread – Cybersecurity News, Data Breaches, AI and More
量子位
Google DeepMind News
Google DeepMind News
Jina AI
Jina AI
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
aimingoo的专栏
aimingoo的专栏
B
Blog RSS Feed
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
宝玉的分享
宝玉的分享
有赞技术团队
有赞技术团队
J
Java Code Geeks
WordPress大学
WordPress大学
The Cloudflare Blog

Recent Commits to openclaw:main

test: merge chat side-result checks · openclaw/openclaw@ddd2c2a test: merge cron history checks · openclaw/openclaw@f7eb746 test: merge responsive navigation shell checks · openclaw/openclaw@c2e4b47 docs(changelog): add codex oauth fixes · openclaw/openclaw@628e6cd test: merge navigation routing cases · openclaw/openclaw@5d8cecb Tests: mock channel registry bundled fallback · openclaw/openclaw@2b08233 Secrets: avoid broad web search discovery for single plugin config · openclaw/openclaw@a464f59 test: merge config view browser checks · openclaw/openclaw@20cf511 fix(status): align oauth health with runtime · openclaw/openclaw@eed7116 feat: add macOS screen snapshots for monitor preview (#67954) thanks … · openclaw/openclaw@f377db1 fix: report shared auth scopes in hello-ok (#67810) thanks @BunsDev · openclaw/openclaw@0b6c39b Auto-reply: avoid eager bundled route fallback · openclaw/openclaw@3ea1bf4 Tests: narrow session binding contract setup · openclaw/openclaw@54e4e16 fix(macOS): enable undo/redo in webchat composer text input (#34962) · openclaw/openclaw@00951dc Tests: speed up channel setup promotion · openclaw/openclaw@82b529a Docs: refresh agent instructions · openclaw/openclaw@5775fe2 fix(auth): serialize OAuth refresh across agents to fix #26322 (#67876) · openclaw/openclaw@8e79080 test: allow ollama public surface boundary test · openclaw/openclaw@7d4f1a6 Docs: add test performance guardrails · openclaw/openclaw@89706d3 Tests: restore context-engine usage proof · openclaw/openclaw@e4c4f95 Tests: slim context engine runtime coverage · openclaw/openclaw@74c198f ci: retry failed custom checkouts · openclaw/openclaw@0ee5baf test: trim duplicate provider auth onboarding cases · openclaw/openclaw@1ffc02e matrix: fix sessions_spawn --thread subagent session spawning (#67643) · openclaw/openclaw@1ce2596 test: reduce auth choice fixture churn · openclaw/openclaw@857b9cd test: mock health status config boundaries · openclaw/openclaw@9d5ab4a test: mock onboard config io boundary · openclaw/openclaw@299694d test: mock legacy state plugin boundaries · openclaw/openclaw@2713089 test: mock channel install boundaries · openclaw/openclaw@b945248 test: mock doctor preview channel boundaries · openclaw/openclaw@b1a3ad4
fix: require all taxonomy coverage ids (#94296) · opencla...
RomneyDa · 2026-06-18 · via Recent Commits to openclaw:main
Original file line numberDiff line numberDiff line change

@@ -473,11 +473,11 @@ describe("qa cli runtime", () => {

473473

expect(evidence.scorecard).not.toHaveProperty("kind");

474474

expect(evidence.scorecard).not.toHaveProperty("taxonomy");

475475

expect(evidence.scorecard).not.toHaveProperty("profile");

476-

expect(evidence.scorecard?.features?.fulfilled).toBe(1);

476+

expect(evidence.scorecard?.features?.fulfilled).toBe(0);

477477

expect(evidence.scorecard?.categoryReports?.[0]).toMatchObject({

478478

id: "agent-runtime-and-provider-execution.agent-turn-execution",

479479

features: {

480-

fulfilled: 1,

480+

fulfilled: 0,

481481

},

482482

});

483483

expect(evidence.entries?.[0]).not.toHaveProperty("execution");

Original file line numberDiff line numberDiff line change

@@ -18,6 +18,7 @@ const TEST_WEBCHAT_COVERAGE_ID = "ui.webchat";

1818

function testMaturityTaxonomy(params?: {

1919

categoryId?: string;

2020

coverageIds?: readonly string[];

21+

featureCoverageIds?: readonly (readonly string[])[];

2122

includeAllCategories?: boolean;

2223

profileCategoryIds?: readonly string[];

2324

}) {

@@ -52,9 +53,14 @@ function testMaturityTaxonomy(params?: {

5253

{

5354

id: categoryLocalId,

5455

name: "Test category",

55-

features: (params?.coverageIds ?? [TEST_EXECUTABLE_COVERAGE_ID]).map((coverageId) => ({

56-

name: coverageId,

57-

coverageIds: [coverageId],

56+

features: (

57+

params?.featureCoverageIds ??

58+

(params?.coverageIds ?? [TEST_EXECUTABLE_COVERAGE_ID]).map((coverageId) => [

59+

coverageId,

60+

])

61+

).map((coverageIds) => ({

62+

name: coverageIds.join(" + "),

63+

coverageIds: [...coverageIds],

5864

})),

5965

},

6066

],

@@ -330,6 +336,33 @@ describe("qa coverage report", () => {

330336

]);

331337

});

332338
339+

it("requires every coverage ID on a taxonomy feature to have primary evidence", () => {

340+

const report = buildQaScorecardTaxonomyReport({

341+

taxonomy: testMaturityTaxonomy({

342+

featureCoverageIds: [[TEST_EXECUTABLE_COVERAGE_ID, TEST_WEBCHAT_COVERAGE_ID]],

343+

}),

344+

repoRoot: process.cwd(),

345+

scenarios: [

346+

scenarioWithCoverage({

347+

primary: [TEST_EXECUTABLE_COVERAGE_ID],

348+

secondary: [TEST_WEBCHAT_COVERAGE_ID],

349+

sourcePath: "qa/scenarios/channels/dm-chat-baseline.yaml",

350+

}),

351+

],

352+

});

353+
354+

expect(report.fulfilledCategoryCount).toBe(0);

355+

expect(report.fulfilledFeatureCount).toBe(0);

356+

expect(report.categories[0]?.coverageStatus).toBe("partial");

357+

expect(report.categories[0]?.fulfilledCoverageIds).toStrictEqual([TEST_EXECUTABLE_COVERAGE_ID]);

358+

expect(report.validationIssues).toContainEqual(

359+

expect.objectContaining({

360+

code: "coverage-id-missing-primary-evidence",

361+

ref: TEST_WEBCHAT_COVERAGE_ID,

362+

}),

363+

);

364+

});

365+
333366

it("uses script producer evidence as coverage fulfillment", () => {

334367

const report = buildQaScorecardTaxonomyReport({

335368

taxonomy: testMaturityTaxonomy({

Original file line numberDiff line numberDiff line change

@@ -79,20 +79,23 @@ export function buildQaProfileScorecardEvidence(params: {

7979

category,

8080

featureCoverageByCategoryId: params.featureCoverageByCategoryId,

8181

});

82-

const fulfilledFeatureCount = featureCoverageIds.filter((coverageIds) =>

83-

coverageIds.some((coverageId) => primaryCoverageIds.has(coverageId)),

82+

const fulfilledFeatureCount = featureCoverageIds.filter(

83+

(coverageIds) =>

84+

coverageIds.length > 0 &&

85+

coverageIds.every((coverageId) => primaryCoverageIds.has(coverageId)),

8486

).length;

8587

const secondaryOnlyFeatureCount = featureCoverageIds.filter(

8688

(coverageIds) =>

87-

!coverageIds.some((coverageId) => primaryCoverageIds.has(coverageId)) &&

88-

coverageIds.some((coverageId) => secondaryCoverageIds.has(coverageId)),

89+

coverageIds.some((coverageId) => !primaryCoverageIds.has(coverageId)) &&

90+

coverageIds.some(

91+

(coverageId) =>

92+

!primaryCoverageIds.has(coverageId) && secondaryCoverageIds.has(coverageId),

93+

),

8994

).length;

9095

const missingCoverageIds = uniqueSortedStrings(

91-

featureCoverageIds

92-

.filter(

93-

(coverageIds) => !coverageIds.some((coverageId) => primaryCoverageIds.has(coverageId)),

94-

)

95-

.flat(),

96+

featureCoverageIds.flatMap((coverageIds) =>

97+

coverageIds.filter((coverageId) => !primaryCoverageIds.has(coverageId)),

98+

),

9699

);

97100

const missingFeatureCount = featureCoverageIds.length - fulfilledFeatureCount;

98101

return {

Original file line numberDiff line numberDiff line change

@@ -364,24 +364,21 @@ function pushMissingPrimaryIssues(params: {

364364

coverageIdsWithSecondaryEvidence: ReadonlySet<string>;

365365

}) {

366366

for (const feature of params.category.features) {

367-

if (

368-

feature.coverageIds.some((coverageId) =>

369-

params.coverageIdsWithPrimaryEvidence.has(coverageId),

370-

)

371-

) {

372-

continue;

367+

for (const coverageId of feature.coverageIds) {

368+

if (params.coverageIdsWithPrimaryEvidence.has(coverageId)) {

369+

continue;

370+

}

371+

const reason = params.coverageIdsWithSecondaryEvidence.has(coverageId)

372+

? "only has secondary evidence"

373+

: "has no primary evidence";

374+

params.issues.push({

375+

code: "coverage-id-missing-primary-evidence",

376+

severity: "warning",

377+

categoryId: params.category.id,

378+

ref: coverageId,

379+

message: `${params.category.id} feature ${feature.name} coverage ID ${coverageId} ${reason}`,

380+

});

373381

}

374-

const hasSecondaryEvidence = feature.coverageIds.some((coverageId) =>

375-

params.coverageIdsWithSecondaryEvidence.has(coverageId),

376-

);

377-

const reason = hasSecondaryEvidence ? "only has secondary evidence" : "has no primary evidence";

378-

params.issues.push({

379-

code: "coverage-id-missing-primary-evidence",

380-

severity: "warning",

381-

categoryId: params.category.id,

382-

ref: feature.coverageIds.join(", ") || feature.name,

383-

message: `${params.category.id} feature ${feature.name} ${reason}`,

384-

});

385382

}

386383

}

387384

@@ -582,8 +579,10 @@ export function buildQaScorecardTaxonomyReport(params: {

582579

}

583580

}

584581
585-

const fulfilledFeatureCountForCategory = category.features.filter((feature) =>

586-

feature.coverageIds.some((coverageId) => fulfilledCoverageIds.has(coverageId)),

582+

const fulfilledFeatureCountForCategory = category.features.filter(

583+

(feature) =>

584+

feature.coverageIds.length > 0 &&

585+

feature.coverageIds.every((coverageId) => fulfilledCoverageIds.has(coverageId)),

587586

).length;

588587

if (required) {

589588

requiredFeatureCount += category.features.length;

Original file line numberDiff line numberDiff line change

@@ -5,10 +5,10 @@ scenario:

55

surface: runtime

66

coverage:

77

primary:

8-

- gateway.smoke

8+

- websocket-transport

99

secondary:

10-

- gateway.health

11-

- gateway.protocol

10+

- health-apis

11+

- hello-ok-snapshot

1212

objective: Exercise gateway health and WebSocket smoke assertions through QA Lab evidence.

1313

successCriteria:

1414

- Gateway health probe succeeds against a reachable local endpoint.

Original file line numberDiff line numberDiff line change

@@ -164,7 +164,7 @@ surfaces:

164164

id: gateway-rpc-apis-and-events

165165

features:

166166

- name: Health APIs

167-

coverageIds: [gateway.health, health-apis]

167+

coverageIds: [health-apis]

168168

description: '`health` and `status` RPCs.'

169169

- name: Identity and presence APIs

170170

coverageIds: [identity-and-presence-apis]

@@ -504,7 +504,7 @@ surfaces:

504504

id: websocket-connection

505505

features:

506506

- name: WebSocket transport

507-

coverageIds: [gateway.smoke, websocket-transport]

507+

coverageIds: [websocket-transport]

508508

description: WebSocket transport with JSON text frames.

509509

- name: Connect challenge

510510

coverageIds: [connect-challenge]

@@ -516,7 +516,7 @@ surfaces:

516516

coverageIds: [protocol-version-negotiation]

517517

description: Protocol range negotiation (`minProtocol`/`maxProtocol`).

518518

- name: hello-ok snapshot

519-

coverageIds: [gateway.protocol, hello-ok-snapshot]

519+

coverageIds: [hello-ok-snapshot]

520520

description: 'Required `hello-ok` payload structure: server identity, negotiated auth, feature discovery, snapshot, and policy limits.'

521521

- name: Startup retry

522522

coverageIds: [startup-retry]