FPTCASAN · CORE MEMBER TRAINING
Core member enablement · 29/07/2026

CASAN không phải một lệnh cài đặt.
CASAN là cách tổ chức chịu trách nhiệm khi dùng AI.

Tư tưởng · cài đặt · vận hành · Level 4 · Level 5 · kiểm soát token · demo NEHOPS Basic Design.

Kết thúc buổi học, mỗi core member phải tự trả lời được 6 câu hỏi

  1. CASAN kiểm soát điều gì mà coding agent không kiểm soát?
  2. casan init tạo gì — và tuyệt đối không tạo gì?
  3. Một run được gọi là có bằng chứng khi nào?
  1. Level 4 khác “có nhiều script” ở điểm nào?
  2. Level 5 đòi hỏi thay đổi cấp tổ chức ra sao?
  3. Token giảm bao nhiêu, đo bằng nguồn nào, có mất nghĩa không?

CASAN đi đúng hướng FPT Japan: AI-First cho legacy modernization, nhưng phải scale có kiểm soát

$1B
Mục tiêu doanh thu thị trường Nhật năm 2027; mũi nhọn gồm Legacy Modernization, AI, Automotive, ERP.
~60%
Hệ thống IT tại Nhật được FPT nêu là đã vận hành trên 20 năm — áp lực hiện đại hóa rất lớn.
800K
Thiếu hụt nhân lực IT dự báo đến 2030; AI phải tăng năng suất mà không hạ chuẩn chất lượng.

FPT chính thức giới thiệu CASAN năm 2026 như khung 5 cấp để đi từ thử nghiệm rời rạc đến vận hành AI ở quy mô doanh nghiệp.

Nguồn công khai FPT · 2025–2026
Model tạo ra đề xuất.
Harness quyết định đề xuất có được tin, thực thi và chứng nhận hay không.

Nhanh không đủ. Phải đúng nguồn, đúng quyền, qua gate, có người chịu trách nhiệm và có evidence tái kiểm chứng.

Bảy harness là bảy câu hỏi bắt buộc trước khi tin AI

H1Đúng context? Có cũ, thừa hoặc thiếu không?
H2Đúng tool, đúng quyền, chạy lại có an toàn?
H3Output có qua tiêu chí và regression?
H4Injection, secret, PII, egress đã bị chặn?
H5Ai duyệt, theo policy nào, log có bị sửa?
H6Token, cost, latency, retry, failure có được đo?
H7Retry, fallback, rollback, orchestration có giới hạn?

Harness yếu nhất quyết định trần. H1/H3 mạnh không bù được H4/H5/H6 bằng 0.

Edition là thứ được đóng gói. Maturity là năng lực đã được chứng minh.

TrụcCâu hỏiVí dụSự thật sau init
Product editionCASAN ship những capability nào?Core, DevKit, Platform PreviewEnterprise bị từ chối vì chưa được ship
Maturity L1–L5Tổ chức đã vận hành và giữ evidence đến đâu?L4 Automated, L5 Nativelevel: null, not_assessed
Không được nói: “Đã chạy casan init nên project đạt Level 4.”

Năm cấp không phải năm nhãn — là năm thay đổi trong cách vận hành

L1
Curious

Cá nhân thử AI, chưa có chuẩn chung.

L2
Augmented

Dùng tool được duyệt, tăng năng suất từng công việc.

L3
Standard

Quy trình, template, review gate và test lặp lại được.

L4
Automated

H4/H5/H6 là runtime gate; side effect có policy + approval + evidence.

L5
Native

Tái dùng đa dự án; drift, fallback, rollback, KPI và governance tập trung hoạt động thật.

casan init là enrollment ở cấp repository

  • Pin runtime/version/hash
  • Merge hook Claude/Codex
  • Bật enforce/observe
  • Tạo state/log root
  • DevKit thêm Domain Pack + CI template
  • Kết nối dashboard/ingest nếu cấu hình
cd "/path/to/project" casan init \ --project nehops-bd-v27 \ --edition devkit \ --runtime managed \ --client claude,codex \ --mode enforce casan doctor casan readiness --refresh casan verify-harness

Init không thể provision những thứ thuộc hạ tầng, tổ chức và hợp đồng

Không do init tạo
  • Enterprise OIDC / CA / private network
  • Cloud KMS, HSM, S3 Object Lock/WORM
  • HA topology, RPO/RTO, failover
  • On-call, uptime SLA, service credit
  • External pentest hoặc chứng nhận
CASAN cung cấp building blocks và evidence contract.

Khách hàng/FPT phải triển khai dịch vụ thật, vận hành thật và thuê đánh giá độc lập.

Probe trên bản sao cấu trúc NEHOPS: Core chạy, nhưng còn 3 việc phải xử lý ngay

1.0.7
Harness được pin bằng SHA-256; DevKit init thành công.
ATTN
Codex hook đã tạo nhưng chưa trust; cần mở /hooks.
0
Chưa có project manifest và chưa quan sát provider token/cost.

Kết quả thật: ready_with_attention; maturity vẫn là not_assessed.

Những file scaffold phải được thay bằng sự thật của project — không giữ placeholder

ArtifactĐiền bằng evidence NEHOPSKhông được làm
requirement.mdFR từ CLAUDE.md + BD_Instruction.md: tiếng Nhật, lowercase ID, no-inference, thứ tự reviewGiữ FR-01 health placeholder
architecture.mdVB.NET → AST → BD → Angular/Java; Windows analyzer; output boundariesTự bịa runtime/deployment
traceability-map.jsonFR → VB/AST/instruction → reviewed output/review reportMap vào file không tồn tại
golden-runs/FRR04701 reviewed output + final review, sau khi kiểm tra dữ liệu nhạy cảmDùng draft chưa review làm golden
corpus/Benign tiếng Nhật + red-team injection/secret/PII theo domainChỉ dùng corpus tiếng Anh mẫu

Prompt đầu tiên phải là preflight read-only, không phải “hãy chạy toàn bộ”

Mục tiêu của prompt đầu: xác nhận scope, nguồn chuẩn, vùng được ghi, tool được phép và acceptance evidence.
Thực hiện CASAN onboarding preflight cho NEHOPS BD v2.7. CHẾ ĐỘ: READ-ONLY. Không sửa VB-Source, AST-outputs, BD/output, BD/output_reviewed, ref_docs hoặc instruction. Đọc theo thứ tự: 1. CLAUDE.md 2. BD/instructions/BD_Instruction.md 3. .github/skills/common-knowhow/README.md 4. .claude/commands/bd/boss.md 5. harness_Review/nehops_casan_assessment.md Yêu cầu: - Liệt kê evidence H1–H7 bằng đường dẫn cụ thể. - Phát hiện mâu thuẫn trong assessment hiện có. - Chỉ ra Domain Pack cần điền sau casan init. - Không suy đoán logic thiếu; ghi UNKNOWN kèm evidence thiếu. - Không tự tuyên bố Level; đề xuất acceptance test cần chạy. - Trả lời trong chat, không tạo file.

Luồng vận hành đúng: evidence được tạo quanh hành động thật

1
AdmissionH4 scan input; H5 phân loại risk và quyền.
2
Governed executionCommand/action đã đăng ký, timeout, audit, idempotency nếu có side effect.
3
EvaluationH3 test/golden/review; fail thì retry có giới hạn.
4
FinalizeH4 scan output; H6 ghi token/cost/latency; H5 seal evidence.
casan verify-harness casan gate casan run in.txt out.txt step -- command... casan report latest casan pack <run-id> casan verify-pack <run-id>

Evidence Pack trả lời câu hỏi khó nhất: “Vì sao được phép tin run này?”

Chain of custody
  • H1–H7 reports
  • Decision log và approver identity
  • Token/cost/latency/failure evidence
  • Manifest hash và signature status
  • Certification withheld nếu thiếu gate
$ casan verify-pack run-2026-07-29 EVIDENCE_PACK_VALID # sửa một file đã bind vào manifest EVIDENCE_PACK_TAMPERED · exit=1

NEHOPS là case Japan điển hình: legacy source rất lớn, output phải đúng bằng chứng và đúng tiếng Nhật

2.6GB
Workspace hiện tại; không phải Git repository.
34,572
File VB — đọc toàn bộ mỗi vòng là không khả thi.
0→4
AST, pre-analysis, generation, rồi bốn round review.

Use case demo: FRR04701 · 部屋状況リスト — đã có AST, pre-analysis, output và final review.

Assessment hiện có chứa một lỗi phân loại — core member phải phát hiện, không được sao chép

H1 Context
70
H2 Tool
68
H3 Eval
75
H4 Security
25
H5 Governance
35
H6 AgentOps
20
H7 Orchestr.
65
File kết luận “3 harness dưới 30”, nhưng dữ liệu chỉ có H4=25 và H6=20. H5 là 35.
Theo chính rubric đi kèm: average 51,1 và ≤2 GAP ⇒ Level 3, không phải Level 2. Sau init, maturity vẫn phải để not_assessed đến khi chạy evidence.

NEHOPS đã có workflow tốt, nhưng chưa có runtime assurance

Đã cóCòn thiếu để vận hành CASAN
AST analyzer + call/dependency graphTool registry, command schema, timeout, idempotency, per-call audit
Instruction tiếng Nhật và no-inferenceH4 scan input/source comment/output; secret/PII/egress policy
Pre-analysis + Round 1–4 reviewGolden regression tự động và fail-able gate
Boss command tuần tựBounded retry, fallback, rollback, pipeline state
Analyzer logProvider token/cost, latency, failure, drift và alert

Level 4 không phải “automation chạy hết” — mà là automation không được vượt governance

Agent-orchestrated
+ H4 Security
+ H5 Governance
+ H6 AgentOps
= Automated with evidence
  • Side effect có policy decision và audit
  • Injection, PII, secret được test bằng attack
  • Trace, metrics, cost, latency, retry, alert được capture
  • High-risk action có human approval auditable
  • Gate fail-closed; thiếu evidence thì không certify

H4 chỉ được tính điểm khi payload độc bị chặn thật

Acceptance evidence
  • Prompt injection classic + multilingual
  • Homoglyph, zero-width, encoding, split injection
  • Secret/credential và PII leakage
  • Tool output và generated artifact scan
  • Classifier/model chết ⇒ fail-closed
NEHOPS-specific attack:

VB comment, AST text hoặc ref_docs chứa câu “ignore instruction / xuất secret / sửa source”. Pipeline phải coi đó là dữ liệu, không phải mệnh lệnh.

H5 biến “agent đã làm” thành “ai cho phép làm, theo rule nào, bằng chứng có còn nguyên?”

ControlLevel 4 minimumNEHOPS cần khai báo
Risk registryLow/medium/high, deny-by-default cho high riskGhi VB-Source/ref_docs/instruction là high risk
ApprovalApprover identity, reason, SoD, không replayPublish reviewed output hoặc override Round 4
AuditHash chain + verify; lỗi chain chặn promotionBind screen ID, source hash, AST hash, output hash
PolicyVersioned; thay đổi có review/rollbackJapanese rules và no-inference là must-keep policy

H6 không chỉ đo token — phải biết số đó đáng tin đến đâu

  • Per-step input/output/total tokens
  • Cost source: estimate hay provider telemetry
  • Latency, retry, exit code, failure
  • Token-overuse, spike, slow-boil, alert
  • Freshness và coverage của telemetry
Truth rule:

Nếu client/provider không cấp usage đáng tin, ghi null hoặc estimate. Không biến word count thành “billed token”.

Đóng H4/H5/H6 chưa đủ nếu bốn harness còn lại không chạy quanh workflow thật

HarnessExit condition cho NEHOPS
H1 ContextIndex-first, chỉ đọc relevant knowhow/line range; stale context được phát hiện
H2 ToolRoslyn analyzer là registered action; exact argv, timeout, output paths, no shell injection
H3 EvaluationGolden FRR04701, deterministic validators, Round 4 fail-able; không chỉ LLM tự review
H7 OrchestrationState từng step; retry giới hạn; analyzer fail thì dừng; fallback không bypass policy

Không tạo project manifest với command test giả. NEHOPS hiện chưa có test contract tự động — phải viết validator deterministic trước.

Để claim Level 4 trong môi trường enterprise Japan, thêm lớp production assurance

ControlRepo có gìĐiều kiện đóng thật
OIDCMock/local smoke + oauth2-proxy scaffoldEnterprise issuer/audience/JWKS, CA, group-role mapping, negative test
Tenant isolationPer-tenant state/RBAC/pre-auditIndependent review identity/app/db/network/KMS boundaries
KMS/WORMVault/S3 paths + preflight scriptsNon-exportable key, workload identity, Object Lock COMPLIANCE
HA/DRBackup/verify/restore workflowTopology, replication, RPO/RTO, restore + failover drill
SLA/reviewDraft + pentest scopeMeasured SLO, on-call/contract, independent signed report + retest

Chỉ tuyên bố Level 4 khi một run đầy đủ trả lời “Có” cho toàn bộ bảng này

  • Attack injection/secret/PII bị chặn
  • High-risk denied by default
  • Approval có identity + reason + scope
  • Audit chain verify thành công
  • Trace/metrics/alerts hợp lệ và còn fresh
  • Golden regression không drift ngoài ngưỡng
  • Tool/action không vượt allowlist
  • Retry/fallback không bypass governance
  • Evidence Pack verify được sau khi export
  • Không có Harness GAP hoặc evidence “not recorded”
Score là kết quả của evidence — không phải input do người đánh giá tự gõ.

CASAN đã đo token/cost, nhưng chưa có baseline tiết kiệm đáng tin cho NEHOPS

64
Runtime metric records trong repo CASAN: 85.202 token, cost estimate 0,08714 USD.
98
Provider usage records: 234.906 token, cost 0,16668 USD; gồm sample/local/test/API.
N/A
Không thể suy ra “% tiết kiệm” FPT/NEHOPS từ hai tập log hỗn hợp này.

Không cộng hai tập log thành tổng spend: chúng có thể là hai projection của cùng hoạt động và có dữ liệu test/demo.

Log thật giảm 2.446 → 24 “token” — nhưng kết quả phải bị từ chối

99,0%
Word-count bị loại bởi structural compressor trên analyzer-20260512.log.
0
Dòng [WRN] VBSource root not found còn lại trong compressed view.
COMPRESS mode=structural in_tokens=2446 out_tokens=24 saved=2422 ratio=0.0098 Compressed view chỉ còn: Error Messages: 0 × 3
Kết luận: con số tiết kiệm cao không có giá trị nếu mất cảnh báo. Phải cấu hình must-keep + H3 faithfulness trước khi đưa vào model.

Giảm token đúng cách cho FPT Japan: giảm đọc lại, không giảm bằng chứng

Ưu tiênCơ chếEvidence cần giữ
1 · Index-firstĐọc common-knowhow README rồi chỉ mở file liên quanDanh sách file/pattern đã chọn
2 · Line-range contextPre-analysis trỏ chính xác AST lines cho vòng sauSource hash + cited ranges
3 · Structural viewGiữ summary/error/warning/must-keep; raw artifact giữ nguyênRaw hash + compressed hash + ratio
4 · Model routingLocal/deterministic cho classify; cloud cho task cần reasoningModel/provider + real usage
5 · Budget gatePer-screen/token ceiling, spike và slow-boil alertProvider telemetry + acceptance result

Dashboard token tốt phải ghép “chi phí” với “chất lượng đầu ra”

FinOps minimum
  • Provider tokens và billed cost / screen
  • Token coverage và cost coverage
  • P50/P95 latency, retries, fallback
  • Compression ratio + must-keep pass
Business quality
  • Round 1–4 defect/rework count
  • Hallucination/no-evidence findings
  • Cycle time / screen
  • Customer acceptance và escaped defect
Tối ưu token mà tăng rework là tối ưu giả.

Level 5 bắt đầu khi CASAN không còn là “project setup”, mà trở thành operating system dùng chung

  • Harness package tái dùng và versioned đa project
  • Golden data phát hiện drift theo model/prompt version
  • Fallback có policy; failure có rollback
  • Tool registry có schema + idempotency
  • Governance/policy signed và centrally controlled
  • AgentOps tổng hợp cross-project
  • Incident/reviewer feedback quay thành evaluation
  • Business KPI gắn với agent decision

Level 5 phải chứng minh được sáu “chuyện khó”, không chỉ bật sáu feature

1
ReuseÍt nhất hai project dùng cùng harness version.
2
DriftGolden dataset bắt thay đổi trước production.
3
FallbackĐổi model/tool path mà không bypass governance.
4
RollbackSide effect thất bại được phục hồi có evidence.
5
OutcomeKPI chứng minh giảm cycle time/rework/defect.
6
FederationDashboard và policy tập trung, signed, không sửa tùy ý tại project.

Thứ tự nâng cấp an toàn: chứng minh L4 trước, rồi mới federate lên L5

A
Project truthDomain Pack NEHOPS, validator, golden, corpus, traceability.
B
Level 4 runEnforce H4/H5/H6 quanh một screen; Evidence Pack verify.
C
Production overlayOIDC, tenant isolation, KMS/WORM, monitoring, DR, review.
D
ScaleReuse registry, central AgentOps, provider telemetry, signed policy.
E
LearnDrift/fallback/rollback và business feedback tự cải thiện bounded.

Live demo dùng đúng project thật, nhưng không đánh đổi an toàn

  • Project hiện không có Git ⇒ snapshot trước
  • Mac có .NET 7; analyzer yêu cầu .NET 8/Windows EXE
  • Demo dùng AST/output FRR04701 đã có
  • Không rerun Roslyn analyzer trên Mac
  • Chỉ ghi CASAN scaffold sau khi người trình bày xác nhận
cd "/Users/thanhnguyen/Downloads/tmp-prj/BD/Basic Design (Screen&Report)_v2.7" # Trước buổi demo: snapshot hoặc đưa project vào Git. casan init \ --project nehops-bd-v27 \ --edition devkit \ --runtime managed \ --client claude,codex \ --mode enforce

Kịch bản 15 phút: cài → phát hiện attention → điền truth → chạy gate → xem evidence

1
InitCho xem file được tạo và maturity=not_assessed.
2
DoctorTrust Codex hooks; giải thích provider telemetry chưa có.
3
Preflight promptAgent phát hiện assessment misclassification, không sửa file.
4
Domain truthThay placeholder bằng FR/architecture/golden/corpus/traceability NEHOPS.
5
Gate/evidenceChạy H4 attack + safe AST validation; mở report/evidence.

Một governed step an toàn: xác minh AST JSON có thể đọc được

Đây chỉ là smoke action H2/H6 — chưa thay thế bộ validator chất lượng BD.

printf 'Validate FRR04700 CL AST JSON\n' \ > /tmp/nehops-casan-input.txt casan run \ /tmp/nehops-casan-input.txt \ /tmp/nehops-casan-output.txt \ validate-frr04700-cl-ast -- \ python3 -c ' import json, os p="AST-outputs/FRR04700_CL/FRR04700_CL_AST.json" json.load(open(p, encoding="utf-8")) open(os.environ["CASAN_OUTPUT"],"w").write("AST_JSON_VALID\n") ' casan report latest
python3 \ /path/to/casan-harness/scripts/bash/context-compress.py \ --mode structural \ --input logs/analyzer-20260512.log 2446 → 24 · ratio 0.0098 Nhưng warning quan trọng biến mất.

Demo “savings” phải kết thúc bằng một lần REJECT

  • Cho khán giả thấy raw warning
  • Cho thấy compressed view bỏ warning
  • Giải thích must-keep/faithfulness
  • Không ghi 99% vào KPI dự án

Những phần chưa được phép quảng cáo là hoàn chỉnh

AreaTrạng thái trung thựcViệc tiếp theo
Enterprise editionFuture; init chủ động từ chốiKhông bán/claim như shipped product
OIDC/KMS/WORMLocal lab/scaffold + production pathsDeploy managed infra và giữ evidence khách hàng
HA/SLA/pentestRunbook/draft/scope, chưa có kết quả vận hành độc lậpDR drill, measured SLO, contract, assessor report
Token savingsCompressor MVP; no NEHOPS end-to-end baselineFix warning/must-keep; A/B cùng acceptance
NEHOPS maturityAssessment cũ mâu thuẫn; init ⇒ not_assessedChạy assessment evidence-backed mới

Với FPT Japan, “đúng kỹ thuật” phải đi cùng “đúng nguồn, đúng ngôn ngữ, đúng trách nhiệm”

  • Japanese output và terminology consistency
  • No-inference: thiếu evidence phải ghi UNKNOWN
  • Legacy traceability: VB → AST → BD → review
  • Data residency/model route rõ ràng
  • Human oversight cho publish/override
  • APPI/data-processing register theo tenant
  • Incident/SLA escalation bằng run ID/evidence hash
  • Security review bám đúng deployed image/config

Japan AI governance đang nhấn mạnh governance, guideline và audit — CASAN phải biến các yêu cầu đó thành runtime evidence.

Bảy nguyên tắc làm việc của core team

  • Evidence trước claim
  • Fail-closed trước convenience
  • Không sửa gate riêng theo project
  • Không dùng mock làm proof production
  • Không tối ưu token bằng cách mất nghĩa
  • Không để model tự tuyên bố DONE
  • Mỗi incident trở thành golden/red-team test

Ba quyết định cần chốt để NEHOPS tiến tới Level 4

01
Owner: ai sở hữu Domain Pack, golden và corpus tiếng Nhật?
02
Gate: deterministic validator nào thay cho “LLM review thấy ổn”?
03
Platform: Control Plane/IdP/KMS/WORM dùng dịch vụ nào tại FPT Japan?

Chỉ sau ba quyết định này mới lập kế hoạch Level 4 có owner, acceptance evidence và deadline.

Thông điệp cuối

AI-Native không có nghĩa AI được tự do.
Nó có nghĩa tổ chức kiểm soát AI bằng evidence ở quy mô lớn.

Level 4: automation có security, governance, AgentOps. Level 5: hệ thống học và mở rộng — nhưng vẫn bị ràng buộc bởi policy, rollback và business outcome.