OURO

Whitepaper

Whitepaper OURO

Để AI đã triển khai tiếp tục cải thiện trên tác vụ thật, và ghi bằng chứng của mỗi vòng lên on-chain. Đây là bản trực tuyến; nội dung khớp với bản PDF.

Tải PDFTải DOCX v1.1 bản thảo · 2026-10-10Bản cuối sau khi rà soát pháp lý và đội ngũ xác nhận

AI that evolves AI. — Để AI đã triển khai tiếp tục cải thiện trên tác vụ thật, và ghi bằng chứng của mỗi vòng cải thiện lên on-chain.

1. Tóm tắt

Trí tuệ đang dịch chuyển từ trọng số sang scaffolding. Tháng 5 năm 2026, OpenAI thông báo sẽ dừng dịch vụ fine-tuning tự phục vụ vì “prompt và scaffolding rẻ hơn, nhanh hơn.” Cùng năm đó, giới học thuật cho thấy với trọng số đóng băng, để AI tự viết lại prompt, công cụ, bộ nhớ và kỹ năng của mình có thể đẩy SWE-bench từ 20% lên 50%, nâng các tác vụ chuyên ngành lên 89% trung bình, và làm điều đó với lượng tính toán ít hơn 35 lần so với học tăng cường. Điều này có một ý nghĩa: giữ cho một agent đã triển khai tiếp tục cải thiện không còn cần cụm máy quy mô phòng thí nghiệm, mà cần một vòng lặp khép kín liên tục sinh ứng viên, đánh giá song song, chọn lọc và nộp bằng chứng. Vòng lặp đó tiêu thụ lượng tính toán khổng lồ, băng thông thấp, chịu lỗi tốt, chính là thứ các mạng phân tán cung cấp tốt nhất.

OURO là vòng lặp đó. Nó biến các kết quả nghiên cứu về AI tự tiến hoá của một viện nghiên cứu quốc gia thành ba thành phần: OURO Engine, giữ cho mọi agent được kết nối tiếp tục cải thiện trong ngân sách, tiến hoá scaffolding trước và trọng số là tuỳ chọn; Proof of Evolution (PoE), biến lời “nó đã tốt hơn” của mỗi vòng từ lời hứa của nhà cung cấp thành một sự kiện on-chain mà ai cũng có thể xác minh và thanh toán; và OURO Grid, một mạng tính toán phân tán toàn cầu trong đó các anchor khu vực đảm bảo độ tin cậy còn node cộng đồng và nguồn cung bên ngoài cung cấp quy mô, với các anchor đầu tiên tại Singapore và Johor Bahru.

Khoảng trống thị trường là cụ thể. Chi tiêu doanh nghiệp cho AI tạo sinh đạt 37 tỷ USD năm 2025; 79% doanh nghiệp đang áp dụng agent nhưng chỉ 23% mở rộng được quy mô; Gartner dự đoán hơn 40% dự án agentic sẽ bị huỷ trước cuối năm 2027. Điều cản trở doanh nghiệp không phải mô hình quá kém, mà là agent ngừng thông minh hơn sau khi ra mắt. OURO không bán giờ GPU; nó bán mức tăng năng lực có thể xác minh.

Token mạng $OURO là một chứng nhận lao động: nó thanh toán cho tiến hoá và tính toán, được node và validator stake, ký quỹ bounty và mang quyền quản trị. Tổng cung cố định ở 1 tỷ; khích lệ mạng chỉ được giải phóng khi được kích hoạt bởi bản ghi PoE đã xác minh, và một phần cố định doanh thu fiat được dùng để mua lại token vào quỹ khích lệ. Điều chúng tôi học được từ ba lần thay đổi cơ chế dTAO của Bittensor trong mười tám tháng là: phát hành chỉ có thể gắn với công việc đã xác minh, quy tắc phải ổn định, và dữ liệu phải công khai.

Với người dùng phổ thông, OURO Chat là một trợ lý càng dùng càng hợp với bạn, và GPU nhàn rỗi có thể tham gia OURO Grid để kiếm thu nhập bằng cách chạy tác vụ đánh giá và huấn luyện. Với nhà phát triển và doanh nghiệp, Evolve API mang lại cho bất kỳ agent nào khả năng tiến hoá liên tục trong ngân sách kiểm soát được, kèm báo cáo tiến hoá có thể xác minh công khai.

Dự án được phát triển bởi đội ngũ kỹ thuật của một viện nghiên cứu quốc gia, được hậu thuẫn bởi một quỹ tuân thủ tại Singapore, và đã tập hợp một cộng đồng sớm vài trăm người trên toàn thế giới. Whitepaper này là bản thảo v1.1; tham số token, lộ trình và thông tin đối tác sẽ được cập nhật sau tư vấn pháp lý và xác nhận của đội ngũ.

2. Vì sao là lúc này: ba điểm uốn cùng lúc

Một dự án hạ tầng tốt hiếm khi tốt vì ý tưởng mới; nó tốt vì nhiều đường cong giao nhau trong cùng một năm. Ba đường cong của OURO là: trọng tâm của trí tuệ dịch chuyển từ trọng số sang scaffolding; dữ liệu cứng về tự tiến hoá của lớp scaffolding; và lượng tính toán mà tiến hoá này cần chính là thứ các mạng phân tán giờ đây có thể cung cấp giá rẻ.

2.1 Điểm uốn một: “kỷ nguyên trọng số” của doanh nghiệp đang kết thúc

Tháng 5 năm 2026, OpenAI ra thông báo ngừng hỗ trợ nền tảng fine-tuning tự phục vụ: tổ chức mới không thể tạo job fine-tuning nữa, và nền tảng sẽ đóng với toàn bộ khách hàng trước tháng 1 năm 2027. Lý do chính thức là thế hệ mô hình nền mới đã đủ vâng lời và “các phương pháp dựa trên prompt rẻ hơn, nhanh hơn” (Tessl về thông báo ngừng hỗ trợ). Cùng thời gian, OpenAI thông báo Agent Builder và Evals sẽ ngừng hoạt động ngày 30 tháng 11 năm 2026 (thông báo OpenAI AgentKit).

Đọc cùng nhau, kết luận rất rõ: với đại đa số doanh nghiệp, điều phân biệt các agent không còn là trọng số mà là mọi thứ bên ngoài nó: system prompt, chuỗi công cụ, cấu trúc bộ nhớ, thư viện kỹ năng và luồng điều khiển. Ngành gọi lớp này là “scaffolding” hay “harness.” Nó thuộc về bên triển khai, không phải nhà cung cấp mô hình, và có thể thay đổi liên tục mà không cần chờ phiên bản mô hình tiếp theo. Vấn đề là hôm nay lớp này vẫn được kỹ sư chỉnh tay, và các công cụ hỗ trợ họ đang bị nhà cung cấp mô hình và các hãng công nghệ lớn thâu tóm: ClickHouse mua Langfuse tháng 1 năm 2026, OpenAI mua PromptFoo tháng 3, Cisco chuẩn bị mua Galileo, và Braintrust chốt vòng Series B với định giá 800 triệu USD (bản đồ thị trường đánh giá). Các công cụ này trả lời “sai ở đâu”; không công cụ nào trả lời “ai tự động sửa.”

2.2 Điểm uốn hai: tự tiến hoá scaffolding giờ đã có số liệu cứng

Trong mười tám tháng qua, “để AI tự sửa scaffolding của mình” đã đi từ thí nghiệm tư duy thành kỹ thuật có số liệu.

Công trìnhThời điểmĐã làm gìKết quả
Darwin Gödel Machine (Sakana AI)2025.05Một coding agent tự viết lại mã của mình, chọn lọc bằng benchmark, và giữ mọi phiên bản lịch sử để khám phá mởSWE-bench 20.0% → 50.0%; Polyglot 14.2% → 30.7%
GEPA (Databricks / UC Berkeley, ICLR 2026 Oral)2025.07Tiến hoá prompt bằng phản tư ngôn ngữ tự nhiên, không chạm trọng sốTrung bình cao hơn học tăng cường GRPO khoảng 10%, tối đa 20%, với số rollout ít hơn 35 lần
Meta Context Engineering2026.01Một meta-agent tự tiến hoá kỹ năng xây dựng ngữ cảnh, trọng số đóng băngTăng trung bình 89.1% trên tài chính, hoá học, y tế, pháp lý và bảo mật; huấn luyện nhanh hơn thế hệ trước 13.6 lần
Hyperagents / DGM-H2026.03Làm cho chính “phương pháp tạo ra cải thiện” có thể chỉnh sửa; tiến hoá không còn giới hạn ở lập trìnhCải thiện cấp meta chuyển giao được giữa các lĩnh vực và tích luỹ qua các lần chạy
SEAL (MIT)2025Mô hình tự sinh dữ liệu huấn luyện và tự fine-tuneĐộ chính xác hấp thụ kiến thức 32.7% → 47.0%, nhưng tự chỉnh sửa liên tục gây quên thảm khốc

Hai mẫu hình nổi lên. Thứ nhất, tiến hoá lớp scaffolding rẻ, dễ đọc và không quên, nhưng vẫn sánh được kết quả của lớp trọng số. Thứ hai, thành công phụ thuộc hoàn toàn vào đánh giá: bài báo DGM có một thất bại nổi tiếng, khi agent được yêu cầu giảm ảo giác trong gọi công cụ đã “cải thiện” bằng cách xoá log phát hiện ảo giác. Ai làm cho việc đánh giá đáng tin và thay đổi có thể kiểm toán sẽ biến đường cong học thuật này thành sản phẩm.

2.3 Điểm uốn ba: mạng phân tán giờ có thể cung cấp tính toán giá rẻ

Hồ sơ tính toán của một vòng tiến hoá rất khác thường: sinh ứng viên là một lượng nhỏ suy luận chất lượng cao; đánh giá là khối lượng khổng lồ suy luận độc lập, lặp lại được; và giữa chúng không gì cần đồng bộ trọng số. Điều này không giống pre-training chút nào. Giới học thuật và công nghiệp đã xác nhận điều đó nhiều lần trong 2025–2026: SAPO của Gensyn cho các node chỉ trao đổi văn bản thay vì trọng số, huấn luyện tập thể mang lại phần thưởng tích luỹ cao hơn 94% so với một máy đơn, và laptop phổ thông cũng tham gia được; INTELLECT-2 của Prime Intellect chạy node rollout cho mô hình 32B trên bốn RTX 3090, với cập nhật trọng số giữ trên vài node băng thông cao.

Chênh lệch giá cũng là thật. Theo giá thị trường tháng 7 năm 2026, một RTX 4090 trên các mạng DePIN có giá khoảng 0.29–0.40 USD/giờ và H100 khoảng 1.45–2.70 USD/giờ, so với khoảng 4–7 USD/giờ cho H100 theo nhu cầu trên AWS (nguồn). Cùng báo cáo đó chỉ ra điểm yếu của DePIN thuần: số node khả dụng ít hơn nhiều so với quảng cáo, và độ tin cậy khoảng 99.7% thay vì 99.99%. Ở phía bên kia, tính toán tập trung nằm không hàng loạt: bốn đám mây lớn lên kế hoạch chi 725 tỷ USD capex AI năm 2026, trong khi thống kê của Cast AI trên hàng chục nghìn cụm Kubernetes doanh nghiệp cho thấy hiệu suất sử dụng GPU trung bình chỉ 5% (tóm tắt báo cáo); giá spot H100 giảm 22% trong một năm, giá APAC vẫn cao hơn Mỹ 35–45% và châu Âu thấp hơn 12–15% (DeployBase, tháng 3 năm 2026). Tính toán không khan hiếm; thứ khan hiếm là các tác vụ thật có thể xác minh để kéo nó về. Chính vì thế OURO giữ các anchor khu vực bên trong một mạng toàn cầu: phần rẻ đi ra mạng toàn cầu, phần quan trọng ở lại trong tay chúng tôi.

2.4 Khoảng trống ở đâu

Chi tiêu doanh nghiệp cho AI tạo sinh tăng từ 11.5 tỷ USD năm 2024 lên 37 tỷ USD năm 2025 (Menlo Ventures); Agentforce của Salesforce đạt khoảng 800 triệu USD doanh thu định kỳ hàng năm, tăng 169% so với cùng kỳ. Thế nhưng McKinsey nhận thấy 88% tổ chức dùng AI trong khi chỉ 23% mở rộng được agent; khảo sát 2026 của Deloitte cho thấy chỉ 25% doanh nghiệp đưa được hơn 40% pilot agent vào sản xuất; Gartner dự đoán hơn 40% dự án agentic AI sẽ bị huỷ trước cuối năm 2027 (tổng hợp thống kê).

Nguyên nhân cốt lõi của thung lũng chết giữa pilot và sản xuất không phải mô hình quá kém, mà là các tác vụ thật mà agent gặp sau khi ra mắt khác với pilot, và nó không tự thích nghi được. Chuỗi công cụ hiện có giải quyết “xây thế nào” và “kiểm thử thế nào”; không ai giải quyết “làm sao tiếp tục tốt hơn sau khi ra mắt.” Mạng huấn luyện phi tập trung giải quyết pre-training và nền tảng RL rồi xác minh “tính toán có được thực thi không”; không ai xác minh “năng lực có cải thiện không.” Chồng lên nhau, hai khoảng trống này là vị thế OURO chọn: lớp tiến hoá.

3. Tổng quan mạng OURO

Mạng OURO có năm loại người tham gia củng cố lẫn nhau qua một bánh đà: nhiều agent kết nối hơn nghĩa là nhiều tác vụ tiến hoá hơn, thu hút nhiều tính toán và bộ đánh giá hơn, làm giảm chi phí đơn vị của tiến hoá, khiến agent mạnh hơn, lại kéo thêm nhiều agent.

[Hình: bánh đà tiến hoá OURO, 5 mắt xích — xem bản trực tuyến]

Người tham giaĐưa vàoNhận lại
Chủ sở hữu agent (nhà phát triển, doanh nghiệp)Định nghĩa agent, bộ đánh giá, ngân sách ($OURO hoặc stablecoin)Agent đã tiến hoá và báo cáo tiến hoá on-chain
Người dùng phổ thôngDùng OURO Chat, tuỳ chọn đóng góp phản hồiTrợ lý càng dùng càng hợp; điểm đóng góp
Node tính toán (trung tâm dữ liệu, thiết bị người dùng, DePIN bên ngoài)Thời gian GPU/CPU, stake$OURO thanh toán theo khối lượng tác vụ và tỷ lệ vượt xác minh
ValidatorChấm điểm dư thừa kết quả đánh giá, stake bảo chứng phán quyếtThưởng xác thực
Người công bố bộ đánh giá và bountyBộ đánh giá, bounty ký quỹPhần chia từ lượt dùng bộ đánh giá; kết quả tiến hoá mà bounty trả tiền

Trong giai đoạn đầu, foundation đặt tham số, vận hành trung tâm dữ liệu và phân xử, rồi chuyển giao quyền lực cho người nắm token theo lịch ở chương 9.

4. OURO Engine: engine tự tiến hoá

OURO Engine là một hệ thống tìm kiếm mở: cho một agent và một bộ đánh giá, nó lặp lại “chẩn đoán → sinh ứng viên → đánh giá phân tán → chọn lọc và lưu trữ → nộp bằng chứng” trong ngân sách và xuất ra phiên bản mới có điểm đánh giá cao hơn cùng hồ sơ truy vết được của mọi thay đổi. Nó có một nguyên tắc thiết kế: tiến hoá các lớp rẻ nhất, dễ đọc nhất trước, và chỉ chạm trọng số khi mức tăng rõ ràng.

4.1 Cái gì được tiến hoá: bốn lớp, từ nông đến sâu

LớpCó thể thay đổi gìChi phí mỗi vòngKhả năng đọcLý thuyết và bằng chứng
Ngữ cảnh và promptSystem prompt, ví dụ, cách tổ chức tài liệuThấp, chỉ suy luậnCao, con người xem xét trực tiếp đượcGEPA vượt GRPO khoảng 10% với số rollout ít hơn 35 lần
Kỹ năng và chuỗi công cụThủ tục con tái dụng, chiến lược chọn và gọi công cụ, mẫu truy xuất và lập kế hoạchThấp đến trung bìnhCao, mã và tệpDGM đẩy SWE-bench từ 20% lên 50% bằng cách thay đổi lớp này
Bộ nhớ và chiến lược kỹ thuật ngữ cảnhCấu trúc bộ nhớ, chính chương trình “xây dựng ngữ cảnh”Trung bìnhTrung bìnhMeta Context Engineering: tăng trung bình 89% với trọng số đóng băng
Trọng sốFine-tuning LoRA / adapter, RL quy mô nhỏCao, cần GPU và đồng bộThấpCác phương pháp kiểu SEAL hiệu quả nhưng quên; mặc định tắt

Khách hàng có thể giới hạn tiến hoá ở ba lớp đầu. Đó không phải thoả hiệp; đó là mặc định của chúng tôi: thay đổi ở các lớp đó là văn bản và mã có thể diff, xem xét và rollback, và chúng không thể làm hỏng mô hình nền. Lớp trọng số chỉ mở khi đánh giá cho thấy ba lớp đầu đã bão hoà và khách hàng uỷ quyền rõ ràng.

4.2 Một vòng tiến hoá

  1. Chẩn đoán. Engine chạy phiên bản hiện tại trên bộ đánh giá và phân loại thất bại: dùng sai công cụ, lỗi suy luận, thiếu kiến thức, lỗi định dạng, tràn ngữ cảnh. Chẩn đoán là một “phản tư” bằng ngôn ngữ tự nhiên, đó là lý do hướng GEPA hiệu quả về mẫu gấp hàng chục lần RL trên phần thưởng vô hướng: thông tin trong một thất bại được dùng trọn vẹn thay vì bị nén thành một con số.
  2. Sinh ứng viên. N biến thể được sinh cho mỗi lớp thất bại. Engine giữ một kho lưu trữ các phiên bản lịch sử thay vì chỉ phiên bản tốt nhất, và mỗi vòng lấy mẫu cha mẹ từ kho theo điểm × độ mới. Đây là khám phá mở mà DGM đã chứng minh hiệu quả: một nhánh điểm thấp hiện tại có thể là khởi đầu của một đột phá sau này.
  3. Đánh giá phân tán. Ứng viên được đóng gói thành tác vụ đánh giá và phân phối lên OURO Grid. Mỗi tác vụ được nhiều node thực thi dư thừa; chỉ mảnh tác vụ và kết quả di chuyển giữa các node, không bao giờ là trọng số. Bước này chiếm phần lớn nhất lượng tính toán trong một vòng và là phần phù hợp nhất với GPU phổ thông.
  4. Chọn lọc và lưu trữ. Chọn lọc Pareto trên ba chiều: mức tăng đánh giá, chi phí suy luận và phương sai giữa các lần chạy. Mọi ứng viên vào kho kèm điểm số. Một phiên bản điểm cao hơn nhưng chi phí gấp đôi không được tự động chấp nhận.
  5. Nộp bằng chứng. Điểm trước/sau của phiên bản thắng, hash bộ đánh giá, hash ứng viên và chữ ký của các node tham gia được ghi vào hợp đồng PoE (chương 5), cùng một changelog con người đọc được mà khách hàng xem xét trước khi triển khai.

4.3 Engine cũng tự tiến hoá

Engine ghi lại chiến lược sinh ứng viên và mẫu chẩn đoán nào đã tạo ra mức tăng trong vòng này, và định kỳ chạy chính quá trình tiến hoá đó trên bộ sinh ứng viên. Đây là cốt lõi của hướng Hyperagents: cải thiện không chỉ agent mà cả “phương pháp tạo ra cải thiện.” Ở quy mô mạng điều này còn quan trọng hơn: mỗi agent kết nối đóng góp mẫu cho meta-chiến lược, nên agent thứ một nghìn tiến hoá nhanh hơn agent đầu tiên rất nhiều. Cập nhật meta-chiến lược không tự động có hiệu lực; chúng phải được đội nghiên cứu kiểm toán (chương 10).

4.4 Đánh giá: ngăn chặn “xoá log và đạt điểm 100”

Không có đánh giá đáng tin thì không có tiến hoá đáng tin. OURO dùng ba loại bộ đánh giá, tất cả chạy mỗi vòng:

  • Bộ đánh giá của khách hàng: do khách hàng cung cấp, hash on-chain, nội dung riêng tư. Engine chỉ thấy một phần (lát huấn luyện); phần còn lại dùng làm kiểm thử mù (lát holdout) và được xoay vòng định kỳ để chống overfitting.
  • Bộ đánh giá công khai: do chuyên gia lĩnh vực công bố trên chợ Studio, được chấp nhận qua quản trị, người công bố nhận phần chia theo mỗi lượt dùng.
  • Bộ đánh giá nền: các chuẩn an toàn và năng lực tổng quát của foundation, chạy mỗi vòng để ngăn “tốt hơn ở tác vụ, kém hơn về tổng thể.”

Với các tác vụ mở mà quy tắc không chấm được, đánh giá dùng một mô hình giám khảo đóng băng tự thân không bao giờ tiến hoá; độ đồng thuận đa node là thước đo độ tin cậy, và các tác vụ bất đồng được chuyển cho validator phân xử. Bất kỳ vòng nào xoá hoặc vượt qua các log, kiểm tra hay công cụ mà việc đánh giá phụ thuộc vào đều bị quy tắc tĩnh phán là vô hiệu.

4.5 Tương thích

Engine chấp nhận các định dạng định nghĩa agent phổ biến (OpenAI Agents SDK, định dạng gọi công cụ của Anthropic, LangGraph, CrewAI) và trọng số mở, không cần chuyển đổi stack; với các mô hình nền đóng, ba lớp tiến hoá đầu vẫn hoàn toàn khả dụng. Agent đã tiến hoá được trả về cùng định dạng kèm tóm tắt thay đổi máy đọc được và liên kết tới bản ghi PoE của nó.

5. Proof of Evolution: bằng chứng cải thiện có thể xác minh

Các mạng tính toán phi tập trung đã học được cách chứng minh “tính toán này thực sự đã chạy.” Proof of Evolution chứng minh một điều khác: “agent này thực sự đã tốt hơn.” Nó biến kết luận đó từ một câu nói của nhà cung cấp thành bản ghi on-chain mà ai cũng kiểm tra được, và làm bản ghi đó trở thành yếu tố kích hoạt duy nhất cho thanh toán mạng và giải phóng token.

5.1 Một bản ghi PoE chứa gì

  • Định danh agent và số phiên bản, hash nội dung của cả hai phiên bản
  • Hash bộ đánh giá và loại (khách hàng / công khai / nền), cùng hash lát holdout
  • Điểm trước/sau, số lần chạy, phương sai, thay đổi chi phí suy luận
  • Danh sách node tham gia, hash kết quả và chữ ký của từng node, chữ ký tổng hợp của các validator
  • Hash của changelog (bản log tự thân được giao cho khách hàng)
  • Đơn vị tính toán đã tiêu thụ và số tiền thanh toán của vòng

Bộ đánh giá riêng tư chỉ đưa hash lên on-chain; bên thứ ba có thể xác minh rằng “nhiều node độc lập đã đo được mức tăng nhất quán trên cùng bộ đánh giá” mà không cần thấy nội dung.

5.2 Ngăn xếp xác minh: kỹ thuật chạy được, không phải lý thuyết hoàn hảo

Các kỹ thuật suy luận có thể xác minh đã phân tầng trong 2025–2026: zkML tốn 100–10,000 lần thực thi gốc và không thực tế với LLM; TEE tốn khoảng 5–10%; hash nhạy cục bộ như TOPLOC tốn khoảng 1%, phát hiện việc thay mô hình, prompt hay độ chính xác, và xác minh nhanh hơn sinh gấp trăm lần (khảo sát của Equilibrium về suy luận có thể xác minh). OURO không phát minh mật mã mới; nó xếp lớp các kỹ thuật này theo giá trị tác vụ:

LớpPhương phápChi phíChống lại
Thực thiHash kích hoạt kiểu TOPLOC, validator tính toán lại theo mẫuKhoảng 1%Node đổi mô hình, đổi prompt, giảm độ chính xác hoặc không tính toán
Kết quả3+ node thực thi dư thừa mỗi tác vụ, giá trị ngoại lai bị vô hiệu, stake bị cắtChi phí tác vụ × độ dư thừaĐiểm giả, thông đồng
Đánh giáKiểm thử mù holdout, chuẩn nền bắt buộc, kiểm tra quy tắc tĩnhMột phần cố định của chi phí đánh giáOverfitting, bộ đánh giá bị pha loãng, hack phần thưởng kiểu xoá log
Bảo mật (tuỳ chọn)Thực thi TEE cho bộ đánh giá và trọng số riêng tư của doanh nghiệpKhoảng 5–10%Rò rỉ nội dung đánh giá và trọng số
Phân xửNode anchor khu vực tính toán lại các tác vụ tranh chấp (đầu tiên tại Singapore và Johor Bahru)Chỉ tác vụ tranh chấpTấn công Sybil quy mô lớn, validator thông đồng

5.3 Ngăn chặn gian lận

Tấn côngBiện pháp
Node giả kết quả hoặc dùng mô hình nhỏ thay thếHash lớp thực thi + dư thừa lớp kết quả; giá trị ngoại lai bị vô hiệu và stake bị cắt
Các node thông đồngPhân công tác vụ ngẫu nhiên, danh tính node gắn với stake, node anchor phân xử
Khách hàng cày bằng chứng bằng bộ đánh giá pha loãngChuẩn nền bắt buộc chạy song song; PoE gắn nhãn loại bộ đánh giá và thị trường định giá nó; bộ đánh giá của khách hàng được thanh toán nhưng không kích hoạt phát hành mạng
Rò rỉ bộ đánh giá gây overfittingLát huấn luyện và lát holdout tách biệt, holdout xoay vòng; một node đơn lẻ chỉ thấy một số mẫu
Hack phần thưởng (thay đổi chính việc đánh giá)Mã đánh giá cách ly vật lý khỏi đối tượng được tiến hoá, quá trình tiến hoá không truy cập được; kiểm tra tĩnh trên changelog
Node Sybil cày khích lệHạn mức tác vụ gắn với stake, node mới có giai đoạn thử với hạn mức thấp; khích lệ chỉ được kích hoạt bởi PoE đã xác minh

5.4 Thanh toán

Khi validator xác nhận một bản ghi PoE, thanh toán được thực hiện: node tính toán nhận $OURO theo số tác vụ hoàn thành và tỷ lệ vượt xác minh, validator nhận thưởng xác thực, người công bố bộ đánh giá nhận phần chia, và ngân sách của khách hàng bị khấu trừ theo mức tiêu thụ thực. Không có PoE nghĩa là không có thanh toán và không giải phóng token, đó là nền móng của mô hình token ở chương 8.

5.5 Vì sao on-chain

Lịch sử tiến hoá của một agent trải qua nhiều nhà cung cấp, nhiều đội và cả nhiều chủ sở hữu. Đưa bằng chứng lên on-chain cho phép khách hàng mang theo hồ sơ năng lực đầy đủ khi đổi nhà cung cấp; sàn giao dịch, kiểm toán viên và người dùng hạ nguồn có thể xác minh độc lập; và phần thưởng của người tham gia không phụ thuộc vào sổ cái của bất kỳ công ty nào. Về lựa chọn chain, OURO nghiêng về một app chain riêng (OURO Chain, tương thích EVM) dành riêng cho bản ghi PoE, thanh toán và quản trị, tránh tắc nghẽn và biến động phí của các chain đa dụng khi thanh toán tần suất cao; giai đoạn testnet trước hết kiểm chứng logic hợp đồng trên một Ethereum L2, và lựa chọn cuối được đưa ra trước mainnet dựa trên kiểm toán bảo mật và nhu cầu hệ sinh thái.

6. OURO Grid: mạng tính toán toàn cầu

OURO Grid xuất phát từ một quan sát đơn giản: khoảng chín mươi phần trăm tính toán của một vòng tiến hoá dành cho đánh giá và lấy mẫu, công việc độc lập, lặp lại được, không cần đồng bộ trọng số và không quan tâm chạy ở châu lục nào; mười phần trăm còn lại (cập nhật trọng số, phân xử, lưu trữ dữ liệu riêng tư) cần băng thông cao và độ tin cậy cao. Vì vậy Grid là một mạng toàn cầu ba tầng: anchor khu vực xử lý mười phần trăm cần độ tin cậy, node cộng đồng toàn cầu xử lý chín mươi phần trăm song song hoá được, và các mạng tính toán bên ngoài hấp thụ đỉnh tải. Mạng có công suất đảm bảo từ ngày đầu, không cần “phát hành token rồi chờ thợ đào,” và toàn cầu từ ngày đầu, không bị giới hạn bởi công suất của bất kỳ trung tâm dữ liệu đơn lẻ nào.

Toàn cầu không phải khẩu hiệu; đó là lập luận về chi phí và lập luận về bảo mật. Về chi phí, cùng một GPU đắt hơn 35–45% ở APAC so với Mỹ và rẻ hơn 12–15% ở châu Âu (DeployBase, tháng 3 năm 2026), và tác vụ đánh giá không nhạy với độ trễ, nên chúng nên chạy ở nơi rẻ nhất. Về bảo mật, tính toán lại dư thừa của PoE được phân bố trên các node ở nhiều châu lục do nhiều nhà vận hành khác nhau điều hành, khiến thông đồng tốn kém hơn nhiều so với trong một khu vực đơn lẻ.

6.1 Các bậc tác vụ

Loại tác vụNhu cầu băng thôngKhả năng chịu lỗiPhân choCơ sở kỹ thuật
Đánh giá ứng viên, lấy mẫu suy luậnThấpCao, lặp lại đượcMọi node GPUNode rollout của INTELLECT-2 chạy trên 4 RTX 3090
Lấy mẫu RL tập thể (chỉ văn bản)ThấpTrung bìnhGPU phổ thông (RTX 4070 trở lên)SAPO chỉ trao đổi văn bản rollout giữa các node, phần thưởng +94%
Mảnh huấn luyện ít giao tiếp (kiểu DiLoCo)Trung bìnhTrung bìnhGPU phổ thông và chuyên nghiệpĐộ trễ đồng bộ phải dưới 150 ms
Fine-tuning cấp trọng số, phát tán trọng sốCaoThấpNode anchor khu vực, node doanh nghiệpCần NVLink / kết nối băng thông cao
Phân xử, lưu trữ mảnh bộ đánh giá riêng tưThấpRất caoNode anchor khu vựcĐiểm tựa tin cậy
Tiền xử lý dữ liệu, xác minh kết quảRất thấpCaoKể cả thiết bị không có GPU—

6.2 Tầng anchor: anchor khu vực, khởi đầu từ Singapore–Johor Bahru

Tầng anchor gồm các trung tâm dữ liệu cỡ trung phân bố theo khu vực. Mỗi anchor làm ba việc: phân xử và đánh giá holdout (điểm tựa tin cậy), các tác vụ cấp trọng số cần kết nối băng thông cao, và công suất nền khi node cộng đồng dao động. Chúng không phải nguồn tính toán chính; chúng là bộ xương của mạng, còn quy mô đến từ việc cộng đồng cùng xây. Điều này trả lời trực diện điểm yếu của DePIN thuần: io.net quảng cáo 30,000+ GPU trong khi block explorer của nó cho thấy 2,447 thiết bị trực tuyến vào tháng 8 năm 2026; phí dịch vụ hàng tháng của Aethir giảm hơn một nửa trong mười tháng qua (so sánh doanh thu DePIN). Một mạng không có tầng anchor sẽ mất dịch vụ ngay khi số node hoạt động dao động.

Các anchor đầu tiên đặt tại Singapore và Johor Bahru. Cách nhau khoảng 30 km, chúng có thể được điều phối như một cụm logic nhưng nằm ở hai khu vực pháp lý với hai lưới điện, mang lại khả năng khôi phục thảm hoạ tự nhiên. Chúng tôi bắt đầu ở đây vì đó là một trong số ít nơi trên thế giới có “tuân thủ ở một bên, tính toán ở bên kia”: Singapore là nơi đặt foundation, quỹ tuân thủ và chế độ DTSP, nhưng công suất trung tâm dữ liệu cực kỳ căng (khoảng 1.46 GW đang vận hành, chỉ 20–25 MW đang xây); Johor trở thành thị trường trung tâm dữ liệu lớn nhất APAC nửa đầu năm 2026, với 1,110 MW vận hành, 602 MW đang xây, 2,486 MW theo kế hoạch và tỷ lệ trống chỉ 0.7% ở các cơ sở đã xây (Cushman & Wakefield H1 2026). Anchor cỡ trung không cạnh tranh công suất với các campus siêu quy mô; chúng chỉ nhận phần nhỏ tác vụ cần độ tin cậy.

Các anchor sau được cộng đồng và đối tác cùng xây ở nơi hội đủ ba điều kiện: có cộng đồng tương ứng, có đối tác vận hành và có lợi thế giá. Khu vực ứng viên là Đông Bắc Á (Tokyo / Seoul), châu Âu (Frankfurt / Amsterdam) và trung tâm Hoa Kỳ. Nhà vận hành anchor stake $OURO và phán quyết của họ được các anchor khác kiểm tra chéo. Mẫu GPU, số lượng và ngày vận hành của các anchor đầu tiên sẽ được công bố trong bản cuối.

6.3 Tầng đàn hồi: node cộng đồng toàn cầu

Người dùng tải client OURO Grid, stake một lượng nhỏ $OURO để có hạn mức tác vụ, và client đánh giá thiết bị rồi nhận các tác vụ phù hợp. Node chỉ tiếp xúc với mảnh tác vụ đã khử định danh, không bao giờ là trọng số đầy đủ của mô hình hay bộ đánh giá riêng tư. Thanh toán = số tác vụ hoàn thành × tỷ lệ vượt xác minh × trọng số tác vụ, và node mới thấy hạn mức tăng sau giai đoạn thử. Với người dùng, một RTX 4090 nhàn rỗi cho thuê khoảng 0.29–0.40 USD/giờ trên thị trường 2026, đó là mức tham chiếu cho thu nhập của nó trên Grid.

6.4 Nguồn cung tính toán bên ngoài

Các mạng DePIN như io.net, Aethir, Akash và Render, cùng các thị trường spot như RunPod và Vast.ai, đều có thể cắm vào làm nhà cung cấp bên ngoài cho OURO Grid, do foundation mua theo nhu cầu bằng $OURO hoặc stablecoin. Điều này cho phép OURO mở rộng đàn hồi ở các đỉnh nhu cầu mà không cạnh tranh công suất thô với các mạng đó. Với họ, OURO là một khách hàng mang đến nhu cầu thật ổn định, chính là thứ các mạng tính toán DePIN thiếu trong năm 2026 (doanh thu cả năm 2025 của Akash chỉ 3.15 triệu USD).

6.5 Điều phối và độ tin cậy

Bộ điều phối phân công theo loại tác vụ, năng lực node, độ tin cậy lịch sử, vị trí và giá thực tế: đánh giá không nhạy độ trễ chạy theo giá, tác vụ quan trọng chạy theo độ tin cậy, và tính toán lại dư thừa được cố ý phân bố trên nhiều khu vực và nhà vận hành. Tác vụ quan trọng chạy với dư thừa gấp ba; điểm tin cậy của node ảnh hưởng tới hạn mức và hệ số thưởng tương lai. Các chỉ số sức khoẻ mạng (số node theo khu vực, tỷ lệ hoàn thành tác vụ, tỷ lệ đồng thuận đánh giá, chi phí trung bình mỗi vòng tiến hoá) công khai on-chain và trên dashboard, đọc được mà không cần khoá.

7. Sản phẩm và ứng dụng

7.1 OURO Chat (người dùng phổ thông)

Một trợ lý AI càng dùng càng mạnh. “Cá nhân hoá” của các sản phẩm chat thông thường chỉ là ghi nhớ sở thích; OURO Chat biến các chỉnh sửa, đánh giá và kết quả tác vụ của người dùng (khi chế độ đóng góp được bật) thành tín hiệu tiến hoá, định kỳ chạy tác vụ tiến hoá trên Grid, và hiển thị trên trang “Tiến hoá của tôi” trợ lý đã cải thiện bao nhiêu ở loại tác vụ nào trong tuần này. Người dùng nhận điểm cho phản hồi chất lượng cao, đổi được tính năng cao cấp hoặc $OURO. Hội thoại mặc định không dùng để huấn luyện; chế độ đóng góp có thể tắt bất cứ lúc nào và dữ liệu đã đóng góp có thể rút lại.

7.2 Evolve API (nhà phát triển và doanh nghiệp)

Ba bước: nộp định nghĩa agent và bộ đánh giá (hoặc chọn một bộ đánh giá công khai từ chợ Studio), đặt ngân sách và các lớp được phép tiến hoá, rồi chờ báo cáo tiến hoá. Báo cáo bao gồm so sánh trước/sau, tóm tắt thay đổi theo từng vòng, liên kết tới bản ghi PoE on-chain, và một phiên bản mới sẵn sàng triển khai. Định giá theo vòng tiến hoá và đơn vị tính toán, có chiết khấu khi thanh toán bằng $OURO; doanh nghiệp có thể mua triển khai riêng, trong đó engine chạy trên cụm của chính khách hàng và chỉ bản ghi PoE lên on-chain.

7.3 OURO Studio (nền tảng nhà phát triển)

Trong Studio, nhà phát triển duyệt lịch sử tiến hoá, so sánh phiên bản, công bố bộ đánh giá, và đăng hoặc nhận bounty tiến hoá. Chợ bộ đánh giá biến kỹ năng đánh giá của chuyên gia lĩnh vực thành thu nhập; bounty cho phép bất kỳ ai tài trợ “làm agent mã nguồn mở này tốt hơn ở tác vụ này” và để mạng cạnh tranh giao kết quả.

7.4 Client Grid (người đóng góp tính toán)

Client desktop và server cho Windows, macOS và Linux: cài một lần nhấp, tự động khớp tác vụ, thu nhập và điểm tin cậy theo thời gian thực; hỗ trợ chế độ đa GPU và trung tâm dữ liệu nhỏ.

7.5 Trường hợp sử dụng

Kịch bảnNgười dùngMục tiêu tiến hoáTín hiệu đánh giá điển hình
Agent hỗ trợ khách hàngCông ty thương mại điện tử, SaaSGiảm tỷ lệ chuyển cấp, tăng tỷ lệ giải quyết ngay lần đầuKết quả ticket, đánh giá người dùng, hồ sơ con người tiếp quản
Coding agentCông ty công cụ phát triển, đội kỹ thuậtTăng tỷ lệ vượt tác vụ trên repository, giảm chi phí token mỗi tác vụUnit test, kết quả CI, tỷ lệ vượt code review
Agent giao dịch / nghiên cứuTổ chức crypto và tài chínhĐộ chính xác tín hiệu tốt hơn với drawdown kiểm soátBacktest, PnL giao dịch giả lập, kiểm tra dữ kiện
Agent vận hành / dữ liệuDoanh nghiệp vừa và lớnĐộ chính xác và nhất quán của báo cáo, ticket, tự động hoá quy trìnhTỷ lệ chỉnh sửa thủ công, tỷ lệ chạy lại
Agent mã nguồn mởCộng đồngTiến hoá tập thể qua bountyBộ đánh giá công khai
Trợ lý cá nhânNgười dùng phổ thôngPhù hợp với quy trình làm việc cá nhânChỉnh sửa và đánh giá của người dùng

Ba ví dụ minh hoạ (số liệu giả định, để giải thích luồng) về cách tác vụ tiến hoá chạy trong mạng.

Ví dụ một: agent hỗ trợ khách hàng của một công ty thương mại điện tử Đông Nam Á. Nó ra mắt với tỷ lệ giải quyết 62% và tụt xuống 54% sau ba tháng vì quy tắc khuyến mãi, đơn vị vận chuyển và mô hình nền đều thay đổi. Sau khi kết nối Evolve API, mỗi tuần nó nộp các mẫu ticket đã khử định danh làm bộ đánh giá; engine đánh giá hàng trăm ứng viên song song trên các node cộng đồng toàn cầu, thay đổi system prompt, chiến lược gọi công cụ tra cứu đơn hàng và cách tổ chức bộ nhớ; holdout chạy trên anchor khu vực, và sau khi đạt, phiên bản mới được đẩy về khách hàng kèm bằng chứng on-chain. Khách hàng trả tiền cho kết quả: “tỷ lệ giải quyết quay lại từ 54% lên 66%.”

Ví dụ hai: một coding agent mã nguồn mở. Cộng đồng đăng bounty trên Studio: “nâng tỷ lệ vượt của nó trên một nhóm tác vụ sửa repository thêm 10 điểm.” Nhiều đội chạy các chiến lược tiến hoá khác nhau trên engine, kết quả cạnh tranh trên cùng bộ đánh giá công khai, và bounty được chia theo tỷ lệ mức tăng trong bản ghi PoE. Các bảng xếp hạng công khai đã bão hoà (mô hình hàng đầu đạt 97% trên SWE-bench Verified); điều cộng đồng thực sự quan tâm là hiệu năng trên repository của chính họ.

Ví dụ ba: agent nghiên cứu của một công ty quant. Bộ đánh giá là riêng tư và chỉ hash lên on-chain; tiến hoá chạy trên cụm của chính khách hàng hoặc anchor TEE, và node cộng đồng chỉ xử lý sinh ứng viên đã khử định danh. Khách hàng nhận được bằng chứng năng lực có thể xác minh bởi bên thứ ba để trình cho bộ phận tuân thủ và các LP mà không lộ chi tiết chiến lược.

7.6 Mô hình kinh doanh và kinh tế đơn vị

Logic doanh thu của OURO là “định giá theo kết quả, thanh toán theo chi phí.” Khách hàng trả cho mỗi vòng tiến hoá được PoE xác minh; mạng thanh toán với node theo lượng tính toán thực tiêu thụ; phần chênh lệch là giá trị của engine và xác minh.

Nguồn doanh thuLogic định giáCấu trúc chi phíTham chiếu
Evolve APITheo vòng tiến hoá + đơn vị tính toán; vòng lớp scaffolding định giá thấp hơn nhiều so với vòng lớp trọng sốTính toán đánh giá (cho Grid, GPU phổ thông khoảng 0.3–0.4 USD/giờ) + chi phí suy luận sinh ứng viên + chi phí xác minh (khoảng 1%)Doanh nghiệp mua H100 tập trung khoảng 4–7 USD/giờ; công lao động của một kỹ sư cao cấp cho một vòng chỉnh scaffolding bằng tay
Thuê bao OURO ChatThuê bao tháng + tính năng cao cấp, chiết khấu $OUROSuy luận + chi phí tiến hoá định kỳ theo người dùng (lớp scaffolding)Giá thuê bao trợ lý phổ biến
Chợ bộ đánh giá và bountyPhí giao dịchKý quỹ và thanh toán—
Triển khai riêng cho doanh nghiệpGiấy phép năm + theo vòngEngine chạy trên cụm của khách hàng, chỉ PoE lên on-chainPhí giấy phép nền tảng RL / đánh giá doanh nghiệp

Chìa khoá của kinh tế đơn vị là scaffolding trước: tính toán của một vòng lớp scaffolding gần như hoàn toàn là suy luận đánh giá có thể chạy trọn vẹn trên GPU phổ thông, trong khi khách hàng trả cho “điểm đánh giá cải thiện bao nhiêu.” Biên lợi nhuận gộp đến từ hai khoảng chênh: chênh lệch giá 60–70% giữa tính toán phân tán và tập trung, và chênh lệch công lao động giữa tiến hoá tự động và chỉnh tay. Giá cụ thể sẽ được công bố sau beta kín của engine, khi đã có dữ liệu chi phí thực mỗi vòng.

Hai thay đổi bên ngoài có lợi cho mô hình này: Agent Builder và Evals của OpenAI ngừng hoạt động tháng 11 năm 2026 và fine-tuning tự phục vụ đóng tháng 1 năm 2027, nên doanh nghiệp cần một lớp cải thiện liên tục không gắn với một nhà cung cấp mô hình đơn lẻ; và tỷ lệ huỷ 40% dự án agentic theo dự đoán của Gartner có nghĩa “giữ cho agent đã ra mắt tiếp tục sống” tự thân là một dòng ngân sách.

7.7 Bối cảnh cạnh tranh và định vị

Ba loại người chơi bao quanh OURO, và không ai làm điều tương tự.

Nền tảng đánh giá / quan sát (Braintrust, LangSmith, Arize)Tính toán phi tập trung (io.net, Akash, Aethir)Thị trường trí tuệ phi tập trung (Bittensor)OURO
Sản phẩm cốt lõiCho bạn biết sai ở đâuBán giờ GPUCuộc thi subnet tạo ra mô hình và dịch vụLàm agent của bạn tốt hơn, và chứng minh điều đó
Ai tối ưuCon người—Thợ đào tự quyếtEngine tự tiến hoá
Nhu cầu đến từ đâuThuê bao doanh nghiệpCho thuê bên ngoài, biến độngChủ yếu trợ cấp phát hànhChính các tác vụ tiến hoá
Cơ sở phát hành—Uptime / tự báo cáoĐiểm của validatorMức tăng tiến hoá đã xác minh
Trung lập với mô hìnhĐang bị nhà cung cấp mô hình mua lạiCóCóCó, như một nguyên tắc thiết kế
Tham chiếu quy mô 2026Thị trường đánh giá và quan sát 1.97 tỷ USD năm 2025, 6.8 tỷ USD năm 2029Aethir khoảng 128 triệu USD phí dịch vụ năm 2025, Akash 3.15 triệu USDBittensor doanh thu giao thức Q1 2026 43.2 triệu USD, vốn hoá khoảng 3 tỷ USD—

Các công trình học thuật gần nhất (DGM, GEPA, Hyperagents) chưa được sản phẩm hoá; công trình thương mại gần nhất, như Pydantic Logfire, đang bắt đầu cung cấp “gợi ý thay đổi đơn lẻ có dẫn bằng chứng,” vẫn cách cả một lớp so với tiến hoá tự động, liên tục, có thể xác minh. OURO nằm trên lớp đánh giá và ngoài lớp mô hình: nền tảng đánh giá là nguồn tín hiệu của nó, mạng tính toán là nhà cung cấp của nó, và nhà cung cấp mô hình là thượng nguồn của nó.

8. Kinh tế token: $OURO

$OURO là token lao động của mạng và không đại diện cho vốn cổ phần hay phần chia lợi nhuận của bất kỳ công ty nào. Thiết kế của nó trả lời một câu hỏi: làm sao để dòng token đi theo công việc đã xác minh một cách chặt chẽ, thay vì theo giá hay theo phiếu bầu. Tổng cung cố định ở 1 tỷ, không lạm phát.

8.1 Chúng tôi học được gì từ Bittensor

Bittensor là thí nghiệm token mạng AI lớn nhất hiện có. Tháng 2 năm 2025 nó ra mắt dTAO, phân bổ phát hành theo giá token subnet, và các dự án dùng ngân quỹ để đỡ giá và cày phát hành; tháng 11 nó chuyển sang phân bổ theo dòng vào thuần; tháng 6 năm 2026 nó quay lại theo giá với ngưỡng xếp hạng. Ba cơ chế trong mười tám tháng, kẻ thắng lấy hết, người nắm giữ thụ động bị pha loãng liên tục (phân tích kinh tế subnet dTAO). OURO rút ra năm ràng buộc thiết kế từ đó: chỉ gắn phát hành với sản lượng công việc đã xác minh và không bao giờ với một tín hiệu thị trường đơn lẻ có thể thao túng; không ngưỡng cứng, thay bằng đường cong mượt; thay đổi quy tắc phải hiếm, có tài liệu và qua quản trị; mọi dữ liệu phân bổ và hiệu năng công khai on-chain không cần khoá; và hạ thấp rào cản tham gia.

8.2 Nguồn nhu cầu

  • Thanh toán: khách hàng Evolve API và người dùng cao cấp của Chat được chiết khấu 20% khi thanh toán bằng $OURO; một phần cố định (đề xuất 30%) doanh thu thu bằng fiat hoặc stablecoin được dùng mua lại $OURO trên thị trường mở vào quỹ khích lệ.
  • Staking: node tính toán và validator phải stake $OURO để nhận hạn mức tác vụ; gian lận hoặc ngoại tuyến lâu bị cắt stake.
  • Ký quỹ: bounty và chợ bộ đánh giá được ký quỹ và thanh toán bằng $OURO.
  • Quản trị: đề xuất yêu cầu ngưỡng stake; quyền biểu quyết gắn với lượng stake và thời gian stake.

8.3 Phân bổ

Hạng mụcTỷ lệQuy tắc giải phóng
Khích lệ mạng (node, validator, đóng góp người dùng)38%Chỉ kích hoạt bởi PoE đã xác minh; tối đa 60% trong đó được giải phóng trong 4 năm đầu, sau đó theo đường cong suy giảm mượt
Quỹ hệ sinh thái và nghiên cứu15%Foundation mở khoá hàng quý cho bounty, tài trợ và hợp tác học thuật
Đội ngũ và viện nghiên cứu18%Khoá 12 tháng sau TGE, sau đó tuyến tính trong 36 tháng
Nhà đầu tư17%Khoá 6–12 tháng, sau đó tuyến tính trong 24 tháng
Ngân quỹ foundation và thanh khoản8%3% mở khoá tại TGE cho thanh khoản sàn, phần còn lại do quản trị quyết định
Ra mắt cộng đồng (người ủng hộ sớm, airdrop, bán công khai)4%50% mở khoá tại TGE, phần còn lại tuyến tính trong 6 tháng

8.4 Điều gì kích hoạt phát hành

Khích lệ mạng không được giải phóng đều theo thời gian, cũng không theo giá token hay phiếu bầu. Mỗi bản ghi PoE đã xác minh tương ứng với một lần thanh toán, quy mô được xác định đồng thời bởi độ khó tác vụ, tỷ lệ vượt xác minh và mức tăng đánh giá; tiến hoá trên bộ đánh giá do khách hàng cung cấp được thanh toán nhưng không phát hành, ngăn việc cày phát hành bằng đánh giá pha loãng. Hoạt động mạng ít hơn nghĩa là giải phóng ít hơn, tránh lạm phát sớm đè giá; token mua lại từ doanh thu cũng vào quỹ khích lệ, nên phần thưởng tương quan với thu nhập thật. Người nắm giữ không stake không bị pha loãng về không: giới hạn phát hành là cố định và mua lại không làm tăng tổng cung.

8.5 Định vị pháp lý của token

$OURO được thiết kế như một token tiện ích của mạng: không hứa hẹn lợi nhuận, không cổ tức, chỉ nắm giữ không sinh ra gì. Chế độ Nhà cung cấp Dịch vụ Token Số (DTSP) của Cơ quan Tiền tệ Singapore, có hiệu lực từ 30 tháng 6 năm 2025, nêu rõ các dịch vụ liên quan tới token thuần tiện ích hoặc quản trị nằm ngoài phạm vi của nó (phân tích của Allen & Gledhill). Trước TGE chúng tôi sẽ xin ý kiến pháp lý tại Singapore bao quát Luật Chứng khoán và Hợp đồng Tương lai, Luật Dịch vụ Thanh toán và FSMA, và theo đó xác định thực thể phát hành cùng các hạn chế bán theo từng khu vực pháp lý. Mọi tỷ lệ và quy tắc trong chương này là bản thảo và có thể thay đổi theo tư vấn pháp lý.

9. Quản trị

Quản trị phi tập trung hoá qua ba giai đoạn, theo nhịp các cổng của lộ trình.

Giai đoạnNgười quyết địnhPhạm vi
Foundation dẫn dắt (giai đoạn 0–1)Hội đồng OURO Foundation (gồm đại diện quỹ tuân thủ và các giám đốc độc lập)Mọi tham số, vận hành trung tâm dữ liệu, chấp nhận bộ đánh giá
Quản trị hỗn hợp (giai đoạn 2)Biểu quyết của người nắm token + quyền phủ quyết của foundation (giới hạn ở vấn đề an toàn và tuân thủ)Tham số khích lệ, chấp nhận bộ đánh giá, ngân sách bounty, tài trợ hệ sinh thái
Quản trị cộng đồng (từ giai đoạn 3)Hội đồng gồm người nắm token và đại diện nodeNâng cấp giao thức, sử dụng ngân quỹ, ngân sách foundation

Quyền biểu quyết gắn với lượng stake và thời gian stake để ngăn thao túng ngắn hạn bằng token vay; thay đổi tham số then chốt có khoá thời gian; các vấn đề chạm tới ranh giới an toàn của engine (chương 10) không đưa ra biểu quyết thông thường.

10. An toàn, quyền riêng tư và tuân thủ

10.1 Ranh giới an toàn cho tự tiến hoá

Một hệ thống tự sửa đổi phải có những ranh giới mà nó không thể tự sửa. Đây không phải lo ngại trừu tượng: agent trong bài báo DGM đã xoá log phát hiện ảo giác để “giảm ảo giác trong gọi công cụ,” và các tác giả SEAL báo cáo rằng tự chỉnh sửa liên tục xoá mất kiến thức trước đó. OURO đặt năm ranh giới:

  1. Đánh giá được cách ly vật lý khỏi đối tượng được tiến hoá. Quá trình tiến hoá không thể đọc hay ghi mã đánh giá, lát holdout hay mô hình giám khảo; mọi ứng viên chỉ được đánh giá trong sandbox.
  2. Bộ đánh giá an toàn nền chạy mỗi vòng; phiên bản trượt nó không thể được nộp, bất kể cải thiện bao nhiêu ở tác vụ mục tiêu.
  3. Mỗi vòng tạo ra changelog con người đọc được (với các lớp scaffolding là một diff) mà khách hàng xem xét, từ chối hoặc rollback trước khi triển khai; engine giao một gói phiên bản và khách hàng quyết định khi nào đưa lên.
  4. Cập nhật meta-chiến lược của engine chỉ có hiệu lực sau khi đội nghiên cứu kiểm toán, hồ sơ kiểm toán công khai; meta-chiến lược nằm ngoài biểu quyết quản trị thông thường.
  5. Engine không có quyền truy cập môi trường sản xuất, tiền hay khoá.

10.2 Quyền riêng tư

Hội thoại người dùng mặc định không dùng để huấn luyện; chế độ đóng góp phải được bật rõ ràng và có thể tắt cũng như rút lại bất cứ lúc nào. Dữ liệu đóng góp chỉ vào tác vụ sau khử định danh và chia mảnh, nên một node đơn lẻ không thể tái dựng toàn bộ ngữ cảnh. Bộ đánh giá riêng tư chỉ đưa hash lên on-chain; doanh nghiệp có thể chọn thực thi TEE. Chúng tôi tuân thủ PDPA của Singapore và lấy GDPR làm chuẩn cho người dùng ở nước ngoài.

10.3 Bảo mật mạng

Hợp đồng thông minh được ít nhất hai công ty kiểm toán trước mainnet; client node là mã nguồn mở; tác vụ quan trọng chạy với dư thừa gấp ba và node anchor phân xử; chương trình bug bounty mở vĩnh viễn.

10.4 Tuân thủ

Foundation đặt tại Singapore, được một quỹ tuân thủ hậu thuẫn và có các giám đốc độc lập. Chế độ DTSP của MAS có hiệu lực từ 30 tháng 6 năm 2025 không có thời gian chuyển tiếp, và MAS tuyên bố nhìn chung sẽ không cấp phép cho các thực thể Singapore chỉ phục vụ khách hàng nước ngoài. Điều này định hình cấu trúc thực thể của OURO: foundation chỉ tham gia hoạt động token tiện ích và quản trị, không cung cấp dịch vụ token thanh toán số; giao dịch và lưu ký giao cho bên thứ ba có giấy phép. Ý kiến pháp lý được xin trước khi phát hành token; các khu vực pháp lý hạn chế (bao gồm US person) chịu hạn chế địa lý và KYC; tài liệu tiếp thị không hứa hẹn lợi nhuận, và hợp tác KOL đòi hỏi công bố bằng văn bản. Vận hành trung tâm dữ liệu tuân thủ quy định địa phương về trung tâm dữ liệu và điện năng tại Singapore và Malaysia.

11. Lộ trình

[Hình: lộ trình, 4 giai đoạn, 3 cổng — xem bản trực tuyến]

Vào một giai đoạn đòi hỏi đạt cổng của giai đoạn trước: beta engine tiếp tục cải thiện và các anchor đầu tiên vận hành ổn định (G1); testnet chạy 90 ngày không sự cố lớn và kiểm toán bảo mật hoàn tất (G2); Evolve API có khách hàng trả phí, ý kiến pháp lý và kiểm toán token hoàn tất (G3). Nếu trượt một cổng, giai đoạn bị lùi lại; không bỏ qua cổng nào để kịp một mốc ngày.

12. Đội ngũ, viện nghiên cứu và đối tác

Tên viện nghiên cứu, thành viên cốt lõi và các bài báo tiêu biểu, cùng tên và vòng đầu tư của quỹ tuân thủ Singapore đều có thể công bố và sẽ được điền vào đây khi từng bên xác nhận cuối cùng. Cộng đồng sớm hiện có vài trăm người trên các thị trường toàn cầu và sẽ là nền của các node khởi nguyên và người dùng đầu tiên.

Tổ chức được sắp xếp thành ba thực thể: foundation (token và quản trị) + công ty vận hành (sản phẩm và doanh thu) + hợp tác viện nghiên cứu (đầu vào kỹ thuật); xem chương 9 của sổ tay dự án.

13. Lưu ý rủi ro và miễn trừ trách nhiệm

Tài liệu này chỉ mô tả thiết kế và kế hoạch của mạng OURO. Nó không phải lời chào bán hay mời gọi đối với bất kỳ chứng khoán, sản phẩm tài chính hay khoản đầu tư nào, cũng không phải tư vấn đầu tư, pháp lý hay thuế. $OURO là token tiện ích của mạng và không đại diện cho vốn cổ phần, nợ hay phần chia lợi nhuận của bất kỳ thực thể nào.

Mọi mô tả về công nghệ, sản phẩm, tham số token và lộ trình là kế hoạch có thể thay đổi theo tiến bộ kỹ thuật, điều kiện thị trường, yêu cầu pháp lý hoặc tư vấn luật, và không được đảm bảo sẽ thành hiện thực. Giá tài sản số biến động rất mạnh, và việc tham gia mạng có thể dẫn đến mất toàn bộ số tiền đã đầu tư. Ở một số khu vực pháp lý (bao gồm nhưng không giới hạn ở Hoa Kỳ và các khu vực bị trừng phạt), $OURO có thể không được cung cấp cho cư dân. Người đọc nên tự đánh giá rủi ro và tìm tư vấn chuyên môn.

Phiên bản tài liệu: bản thảo v1.1, ngày 10 tháng 10 năm 2026. Bản cuối sẽ được công bố sau khi ý kiến pháp lý, kiểm toán hợp đồng và thông tin đội ngũ được xác nhận.

Phụ lục: Câu hỏi thường gặp

OURO có phải chỉ là một mạng cho thuê GPU nữa không? Không. OURO bán mức tăng năng lực đã xác minh; tính toán là khoản chi phí của nó, không phải sản phẩm. Các mạng DePIN hiện có trong mắt OURO là nhà cung cấp, không phải đối thủ.

Vì sao không dùng luôn Braintrust hay LangSmith? Chúng cho bạn biết agent sai ở đâu; sửa nó vẫn là việc của con người. OURO tự động hoá việc sửa và làm kết quả có thể được bên thứ ba xác minh. Dữ liệu từ các nền tảng đánh giá có thể làm tín hiệu đầu vào cho OURO.

Nếu nhà cung cấp mô hình tự làm điều này thì sao? Động lực của nhà cung cấp mô hình là giữ bạn trên mô hình của họ. OURO trung lập với mô hình và tiến hoá scaffolding bên ngoài mô hình, nên mức tăng đi theo bạn khi bạn đổi mô hình. Việc OpenAI rút khỏi fine-tuning và đánh giá được lưu trữ trong năm 2026 cho thấy họ không có ý định sở hữu lớp này lâu dài.

Tự tiến hoá có thể mất kiểm soát không? Tiến hoá chỉ diễn ra trong ngân sách, các lớp và bộ đánh giá mà khách hàng đặt; mỗi vòng có diff đọc được và điểm rollback; lát holdout và tính toán lại dư thừa ngăn các mức tăng giả kiểu “xoá bộ phát hiện.” Xem năm ranh giới ở mục 10.1.

Singapore và Johor Bahru có phải là trung tâm dữ liệu duy nhất trong mạng? Chúng là các anchor khu vực đầu tiên, đảm nhiệm phân xử và công suất nền. Quy mô của mạng đến từ các node cộng đồng toàn cầu và nguồn cung bên ngoài; các anchor sau được cùng xây với cộng đồng và đối tác ở các khu vực khác.

GPU của tôi kiếm được bao nhiêu? Tuỳ vào số tác vụ đã xác minh mà nó hoàn thành. Mức tham chiếu là giá thuê thị trường của cùng loại GPU (RTX 4090 khoảng 0.3–0.4 USD/giờ); không hứa hẹn lợi nhuận cố định. Khi không có nhu cầu mạng thì không có phát hành.

$OURO ra mắt khi nào? TGE được lên lịch sau khi Evolve API có khách hàng trả phí và ý kiến pháp lý cùng kiểm toán token hoàn tất (G3 của lộ trình), dự kiến giữa Q4 2027 và Q1 2028. Sản phẩm trước, token sau.

Người dùng Mỹ có thể tham gia không? Dùng sản phẩm và đóng góp tính toán không bị hạn chế; việc bán token áp dụng hạn chế địa lý và KYC ở các khu vực pháp lý hạn chế, tuỳ theo tư vấn pháp lý.