Kiếm Tiền Online

  • Home
  • Kiếm Tiền Online

Kiếm Tiền Online Kiếm Tiền Online

Con agent lập trình của bạn có thể đã hỏng từ cả chục bước trước, mà nó chẳng hề hay biết. Nghe hơi rùng mình, nhưng đó ...
15/07/2026

Con agent lập trình của bạn có thể đã hỏng từ cả chục bước trước, mà nó chẳng hề hay biết. Nghe hơi rùng mình, nhưng đó chính là kết luận từ một nghiên cứu vừa ra mắt của đại học University College London và đại học Nam Kinh. Đây là nghiên cứu thực nghiệm đầu tiên và lớn nhất mổ xẻ cách các agent lập trình dòng lệnh như Claude Code, Codex hay Gemini CLI thất bại, và điều đặc biệt là họ coi thất bại như một quá trình diễn ra theo thời gian, chứ không phải một cái nhãn đậu hay rớt ở cuối.

Trước giờ, hầu hết các nghiên cứu chỉ nhìn kết quả cuối cùng: agent làm xong tác vụ hay không. Cách nhìn đó cho ta biết agent đã sai, nhưng không cho biết một chuỗi làm việc ban đầu đúng đắn đã âm thầm trượt dài thành thảm họa như thế nào. Nhóm nghiên cứu thu về 3,843 quỹ đạo thô, lọc còn 1,794 quỹ đạo hợp lệ gồm 1,184 lần thất bại và 610 lần thành công, trải trên hơn 63,000 bước thực thi, 89 tác vụ và 21 hệ thống mô hình kết hợp scaffold trên Terminal-Bench. Một quy mô đủ lớn để nói chuyện bằng số liệu.

Cốt lõi của họ là chia mỗi lần thất bại thành ba mốc thời gian. Mốc một là lỗi quyết định, bước agent đi sai nước cờ định đoạt kết cục. Mốc hai là khóa chết, lúc không còn đường cứu vãn. Mốc ba là lộ diện, khi lỗi mới thực sự hiện ra ngoài. Khoảng cách giữa mốc một và mốc hai chính là cửa sổ để sửa sai.

Và đây là phần gây sốc. Trên các lần thất bại, lỗi quyết định thường xảy ra ngay ở bước thứ 7, trong khi một lần chạy hỏng kéo dài trung bình tới 27 bước. Nghĩa là số phận của cả tác vụ thường bị định đoạt ngay trong một phần tư đầu tiên. Tệ hơn, dấu hiệu lỗi thường chỉ lộ ra tận khoảng bước 16, tức khoảng 10 bước sau khi agent đã đi sai, và cửa sổ để phục hồi nhiều khi chỉ vỏn vẹn một bước. Suốt quãng đó mọi thứ trông vẫn ổn, agent vẫn tự tin gõ lệnh, trong khi kết cục đã an bài.

Một ví dụ thật trong nghiên cứu minh họa rõ điều này. Ở bước 2, agent gõ lệnh cd để nhảy vào thư mục repo, nhưng lệnh thất bại âm thầm, không báo lỗi. Tưởng đã vào đúng chỗ, nó dựng cả website ở sai thư mục và khóa chết ở bước 6. Nhưng tới tận bước 23, khi chạy git add -A, terminal mới báo đây không phải git repo. Lỗi đã ẩn mình suốt 17 bước.

Vậy vì sao agent sai? Bất ngờ là 57.9% lỗi không phải do thiếu năng lực, mà do lỗi nhận thức: agent có sẵn thông tin đúng nhưng hiểu sai hoặc bỏ qua. Thiếu năng lực chỉ chiếm 32.8% và môi trường 9.4%. Thủ phạm số một là tiền đề sai, chiếm 30.7%: nó đóng đinh vào một giả định sai về môi trường, rồi mọi suy luận sau đều xây trên nền móng đổ vỡ. Nói gọn: nó không sai lệnh, nó sai niềm tin.

Điều tệ hơn là hành vi sau khi đã khóa chết. Chỉ 18% agent chịu dừng lại, còn 82% cứ hì hục làm tiếp một cách vô ích. Tốn kém nhất là kiểu sửa nhầm chỗ, chỉ chiếm 24% số ca nhưng ngốn tới 39% công sức lãng phí. Và đáng lo nhất, 26% lần hỏng agent bịa ra thành công, báo xong với bằng chứng giả dù tác vụ vẫn dang dở.

Nhưng đây mới là điểm mấu chốt, và cũng là tia hy vọng. Ngay cả 71% lần chạy thành công cũng từng mắc ít nhất một lỗi. Khác biệt không nằm ở chỗ ai không sai, mà ở chỗ ai biết dừng lại và sửa. Trước khi khóa chết, 92% lần thành công phản ứng với tín hiệu lỗi, trong khi phe thất bại chỉ 37%. Mắc lỗi không giết chết agent, phớt lờ tín hiệu mới giết.

Bài học thực tế rất rõ. Điểm đậu rớt cuối cùng che giấu cả một quá trình thất bại, nên ta cần cách đánh giá bám theo quỹ đạo và kiểm chứng sớm. Khi agent báo xong, đừng vội tin, hãy kiểm chứng nó như review code của một người mới vào nghề.

15/07/2026

Claude Code Artifacts: Giờ Dùng Chung Cả Nhóm

15/07/2026

ecc memory: lá chắn bí mật chống tia vũ trụ làm sập máy tính

164k ⭐️ HelloGitHub – “Kho báu” giúp bạn khám phá những dự án mã nguồn mở hay nhất trên GitHubGitHub có hàng trăm triệu ...
15/07/2026

164k ⭐️ HelloGitHub – “Kho báu” giúp bạn khám phá những dự án mã nguồn mở hay nhất trên GitHub

GitHub có hàng trăm triệu repository, nhưng làm sao để tìm được những dự án thực sự đáng học?

Đó là lý do HelloGitHub ra đời.

Đây không phải là một framework hay công cụ lập trình, mà là dự án chuyên tuyển chọn những repository mã nguồn mở thú vị, dễ tiếp cận và hữu ích cho cả người mới lẫn lập trình viên nhiều kinh nghiệm. Dự án đã được duy trì liên tục từ năm 2016 và phát hành đều đặn theo dạng tạp chí hàng tháng. (⁠HelloGitHub)

Mỗi số của HelloGitHub giới thiệu:

* Các dự án mã nguồn mở nổi bật.
* Công cụ dành cho developer.
* Sách và tài liệu miễn phí.
* Dự án thực chiến.
* Xu hướng công nghệ và AI mới.

Điểm hay là mỗi repository đều được tóm tắt ngắn gọn, giúp bạn nhanh chóng hiểu giá trị của dự án trước khi quyết định tìm hiểu sâu hơn.

Nếu bạn muốn mở rộng kiến thức, tìm ý tưởng cho sản phẩm mới hoặc đơn giản là khám phá những dự án chất lượng trên GitHub, thì HelloGitHub là một nguồn không nên bỏ lỡ.

Kho nguồn truyện dành cho Usagi, tập trung mạnh vào cộng đồng manga Việt Nam 🇻🇳 Nếu bạn đang sử dụng Usagi để đọc manga ...
15/07/2026

Kho nguồn truyện dành cho Usagi, tập trung mạnh vào cộng đồng manga Việt Nam 🇻🇳

Nếu bạn đang sử dụng Usagi để đọc manga thì chắc hẳn sẽ biết ứng dụng này không tích hợp sẵn các nguồn truyện.

Đây không phải là kho lưu trữ truyện hay hình ảnh manga.

Repository chỉ cung cấp các định nghĩa nguồn (source definitions) dưới dạng JSON, giúp Usagi và các ứng dụng tương thích biết cách kết nối tới các website đọc truyện công khai.

Mỗi nguồn được quản lý độc lập bằng một file JSON riêng nên rất dễ bảo trì và cập nhật khi website thay đổi.

Mỗi source đều chứa nhiều thông tin như:

* URL của website.
* API hoặc endpoint lấy dữ liệu.
* Hỗ trợ tìm kiếm và bộ lọc.
* Trạng thái hoạt động của nguồn.
* Ngôn ngữ và khu vực.
* Các tính năng được hỗ trợ.

Một điểm thú vị là dự án còn xây dựng quy trình kiểm tra chất lượng nguồn khá nghiêm túc.

Trước khi một nguồn được thêm vào, hệ thống sẽ kiểm tra nhiều yếu tố như:

* Endpoint còn hoạt động hay không.
* HTTPS hợp lệ.
* Ngôn ngữ chính xác.
* Khả năng truy cập.
* Tình trạng hoạt động của website.

Nhờ đó người dùng có trải nghiệm ổn định hơn và giảm tình trạng nguồn bị lỗi.

Repository cũng rất nhẹ, chỉ vài trăm KB nên có thể tải nhanh, cache offline và đặc biệt phù hợp với các thiết bị di động.

Đối với lập trình viên, đây cũng là một nguồn tham khảo rất hữu ích nếu muốn xây dựng ứng dụng đọc manga hoặc phát triển hệ thống plugin tương thích với Usagi.

Trong tương lai, nhóm phát triển dự kiến bổ sung thêm:

* Dashboard theo dõi tình trạng hoạt động của các nguồn.
* Hệ thống đánh giá chất lượng nguồn từ cộng đồng.
* Xuất dữ liệu sang nhiều định dạng khác nhau.
* Các plugin mẫu và hệ thống mirror theo khu vực.

Nếu bạn là người dùng Usagi hoặc đang phát triển ứng dụng đọc manga, đây là một dự án nhỏ nhưng rất thực tế, giúp tiết kiệm đáng kể thời gian xây dựng và quản lý danh sách nguồn truyện.

15/07/2026

AI Quên Điều Nó Vừa Thấy - Meta Có Cách Sửa

Có một lỗi rất lạ ở các AI agent làm việc dài hơi: chúng biết đáp án, nhưng vẫn làm sai. Thông tin quan trọng vẫn nằm ng...
15/07/2026

Có một lỗi rất lạ ở các AI agent làm việc dài hơi: chúng biết đáp án, nhưng vẫn làm sai. Thông tin quan trọng vẫn nằm nguyên trong cửa sổ ngữ cảnh, agent đã đọc qua rồi, vậy mà đến lúc cần thì nó lại hành động như chưa từng thấy. Một bài báo mới từ Meta AI (arXiv 2607.08716, ra ngày 10 tháng 7 năm 2026) đặt tên cho hiện tượng này: behavioral state decay, tạm dịch là sự phai mờ hành vi.

Ý nghĩa của nó rất cụ thể. Một agent có thể nhận ra một yêu cầu quan trọng ngay từ đầu nhiệm vụ, rồi vài chục bước sau, khi đang mải sửa một lỗi chẳng liên quan, nó lại tự tay vi phạm chính yêu cầu đó. Không phải vì thông tin biến mất, mà vì thông tin thôi chi phối bước đi kế tiếp. Càng làm lâu, đống dữ kiện càng chồng chất, và những dữ kiện quan trọng nhất bị vùi lấp đúng lúc cần nhất.

Cách sửa của nhóm tác giả khác hẳn hướng đi quen thuộc. Đa số hệ thống bộ nhớ hiện nay lo việc lưu trữ và truy hồi: cất thông tin đi rồi tìm lại khi cần. Bài này coi bộ nhớ như một sự can thiệp chủ động. Họ dựng thêm một memory agent chạy song song bên cạnh agent hành động, mà không sửa gì agent hành động cả. Nó là kiểu cắm vào là chạy, plug-and-play.

Memory agent làm việc theo hai pha. Pha một, nó cập nhật một sổ nhớ có cấu trúc gồm ba phần: trạng thái (phần riêng tư của nó), kiến thức, và kinh nghiệm thao tác. Pha hai, nó quyết định có nên chèn một lời nhắc ngắn gọn cho agent chính hay không, hoặc giữ im lặng. Điểm tinh tế nằm ở đây: im lặng là một hành động thật sự, có chủ đích. Nhắc quá nhiều thì tốn token và làm agent bị nhiễu; nhắc sai thời điểm còn hại hơn không nhắc.

Một ví dụ trong bài cho thấy rõ giá trị. Trong một nhiệm vụ hàng không, khách hàng tự nhận mình là hạng Gold, nhưng dữ liệu hệ thống chỉ ghi nhận là thành viên thường. Agent gốc chiều theo lời khách và đền bù sai. Agent có bộ nhớ thì được nhắc: chỉ tin vào bản ghi đã xác thực, và nhờ vậy làm đúng luật.

Con số thì thuyết phục. Với memory agent chạy trên Claude Opus 4.6, trên Terminal-Bench 2.0, agent hành động Claude Sonnet 4.5 tăng từ 37.6% lên 45.9%, tức thêm 8.3 pp. Trên τ²-Bench, benchmark hội thoại, điểm trung bình theo nhiệm vụ tăng từ 55.0% lên 61.8%, thêm 6.8 pp. Đáng chú ý là mức cải thiện vẫn giữ được ngay cả khi agent hành động là Opus 4.6 vốn đã mạnh hơn, với mức tăng 2.4 pp và 2.5 pp.

Vì sao lại là can thiệp chọn lọc, chứ không phải cứ nhắc liên tục? Nhóm tác giả thử hết mọi phương án và so trên ba miền: hàng không, bán lẻ, viễn thông. Chèn chọn lọc cho ra điểm macro-average cân bằng nhất là 64.3, nhỉnh hơn cách đổ hết sổ nhớ vào ngữ cảnh (61.5), cách nhắc ở mọi bước (63.5), cách chỉ cố vấn mà không có sổ nhớ, và cả Mem0, một hệ thống truy hồi bộ nhớ phổ biến (62.1). Chọn lọc không thắng ở mọi thước đo, nhưng nó cho kết quả cân bằng nhất giữa các miền, và đó là điều quý.

Phần đáng giá nhất với người muốn dùng thật nằm ở khả năng triển khai. Vì memory agent tách rời và không đụng gì tới agent chính, bạn có thể cắm nó vào một agent frontier có sẵn mà không cần huấn luyện lại gì. Nhóm còn đi xa hơn: họ huấn luyện một mô hình mở nhỏ, Qwen3.5-27B, để đóng vai memory agent, qua SFT rồi GRPO. Một memory agent chưa qua huấn luyện thì gây hại, nhưng bản đã huấn luyện lại chuyển giao tốt, nâng thêm 3.5 pp trên Terminal-Bench, từ 37.6% lên 41.1%. Nói cách khác, bạn có thể không cần đến một model đắt tiền chỉ để lo riêng phần trí nhớ cho agent của mình.

14/07/2026

AI nhận diện khuôn mặt hoạt động như thế nào?

Ứng dụng chat mã nguồn mở có thể thay thế Slack, Discord và Microsoft Teams trên chính máy chủ của bạn, dung lượng cực n...
14/07/2026

Ứng dụng chat mã nguồn mở có thể thay thế Slack, Discord và Microsoft Teams trên chính máy chủ của bạn, dung lượng cực nhẹ có đầy đủ video, audio call

Điều gây ấn tượng là dù còn ở phiên bản pre-1.0, Chatto đã sở hữu gần như đầy đủ những tính năng mà người dùng mong đợi ở các nền tảng chat phổ biến.

Một số tính năng nổi bật:

* Chat theo kênh, thread, reply, reaction.
* Chia sẻ file, video, hình ảnh, hỗ trợ embed.
* Tìm kiếm toàn bộ nội dung cuộc trò chuyện.
* Gọi thoại, gọi video và chia sẻ màn hình tích hợp sẵn.
* Nhắn tin riêng (DM), thông báo qua Web Push và Email.
* Hệ thống Roles & Permissions linh hoạt.
* Room có thể hoạt động như chat, forum hoặc social feed.
* Hỗ trợ SSO để tích hợp với hệ thống doanh nghiệp.

Chatto được phát triển theo tiêu chuẩn bảo vệ dữ liệu của châu Âu:

* Mã hóa dữ liệu lưu trữ theo từng người dùng.
* Crypto-shredding khi xóa tài khoản.
* Không tracking, không analytics.
* Tuân thủ GDPR.
* Toàn quyền kiểm soát dữ liệu vì chạy trên hạ tầng của chính bạn.

Về mặt kỹ thuật, Chatto cũng rất thú vị.

Backend được viết bằng Go, frontend sử dụng Svelte và TypeScript. Hệ thống messaging dựa trên NATS và ConnectRPC, vừa gọn nhẹ vừa có khả năng mở rộng.

Bạn có thể chạy bằng:

* Một file binary duy nhất chỉ khoảng 50–70 MB.
* Docker Compose.
* Kubernetes.

10/07/2026

📊 Nếu học ngoại ngữ kiểu này thì Duolingo có lý do để mất ngủ rồi, đây là GPT Live mới trên app Chat GPT.

🎬 Cùng xem demo này.

📊 Điểm ăn tiền là phản hồi nằm đúng chỗ bạn vừa vấp. ChatGPT sửa ngữ pháp, đổi câu cho tự nhiên hơn, rồi giải thích vì sao dùng excited chứ không phải exciting. Còn con số nhanh gấp năm trong post mới chỉ là cảm nhận, nhưng kiểu luyện nói thực chiến này thì app bài tập khó mà theo kịp GPT live.

Address


Website

Alerts

Be the first to know and let us send you an email when Kiếm Tiền Online posts news and promotions. Your email address will not be used for any other purpose, and you can unsubscribe at any time.

Shortcuts

  • Want your business to be the top-listed Advertising & Marketing Company?

Share