Hook

Their other posts in the index, biggest breakout first.
Các bạn mới gõ có 3 câu prompt mà Claude đã báo là you have reached your usage limit Try again in 4 hours trong khi cùng cái gói subscription đấy nhé. Các bạn của bạn lại dùng cả ngày không hết. Ở đây không phải là cái account của các bạn bị lỗi đâu, mà cũng không phải là thằng Claude nó ghét các bạn, mà là vì Claude nó không reset theo cách các bạn đang nghĩ. Nó chạy theo một cơ chế mà đến 90% người dùng đều hiểu sai và các bạn cũng thế. Các bạn đang đốt token vào những chỗ mà không nên đốt mà lại không hề hay biết. Và trong video này mình sẽ chỉ cho bạn cái chỗ đấy nó nằm ở đâu và làm sao để subscription Claude Code dùng được gấp 3 lần hiện tại. Ok để mình giải thích cho bạn nào chưa biết nhé. Đầu tiên cái sai lầm lớn nhất mà nhiều bạn hiểu nhầm ấy là cái thằng Claude nó không tính theo ngày, không phải là cứ dùng hết hôm nay rồi ngày mai sẽ được reset mà nó tính theo cái cửa sổ 5 tiếng liên tục. Nghĩa là sao? Cái tin nhắn đầu tiên các bạn gửi lúc 9h sáng ấy thì đúng đến 2h chiều cái cửa sổ đấy nó mới đóng lại và trong 5 tiếng đấy các bạn được dùng lượng token nhất định. Hết là hết và phải đợi qua cái mốc 2h chiều thì mới được mở cửa sổ mới. Cho nên nhiều khi các bạn ngồi làm việc cật lực từ 9h sáng đến 11h trưa xong rồi nghỉ trưa, chiều các bạn quay lại lúc khoảng 1h30 tức là vẫn còn nằm trong cửa sổ cũ đấy. Và đấy chính là lý do mà nhiều người lại than là ủa sao mới mở máy ra đã hết token rồi? Chẳng qua là vì cái cửa sổ đấy nó chưa reset. Đấy là chuyện thứ nhất, còn cái chuyện thứ hai mới là chuyện đắt giá hơn. Claude Code nó có một cái gọi là context window. Các bạn cứ tưởng tượng nó giống một cái bàn làm việc ấy. Cái bàn của Claude Code thì nó rộng đến 1 triệu token. Nghe thì có vẻ to khủng khiếp đúng không? Để các bạn dễ hình dung nhé, 1 triệu token nó tương ứng khoảng 750.000 từ tiếng Anh, nó bằng cả một bộ truyện Harry Potter cộng lại. Nhưng mà cái vấn đề ở đây lại không nằm ở cái chỗ cái bàn to hay bàn nhỏ mà cái vấn đề là các bạn đang chất cái gì lên cái bàn đấy. Và cái này, đây mới là cái chỗ mà 90% người dùng đốt tiền vào mà không hề hay biết. Để mình lý giải tại sao token nó lại tăng theo cái kiểu chồng chất nhé. Thứ nhất, mỗi lần các bạn gửi tin nhắn thì Claude nó không chỉ đọc cái câu hỏi đấy mà nó đọc lại toàn bộ cuộc hội thoại từ đầu đến giờ. Mỗi lần đều như thế, không ngoại lệ. Tức là tin nhắn thứ nhất thì tốn khoảng 500 token và đến tin nhắn thứ 30 nó sẽ tốn khoảng 15.000 token, gấp khoảng 30 lần. Và tức là tổng sau 30 cái tin nhắn đấy, các bạn có thể đã tiêu hết 250.000 token nếu mà cộng dồn lại. Có một developer họ đã theo dõi một cái phiên chat hơn 100 tin nhắn nhé và phát hiện ra rằng 98,5% tổng số token chỉ để dùng để đọc lại cái lịch sử chat, không làm ra cái gì mới cả. Nó chỉ đọc lại cái cũ. Và mình đã thấy rõ cái điều này khi mới sử dụng Claude Code để làm content nhé. Mình build những cái workflow cho khách hàng, mở Claude Code từ sáng, paste brief, paste code, paste error log, hỏi qua hỏi lại suốt 3 tiếng. Chưa làm được gì nhiều thì Claude Code nó báo là limit và khi đấy kiểm tra lại mình thấy là đã chat hơn 80 tin nhắn, nhưng mà mỗi tin nhắn lại mang theo cả đống code và log ở phía trên. Và cái thằng Claude nó không hề bị lỗi mà là mình đang bắt nó đọc cả một cái quyển tiểu thuyết mỗi khi hỏi nó một câu. Tiếp theo mình sẽ giải thích một cái mà nhiều người cũng cảm nhận được, tức là càng dùng lâu thì Claude nó càng ngu đi. Đấy chính là cái thứ hai mình muốn nói đến. Cái hệ quả của cái đấy chính là cái thứ gọi là context rot, các bạn có thể dịch ra là AI mất trí. Khi mà cái session chat quá dài, tức là cái phiên chat của các bạn với Claude ấy thì Claude nó bắt đầu bị phân tán, nó phải chia cái sự chú ý của nó ra cho hàng nghìn những cái token cũ và kết quả là nó sẽ quên task và tự mâu thuẫn với chính nó. Thậm chí đôi khi nó sẽ sửa những cái file mà không cần đọc cái file đấy trước. Một cái số liệu từ Anthropic, cái độ chính xác khi tìm thông tin trong context giảm từ 92% xuống còn 78% khi context nó đầy 1 triệu token. Tức là với cùng một câu hỏi thì Claude lúc 1 triệu token sẽ trả lời tệ hơn là Claude lúc 250.000 token. Và từ cái phân tích hơn 7.000 session ở trên GitHub ấy thì họ đã khẳng định là cái tư duy của Claude nó giảm 67% khi mà cái session nó kéo dài và cái hành vi sửa file mà không đọc trước nó tăng từ 6% lên 34% trong session dài. Nó ngắn gọn lại thì session dài, Claude nó sẽ lười và cẩu thả hơn. Và khi Claude nó làm kém hơn các bạn sẽ phải hỏi lại, đính chính, sửa lỗi. Những cái việc đấy nó lại tốn thêm token và cái vòng xoáy đấy chính là cái lý do mà các bạn chưa dùng đã bị limit. Ok vậy chúng ta sẽ cần làm gì? Mình sẽ chỉ cho các bạn 5 cái thói quen của người dùng Claude thông minh. Cái thứ nhất là các bạn dùng cái lệnh /RE thay vì gửi cái tin nhắn mới khi mà Claude nó làm sai. Khi mà Claude nó trả lời không đúng nhé, đa số chúng ta sẽ nhắn thêm là không phải, thử lại đi. Nhưng mà khi đấy thì cái câu trả lời sai nó vẫn nằm ở trong cái context, Claude nó vẫn đọc lại cái câu trả lời sai đấy. Chúng ta hãy dùng cái lệnh /RE quay về cái tin nhắn trước đấy, xóa cái phần sai và bắt đầu lại từ cái chỗ sạch. Thứ hai là chúng ta reset thủ công ở cái mức 60%, chứ đừng đợi Claude nó auto reset. Claude Code nó có cái tính năng tự compact khi mà context của các bạn đầy 95% nhưng mà lúc đấy nó chỉ giữ lại khoảng 20 đến 30% thông tin. Nó giống như kiểu các bạn nhồi vali lúc chỉ còn 5 phút là lên xe ấy. Và khi các bạn làm thủ công ở mức 60% thì các bạn sẽ nói Claude Code nó cần tóm tắt những gì đã làm, sau đấy copy lại rồi dùng cái lệnh clear, sau đấy paste cái đoạn tóm tắt đấy vào cái khung chat mới. Đấy là cái cách reset mà các bạn không mất cái gì. Thứ ba là các bạn hãy chuyển những cái file sang dạng Markdown trước khi đưa vào Claude. Các bạn nên nhớ HTML chuyển sang Markdown thì sẽ tiết kiệm hơn 90% token. PDF mà chuyển sang Markdown thì tiết kiệm từ 65 đến 70% token. Bản chất Claude nó không cần layout, không cần màu sắc, không cần metadata, nó chỉ cần cái nội dung văn bản thôi. Mình ví dụ các bạn làm nội dung nhé, hay paste những cái brief hoặc là những cái tài liệu tham khảo vào Claude ấy, thay vì phải paste cái file PDF thì các bạn hãy chuyển nó sang file Markdown. Có rất nhiều những cái công cụ miễn phí ở trên mạng, chỉ cần 5 giây để đổi format thôi các bạn đã tiết kiệm được cả đống token. Thứ tư là các bạn hãy dùng Projects cho những cái tài liệu dùng đi dùng lại. Nếu các bạn hay đưa cùng một cái file vào Claude như là cái brief công ty, style guide, cái template thì các bạn hãy upload nó một lần vào Project, Claude nó sẽ cache nó lại và các bạn sẽ không tốn cái token để nhắc đi nhắc lại nữa. Thứ năm là các bạn hãy chọn đúng model cho đúng việc. Claude nó có những cái model Haiku, Sonnet, Opus, bản chất nó khác nhau như kiểu xe máy, SUV hay là sedan thôi. Nó cùng đi được nhưng mà tốn xăng thì hoàn toàn khác nhau. Nếu mà các bạn dùng Opus để viết cái email cảm ơn ấy thì nó chả khác gì các bạn lái một SUV đi mua cái bánh mì ở đầu ngõ. Bản thân mình hiện tại mình chỉ dùng Opus cho cái việc phân tích chiến lược hoặc là những cái task cần suy luận sâu, còn lại chủ yếu thì mình dùng Sonnet, những cái việc rất đơn giản thì mình dùng Haiku. Ok nhưng mà cái thay đổi cách mình nhìn Claude nhất ấy không phải là mấy cái trick vừa rồi mà là mình hiểu ra rằng 1 triệu token context window không phải là cái mục tiêu để lấp đầy mà nó là một cái bảo hiểm. Và mình khuyên các bạn là nếu các bạn dùng Claude Code với lại cái model Opus thì với cái context window 1 triệu token, các bạn đừng bao giờ cho phép nó vượt quá 120.000 token, tức là khoảng 12% context window. Đến cái mức đấy thì các bạn nên tóm tắt, clear và bắt đầu một cái phiên chat mới. Lý do là từ 0 đến 20% đầu của session là cái lúc mà Claude nó hoạt động tốt nhất. Cái file Claude.md còn mới, cái model nó còn tập trung, càng về sau thì nó sẽ càng loãng. Và nếu các bạn cứ nghĩ là 1 triệu token thì bằng nhiều chỗ để làm việc, bằng với việc làm được nhiều hơn thì chính xác đấy là cái bẫy mà khiến các bạn chưa làm việc đã bị limit, kể cả các bạn có dùng cái phiên bản max 200 đô đi nữa. Vậy thì cái chuyện này có ý nghĩa gì với các bạn? Một là để các bạn đang dùng Claude theo cái kiểu một cái khung chat to cho tất cả mọi thứ trong ngày ấy thì đấy chính là cái lý do mà các bạn hay bị cắt. Hãy chia nhỏ những cái công việc ra theo task, khung chat để viết nội dung này, khung chat riêng cho cái việc research hay là cái khung chat riêng cho cái việc chỉnh sửa. Thứ hai là khi các bạn nhận ra Claude bắt đầu trả lời kỳ kỳ, tự mâu thuẫn hoặc là làm sai những cái việc cơ bản thì đừng hỏi thêm, đấy là cái dấu hiệu của context rot. Hãy tóm tắt lại, clear và bắt đầu lại từ đầu. Thứ ba là các bạn hãy nhớ cái rule 12%, đừng bao giờ đợi đến khi Claude nó tự compact, các bạn hãy chủ động reset sớm để cái session nào nó cũng sạch. Rồi và các bạn đang dùng Claude theo cách nào? Một cái đoạn chat dài từ sáng đến chiều hay là nhiều cái đoạn chat ngắn phân theo task? Comment ở dưới cho mình biết nhé. Và nếu các bạn cũng từng bị cắt giữa chừng ở những cái lúc quan trọng nhất ấy thì cũng kể cho mình nghe luôn nhé. Rồi và nếu các bạn muốn cập nhật những cái tip thực chiến về AI mỗi tuần thì nhớ follow cái kênh này của mình nhé. Mình sẽ giải thích mọi thứ đang xảy ra trong cái thế giới AI bằng cái ngôn ngữ đơn giản nhất. Hẹn gặp lại các bạn ở cái video tiếp theo.