AI đang làm gì để “đóng dấu” vào văn bản do máy tạo ra?

đéo có hình chó nó tin

Địt Bùng Đạo Tổ
Nếu một người dùng ChatGPT, Gemini hay Claude viết một bài rồi copy sang Word, sau đó gửi cho giáo viên hoặc xuất bản, liệu có cách nào biết văn bản đó được tạo bởi AI?

Câu trả lời đang dần là . Các công ty AI đang phát triển một cách tiếp cận mới: thay vì chỉ nhìn vào văn phong để đoán "đây có phải văn bản AI không", họ gắn một dấu hiệu vô hình ngay trong quá trình AI tạo ra câu chữ.

Google đã triển khai công nghệ SynthID-Text cho văn bản Gemini, còn Anthropic vừa cho biết các mô hình Claude mới sẽ sử dụng watermark không thể nhận biết bằng mắt thường.

Hãy tưởng tượng AI đang viết câu:

"Hôm nay trời rất đẹp."

Khi tạo câu này, mô hình không đơn giản chọn từng từ một cách ngẫu nhiên. Nó tính toán xác suất của rất nhiều từ có thể xuất hiện tiếp theo.

Ví dụ, sau câu "Hôm nay trời...", AI có thể đánh giá:

"đẹp" 40%

"nắng" 30%

"mưa" 15%

"âm u" 5%

và nhiều lựa chọn khác.

Thông thường, AI sẽ chọn từ dựa trên những xác suất này.

Công nghệ watermark can thiệp rất nhẹ vào quá trình đó. Nó tạo ra một quy luật bí mật để khiến AI ưu tiên một số lựa chọn nhất định trong những tình huống nhất định. Những thay đổi này nhỏ đến mức người đọc không nhận ra, nhưng khi nhìn toàn bộ đoạn văn bằng một công cụ chuyên dụng, chúng tạo thành một mẫu thống kê đặc trưng.

Đó chính là watermark.

Google mô tả SynthID-Text theo nguyên lý này: điều chỉnh điểm xác suất của các token trong quá trình sinh văn bản để tạo ra một mẫu có thể nhận diện sau đó, mà không làm thay đổi đáng kể chất lượng hoặc ý nghĩa câu chữ.

Nói đơn giản:

AI không viết thêm một dòng chữ bí mật vào bài. Nó để lại một "thói quen lựa chọn từ" có chủ đích.


1786543730944.png



Không thể nhìn bằng mắt thường. Một công cụ phát hiện sẽ lấy đoạn văn cần kiểm tra và phân tích cách các từ, hay chính xác hơn là các token, được lựa chọn. Nó tìm xem văn bản có chứa mẫu thống kê mà hệ thống watermark đã tạo ra hay không.

Có thể hình dung như việc kiểm tra một tờ tiền. Bạn không cần nhìn thấy bằng mắt thường dấu bảo an. Máy kiểm tra tiền sẽ tìm một đặc điểm mà người làm giả khó nhận biết. Watermark văn bản cũng tương tự.

AI tạo ra hàng trăm hoặc hàng nghìn lựa chọn từ. Một số lựa chọn được "thiên vị" theo quy luật bí mật. Khi phân tích đủ dài, những lựa chọn nhỏ này cộng lại thành một tín hiệu đủ mạnh để hệ thống đưa ra kết luận.

Với SynthID-Text, Google cho biết hệ thống có thể tính điểm dựa trên mẫu lựa chọn token để đánh giá khả năng văn bản có chứa watermark.
Đây là điểm rất thú vị. Nếu watermark nằm trong một ký tự đặc biệt, việc copy sang Word hoặc Google Docs có thể làm mất nó. Nhưng với phương pháp nói trên, watermark không nằm ở một ký tự cụ thể. Nó nằm trong cách toàn bộ văn bản được hình thành.

Vì vậy, khi bạn copy: Claude → Word → email → website các chữ vẫn giữ nguyên và mẫu thống kê có thể vẫn còn đó.

Anthropic cho biết watermark của Claude được thiết kế để có thể tồn tại qua những thao tác thông thường như copy, paste và một số chỉnh sửa nhẹ. Công ty cũng đang phát triển công cụ để người dùng và bên thứ ba có thể phát hiện dấu này.
Đây là điểm rất quan trọng. Watermark hoạt động tốt nhất khi văn bản vẫn tương đối gần với phiên bản AI ban đầu. Nếu một người lấy bài do AI viết rồi sửa rất nhiều, viết lại bằng ngôn ngữ khác hoặc nhờ một AI khác diễn đạt lại, tín hiệu watermark có thể yếu đi hoặc biến mất.

Các nghiên cứu cũng cho thấy đây là một trong những thách thức lớn nhất của watermark văn bản. Một nghiên cứu đánh giá các phương pháp watermark hiện nay cho thấy việc paraphrase có thể làm suy giảm đáng kể khả năng phát hiện.

Vì vậy, nếu một công cụ nói: "Văn bản này có watermark của Claude." thì ý nghĩa hợp lý hơn là: "Văn bản này có những đặc điểm phù hợp với watermark mà Claude đã nhúng vào nội dung."

Nó không nhất thiết chứng minh được ai đã sử dụng AI, sử dụng vào thời điểm nào hay người đó không hề chỉnh sửa văn bản.
Có thể chia thành hai cách chính.

Cách thứ nhất: watermark ngay trong quá trình AI viết.

Google đang đi theo hướng này với SynthID-Text. Watermark được tạo ra ngay khi mô hình lựa chọn token.

Anthropic cũng đang áp dụng một dạng watermark không thể nhận biết bằng mắt thường cho các mô hình Claude mới.

Cách thứ hai: gắn thông tin nguồn gốc vào file.

Với hình ảnh, video hoặc một số loại file, công nghệ có thể sử dụng metadata để ghi lại nguồn gốc nội dung. Anthropic cho biết họ sử dụng chuẩn C2PA cho hình ảnh và metadata nguồn gốc của file.

Hai cách này có điểm khác nhau.

Metadata giống như một chiếc tem trên bao bì.

Watermark giống như một dấu hiệu được đưa vào chính sản phẩm.


Nếu chỉ có metadata, việc chỉnh sửa hoặc tải lại file qua một số nền tảng có thể làm mất thông tin. Còn watermark được thiết kế để nằm trong chính nội dung nên khó bị loại bỏ bằng những thao tác thông thường hơn.
Một lý do quan trọng là minh bạch về nội dung AI.

Khi AI ngày càng được sử dụng để viết bài báo, sách, bài tập, quảng cáo, tài liệu doanh nghiệp và nội dung trên mạng xã hội, câu hỏi "Nội dung này do người hay máy tạo ra?" ngày càng quan trọng.

Đặc biệt tại châu Âu, các quy định mới về minh bạch nội dung AI đang thúc đẩy các công ty phải có cơ chế nhận diện và công bố nguồn gốc nội dung. Anthropic cho biết việc triển khai watermark Claude liên quan trực tiếp tới các yêu cầu minh bạch của EU AI Act.

Điều đó có thể dẫn tới một thay đổi đáng chú ý:

Trong tương lai, AI không chỉ tạo ra nội dung. Nó có thể đồng thời để lại "dấu vân tay" cho nội dung đó.

Và cuộc chơi giữa AI tạo nội dung và AI phát hiện nội dung vì thế có thể chuyển từ việc "đoán văn phong có giống AI hay không" sang một cuộc kiểm tra hoàn toàn khác:

"Trong văn bản này có dấu hiệu mà chính mô hình đã để lại khi tạo ra nó hay không?"

Tuy nhiên, cuộc đua chưa kết thúc. Các nhà nghiên cứu vẫn đang tìm cách làm watermark bền hơn trước việc viết lại, dịch và chỉnh sửa, trong khi những người muốn che giấu nguồn gốc AI lại có động cơ tìm cách loại bỏ những dấu hiệu đó.

 
@đéo có hình chó vẫn tin , @TrienChjeu , @aslast05 , @Nguyễn Quang 01 @gatingun741 , @club_libertad @xetaxi , @Nmlam , @Hoanggiap512 @Thợ săn @Marine Corp Commandant @Chichchoe9x @Duckknightx

Tao thấy cái này không khác gì đi tìm gái xinh trẻ đẹp trong rừng , nghĩa là làm đéo gì có . Đi bàn chuyện không đâu , y như mấy thằng cán bộ ngoài bắc đi tìm đường lên XHCN , phải làm sao để nâng cao đạo đức cho cán bộ , làm gì có mà tìm ?

Thay vì đi tìm cách chống lại AI thì cải tổ giáo dục , bỏ làm luận văn mà thay bằng tranh luận trực tiếp , thằng nào muốn tranh luận giỏi thì phải đọc và dùng chính AI dạy phát ngôn hàn lâm . Chứ đụ mẹ nó đi lòng vòng xác minh đạo văn thì lòng vòng chả đi tới đâu , như ở VN giờ thi văn cũng chỉ là học vẹt vì nó nhờ Google giải văn cho từ 20 năm trước rồi , nay có AI chỉ là dễ tìm văn mẫu chép thôi , mà học văn có phải để chép vẹt đéo đâu ? học văn là để cảm nhận , để tranh biện và học cách hiểu nhau , có văn mà đi cua gái thay vì nói ''em ăn cơm chưa ?'' như thằng @Không tên1 đi cua gái Tin lành mà săn ở Nhà thờ công giáo
 
máy móc đang cố làm việc nhân văn, con người nên cố làm việc máy móc bằng cách dùng AI thì thông báo rằng đã dùng AI, vậy là song.
 
Tao đố con A.I nào viết được cái giọng văn của xàm
Nó thô, nó bựa và cực kỳ trần trụi
từ Grok 2.5 là nhại dc rồi đó mày , nhại 1 cách hoàn hảo

Hiện nay chính phủ phương tây có 1 công nghệ tìm người ẩn danh , dùng AI đọc văn phong trên xamvn để so văn phong trên zalo của mày , mục đích chỉ là xác minh độ chính xác văn phong . Hiện tại AI nó còn đọc được cả suy nghĩ , ví dụ mày đang nghĩ gì khi viết cái này và so sánh 2 ID khác nhau có phải cùng 1 người hay không . Đó là lí do tao luôn phải phẩy như này

1 số thằng tinh ý có thể đọc ra được suy nghĩ tao thì AI hoàn toàn có thể đọc , ví dụ tao đọc mày thì cũng biết mày ntn , ngoài đời có lẽ gầy do ăn chơi nhiều , giọng hơi khàn chắc vậy , vì tao để ý trung niên ngoài bắc giọng luôn khàn , mày từng nói mày là công nhân và không quan trọng chuyện ăn uống , nói vậy là suy ra được vô số hình thể , tài chính và suy nghĩ của mày , chưa kể 1 đống thông tin mày leak ra . và nếu tao có thể đọc tất cả cmt của mày thì gần như tao sẽ tìm ra mày ngoài đời , AI nó chỉ đơn giản làm tốt hơn

Kiểu như cách mày xác minh cậu này là acc phụ của thằng nào vậy . Đọc văn của nó mày biết ngay thằng này làm nghề gì , tuổi tác , như việc mày biết tao phải hơn tuổi mày và tao biết mày sẽ thể hiện thái độ ntn ngoài đời , tao đoán là hiền và chơi đẹp . Càng đọc lâu đừng nói AI , con người có thể đọc ra 1 đống thông tin từ mấy thằng trên mạng , và khi đọc đủ thì ra ngay đồng chí Lê Anh Quân ở Hai bà trưng Hà nội . Giả dụ thế

thằng ditconmecuocdoi trước trong nhóm học sinh tao đã chạy 1 lệnh gemini bản build trên aigoogle.com , nó ném các bài viết của tao vô đó và xuất ra kết qua gần như chính xác cách tao sẽ hành xử ngoài đời . Nó đọc được cân nặng , hình thể và dự đoán tao làm công việc không ổn định mới sợ . Như vậy không có gì lạ khi New york time nói csvn đang huấn luyện AI để hình thể hóa tất cả tài khoản VN , về cơ bản chỉ đọc ở mức biết xu hướng thích gì khi cướp được API facebook để biết sở thích dân VN , như kiểu thuật toán gợi ý nội dung đấy mày

Thế là nó tạm phân loại được bao nhiêu % dân bất mãn theo thời gian thật . Tất nhiên phải có Meta , Google và Microsorf hỗ trợ mới làm được chứ thằng việt cộng không đủ trình , nó chỉ cần đổi cho phép big tech kiếm tiền tại Vn bù lại train cán bộ việt cộng cách quản lý dân số

Sau này dân nó chỉ nhìn như các dòng mã

ví dụ mày có mã g86gh9gfj6sdfg0vb6dvb0dfh6dcvb6df8h , dài gấp 20 lần , nó định danh từ mọi thứ của mày
 
từ Grok 2.5 là nhại dc rồi đó mày , nhại 1 cách hoàn hảo

Hiện nay chính phủ phương tây có 1 công nghệ tìm người ẩn danh , dùng AI đọc văn phong trên xamvn để so văn phong trên zalo của mày , mục đích chỉ là xác minh độ chính xác văn phong . Hiện tại AI nó còn đọc được cả suy nghĩ , ví dụ mày đang nghĩ gì khi viết cái này và so sánh 2 ID khác nhau có phải cùng 1 người hay không . Đó là lí do tao luôn phải phẩy như này

1 số thằng tinh ý có thể đọc ra được suy nghĩ tao thì AI hoàn toàn có thể đọc , ví dụ tao đọc mày thì cũng biết mày ntn , ngoài đời có lẽ gầy do ăn chơi nhiều , giọng hơi khàn chắc vậy , vì tao để ý trung niên ngoài bắc giọng luôn khàn , mày từng nói mày là công nhân và không quan trọng chuyện ăn uống , nói vậy là suy ra được vô số hình thể , tài chính và suy nghĩ của mày , chưa kể 1 đống thông tin mày leak ra . và nếu tao có thể đọc tất cả cmt của mày thì gần như tao sẽ tìm ra mày ngoài đời , AI nó chỉ đơn giản làm tốt hơn

Kiểu như cách mày xác minh cậu này là acc phụ của thằng nào vậy . Đọc văn của nó mày biết ngay thằng này làm nghề gì , tuổi tác , như việc mày biết tao phải hơn tuổi mày và tao biết mày sẽ thể hiện thái độ ntn ngoài đời , tao đoán là hiền và chơi đẹp . Càng đọc lâu đừng nói AI , con người có thể đọc ra 1 đống thông tin từ mấy thằng trên mạng , và khi đọc đủ thì ra ngay đồng chí Lê Anh Quân ở Hai bà trưng Hà nội . Giả dụ thế

thằng ditconmecuocdoi trước trong nhóm học sinh tao đã chạy 1 lệnh gemini bản build trên aigoogle.com , nó ném các bài viết của tao vô đó và xuất ra kết qua gần như chính xác cách tao sẽ hành xử ngoài đời . Nó đọc được cân nặng , hình thể và dự đoán tao làm công việc không ổn định mới sợ . Như vậy không có gì lạ khi New york time nói csvn đang huấn luyện AI để hình thể hóa tất cả tài khoản VN , về cơ bản chỉ đọc ở mức biết xu hướng thích gì khi cướp được API facebook để biết sở thích dân VN , như kiểu thuật toán gợi ý nội dung đấy mày

Thế là nó tạm phân loại được bao nhiêu % dân bất mãn theo thời gian thật . Tất nhiên phải có Meta , Google và Microsorf hỗ trợ mới làm được chứ thằng việt cộng không đủ trình , nó chỉ cần đổi cho phép big tech kiếm tiền tại Vn bù lại train cán bộ việt cộng cách quản lý dân số

Sau này dân nó chỉ nhìn như các dòng mã

ví dụ mày có mã g86gh9gfj6sdfg0vb6dvb0dfh6dcvb6df8h , dài gấp 20 lần , nó định danh từ mọi thứ của mày

mày có thể đọc đc suy nghĩ của tao (nếu nói chuyện đủ lâu, đủ hiểu nhau) và A.I nó cũng làm được. Nhưng văn phong của 1 người thì ko thể, nhất là văn trên xàm với văn zalo. Hai cách nói chuyện khác hẳn nhau, dù cùng là 1 người. Khi mà cái văn trào phúng người ta sử dụng rất nhiều tiếng lóng, những thứ mà A.I không thể hiểu nó là cái gì, ý nghĩa như nào.
 
mày có thể đọc đc suy nghĩ của tao (nếu nói chuyện đủ lâu, đủ hiểu nhau) và A.I nó cũng làm được. Nhưng văn phong của 1 người thì ko thể, nhất là văn trên xàm với văn zalo. Hai cách nói chuyện khác hẳn nhau, dù cùng là 1 người. Khi mà cái văn trào phúng người ta sử dụng rất nhiều tiếng lóng, những thứ mà A.I không thể hiểu nó là cái gì, ý nghĩa như nào.
Văn phong tức Context không phải chữa viết , cách viết , Context cũng dịch là Ngữ cảnh , tức toàn bộ í chí và suy nghĩ của mày . Kiểu như 1 thằng nói bác hồ đi xkld nhưng có thể nó có ý tốt nếu mày đọc đầy đủ ngữ cảnh của nó


Kiểu như phân tích mày độc thân , mày làm gì , xu hướng , sở thích để tìm ra những ai trên zalo , fb , shopee phù hợp với mày . Không ai biết mày chơi sữa tắm đắt tiền hoặc có thể là không , nhưng họ hiểu 1 chút về mày , ví dụ 1 thằng có vợ con hoặc là kĩ sư ngân hàng tối ngày bận việc thì đó không thể là đối tượng trùm phản động Trienchieu trên xamvn

Đại khái công nghệ tấn công tương quan và phân tích văn phong là vậy , đây là cách phổ biến ở Mỹ và Châu âu để thật sự tìm ra đúng 1 ai đó mà không phải tra tấn , chứ thật ra tao nghĩ công an VN nó cũng không cần làm những cái trên , thích thì thằng nào cũng là Trienchieu sau 3 giờ ăn đấm
 
Văn phong tức Context không phải chữa viết , cách viết , Context cũng dịch là Ngữ cảnh , tức toàn bộ í chí và suy nghĩ của mày . Kiểu như 1 thằng nói bác hồ đi xkld nhưng có thể nó có ý tốt nếu mày đọc đầy đủ ngữ cảnh của nó


Kiểu như phân tích mày độc thân , mày làm gì , xu hướng , sở thích để tìm ra những ai trên zalo , fb , shopee phù hợp với mày . Không ai biết mày chơi sữa tắm đắt tiền hoặc có thể là không , nhưng họ hiểu 1 chút về mày , ví dụ 1 thằng có vợ con hoặc là kĩ sư ngân hàng tối ngày bận việc thì đó không thể là đối tượng trùm phản động Trienchieu trên xamvn

Đại khái công nghệ tấn công tương quan và phân tích văn phong là vậy , đây là cách phổ biến ở Mỹ và Châu âu để thật sự tìm ra đúng 1 ai đó mà không phải tra tấn , chứ thật ra tao nghĩ công an VN nó cũng không cần làm những cái trên , thích thì thằng nào cũng là Trienchieu sau 3 giờ ăn đấm

Mày có tin, cách nói trên xàm và cách nói ngoài đời của tao khác hẳn nhau ko? Nếu chỉ qua cách nói chuyện mày sẽ ko thể biết tao là Trien Chjeu trên xàm. Cùng nói 1 vấn đề nhưng cách dùng từ và diễn đạt rất khác nhau. Chẳng hạn câu chuyện xoay quanh việc bác Hồ rời bến cảng nhà rồng đi tìm đường cứu nước. Ngoài đời tao sẽ dùng từ bác Hồ hoặc chủ tịch HCM. Nhưng nếu ở trên xàm tao sẽ dùng từ: Bả Chó đi XKLĐ. Và khi dùng từ này thì A.I nó cũng đéo hiểu tao đang nói gì?
 
Mày có tin, cách nói trên xàm và cách nói ngoài đời của tao khác hẳn nhau ko? Nếu chỉ qua cách nói chuyện mày sẽ ko thể biết tao là Trien Chjeu trên xàm. Cùng nói 1 vấn đề nhưng cách dùng từ và diễn đạt rất khác nhau. Chẳng hạn câu chuyện xoay quanh việc bác Hồ rời bến cảng nhà rồng đi tìm đường cứu nước. Ngoài đời tao sẽ dùng từ bác Hồ hoặc chủ tịch HCM. Nhưng nếu ở trên xàm tao sẽ dùng từ: Bả Chó đi XKLĐ. Và khi dùng từ này thì A.I nó cũng đéo hiểu tao đang nói gì?
Nó không nhìn cách nói hay cách viết , nó nhìn vào suy nghĩ , xu hướng

Ví dụ mày độc thân , lao động tự do , không sống cùng ba mẹ , sống tại Hà nội và có thể không phải dân gốc Hà nội , đang ở trọ , đây là tao tạm đoán , và nếu đúng , và nếu là AI đọc tất cả toàn bộ 10 ngàn cmt mày trên xamvn thì sẽ ra 1 bản dạng nhất định

Tất nhiên mày có thể nói dối tao , nói dối AI , nhưng sẽ sẽ tìm ra kết quả khả dĩ nhất , mà thật ra tìm ra mày không khó , mày xài 1111 , tại Vn có bao nhiêu thằng kết nối tới Flarecloud vào chính xác thời điểm 10 lần mày cmt gần nhất ? chắc chắn chỉ có 1 rồi
 
Nó không nhìn cách nói hay cách viết , nó nhìn vào suy nghĩ , xu hướng

Ví dụ mày độc thân , lao động tự do , không sống cùng ba mẹ , sống tại Hà nội và có thể không phải dân gốc Hà nội , đang ở trọ , đây là tao tạm đoán , và nếu đúng , và nếu là AI đọc tất cả toàn bộ 10 ngàn cmt mày trên xamvn thì sẽ ra 1 bản dạng nhất định

Tất nhiên mày có thể nói dối tao , nói dối AI , nhưng sẽ sẽ tìm ra kết quả khả dĩ nhất , mà thật ra tìm ra mày không khó , mày xài 1111 , tại Vn có bao nhiêu thằng kết nối tới Flarecloud vào chính xác thời điểm 10 lần mày cmt gần nhất ? chắc chắn chỉ có 1 rồi
Mày lại nói luyên thuyên đi đâu vậy. Tao chỉ muốn khẳng định 1 điều A.I không thể giả được văn phong của tao. Còn nó tìm ra tao làm cái đéo gì? Đang nói chuyện về cách hành văn cơ mà
 
Mày lại nói luyên thuyên đi đâu vậy. Tao chỉ muốn khẳng định 1 điều A.I không thể giả được văn phong của tao. Còn nó tìm ra tao làm cái đéo gì? Đang nói chuyện về cách hành văn cơ mà

Vì AI hiện tại về bản chất chỉ là LLM một cỗ máy tính toán xác suất chuỗi từ. Để nhái văn phong hay đoán nghĩa của mày, nó đéo có trải nghiệm thực tại, nó buộc phải suy đoán ngữ cảnh dựa trên tập dữ liệu đã học.

Ví dụ: Mày ra đường thấy trời mưa, mày chửi 'ướt vãi lồn' rồi đoạn sau mày phàn nàn chuyện tắc đường. AI nó quét không gian vector xung quanh và gán trọng số câu đó vào cụm 'thời tiết/mưa'.

Lần sau, mày đang chịch một con, mày cũng phọt ra đúng câu 'ướt vãi lồn' rồi câm nín đéo nói gì thêm. Nếu câu đó đứng hoàn toàn độc lập, xác suất cao AI sẽ chọn đáp án an toàn nhất dựa trên dữ liệu phổ biến: Mày đang nói về thời tiết hoặc sự ẩm ướt thuần túy. Muốn nó đoán đúng mày đang làm tình, mày bắt buộc phải nạp thêm Input đa giác quan (tiếng thở, nhịp tim, góc quay camera) hoặc lịch sử chat trước đó. Máy đéo có bản năng sinh học để 'cảm' được cái không khí rạo rực đó nếu mày không mớm dữ liệu cho nó.

Cái gọi là 'văn phong' của mày thực chất là một chuỗi hành vi bất quy tắc ngẫu nhiên cao. Khi mày nói, não mày chịu tác động cùng lúc bởi vô số biến số ngầm: Hormone, cảm xúc bột phát, phản xạ tủy sống, hay một ký ức củ chuối nào đó vừa xẹt qua. Mày đéo giải thích được tại sao mày sắp xếp từ ngữ như thế, vì mày là một hệ sinh học phức hợp và điên rồ. AI cũng dùng tham số ngẫu nhiên (Temperature) để bắt chước cái sự dở hơi đó của mày, nhưng xác suất toán học chỉ là sự mô phỏng, đéo phải là trải nghiệm thực sự.

Quan trọng nhất: Bộ ngôn ngữ của mày là một hệ thống liên tục tiến hóa. Mày đi chơi, mày bị cắm sừng, mày nghe lỏm một câu chửi ngoài chợ... mày vô thức nạp cái Input đời sống đó vào, xào nấu lại qua bộ lọc trải nghiệm cá nhân để tạo ra một phản xạ ngôn ngữ 'OG' hoàn toàn mới.

AI đéo sống cuộc đời của mày. Muốn nó cập nhật cái quy tắc mới đó, mày phải nạp Input vào Prompt hoặc đợi người ta Fine-tune/RAG lại cho nó. AI không tự có trải nghiệm sống real-time để tự sinh ra ngôn ngữ mới, nó chỉ mãi mãi là kẻ đi sau xào nấu lại cái bóng của tri thức loài người.
 
Sửa lần cuối:
Quan trọng nhất: Bộ ngôn ngữ của mày là một hệ thống liên tục tiến hóa. Mày đi chơi, mày bị cắm sừng, mày nghe lỏm một câu chửi ngoài chợ... mày vô thức nạp cái Input đời sống đó vào, xào nấu lại qua bộ lọc trải nghiệm cá nhân để tạo ra một phản xạ ngôn ngữ 'OG' hoàn toàn mới.

Cái này mới đúng, từ ngữ tao hay dùng cũng luôn đc cập nhật theo thời gian. Có thể đi chợ, đi uống bia, lên xàm chém gió..... tao nghe đc 1 vài câu hay, 1 vài từ lóng mới, thế là tao thêm những câu đó vào lời văn sau này.
 

Có thể bạn quan tâm

Top