[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"_public_topic_publications_k-means{\"limit\":5}":3,"_public_topic_byId_k-means":11},{"code":4,"data":5,"meta":10},"SUCCESS",{"latest":6,"mostCited":7,"vietnamFeatured":8,"vietnamLatest":9},[],[],[],[],null,{"code":4,"data":12,"meta":10},{"id":13,"title":14,"description":15,"content":16,"term":13,"englishTitle":10,"synonyms":10,"definition":10,"discipline":10,"references":10,"faqs":10,"createUser":17,"publishUser":10,"keywords":21,"keywordCount":10,"enrichTopicLink":22,"status":23,"createTime":24,"updateTime":25,"publishTime":10,"linkEnrichedTime":10,"publicationScanTime":10,"contentErrorMessage":10,"viewCount":26,"relateTopics":27},"k-means","K-means là gì? Các công bố khoa học về K-means","k-means là một thuật toán trong lĩnh vực học không giám sát được sử dụng để phân cụm dữ liệu. Đồng thời, nó cũng là một phương pháp phân cụm thống kê phổ biến.\n...","{\"ops\":[{\"insert\":\"k-means là một thuật toán trong lĩnh vực học không giám sát được sử dụng để phân cụm dữ liệu. Đồng thời, nó cũng là một phương pháp phân cụm thống kê phổ biến.\\n\\nThuật toán này hoạt động dựa trên công thức Euclid để tính khoảng cách giữa các điểm dữ liệu và các centroid (điểm trung tâm của từng cụm). Ban đầu, thuật toán chọn ngẫu nhiên một số lượng centroid, sau đó nó liên tục tối ưu hóa vị trí centroid dựa trên việc tính toán khoảng cách và cập nhật cụm dữ liệu.\\n\\nKết quả sau khi thuật toán kết thúc là một số lượng cụm đã được phân loại hoàn tất. Mỗi điểm dữ liệu thuộc vào cụm gần nhất với centroid tương ứng. K-means có thể được áp dụng trong nhiều lĩnh vực như khách hàng phân loại, phân loại hình ảnh, phân tích dữ liệu, và nhiều ứng dụng khác.\\nK-means là một thuật toán phân cụm dữ liệu đơn giản nhưng hiệu quả. Các bước cơ bản trong thuật toán k-means là:\\n\\n1. Chọn ngẫu nhiên K centroid ban đầu trong không gian dữ liệu. K là một số nguyên dương được xác định trước.\\n\\n2. Gán từng điểm dữ liệu vào cụm gần nhất bằng cách tính khoảng cách Euclid giữa điểm dữ liệu và các centroid. Điểm dữ liệu thuộc vào cụm có centroid gần nhất.\\n\\n3. Cập nhật vị trí của các centroid bằng cách tính toán trung bình của tất cả các điểm dữ liệu trong cụm. Điều này sẽ di chuyển centroid về phía trung tâm của cụm.\\n\\n4. Lặp lại bước 2 và 3 cho đến khi không có sự thay đổi nào trong việc gán các điểm dữ liệu vào cụm hay vị trí của các centroid.\\n\\nThuật toán k-means cố gắng tối thiểu hóa tổng bình phương khoảng cách giữa các điểm dữ liệu và centroid của cụm tương ứng. Điều này đảm bảo rằng các điểm dữ liệu trong cùng một cụm sẽ gần nhau nhất và các điểm giữa các cụm sẽ cách xa nhau. Kết quả cuối cùng là một tập hợp các cụm có centroid cách nhau và tối ưu cho dữ liệu ban đầu.\\n\\nMột điểm yếu của thuật toán k-means là độ nhạy của kết quả đối với vị trí ban đầu của các centroid ban đầu. Như vậy, nếu hình dạng của các cụm khác nhau hoặc số lượng cụm không được biết trước, việc khởi tạo centroid ban đầu có thể ảnh hưởng đáng kể đến kết quả.\\n\"}]}",{"id":18,"researcherId":10,"name":19,"imageUrl":20},1,"Nguyễn Ngọc Sơn","https:\u002F\u002Flh3.googleusercontent.com\u002Fa\u002FACg8ocLGfGsF1nYQqYK5BasTLhNu1dBrBXg2fcEgBNPXJ0p2gqLQnO7i=s96-c",[13],false,"PUBLISHED","2023-08-15T12:59:35.029+00:00","2025-09-10T18:52:11.548+00:00",289,[28,31,34,37,47,50,53,56,59,62],{"id":29,"title":30,"term":29,"englishTitle":10,"definition":10,"discipline":10,"disciplineCode":10,"disciplineLabel":10,"disciplineColor":10,"disciplineIcon":10},"bê tông tái chế","Bê tông tái chế là gì? Các nghiên cứu khoa học về Bê tông tái chế",{"id":32,"title":33,"term":32,"englishTitle":10,"definition":10,"discipline":10,"disciplineCode":10,"disciplineLabel":10,"disciplineColor":10,"disciplineIcon":10},"người tiêu dùng trẻ","Người tiêu dùng trẻ là gì? Các bài báo nghiên cứu khoa học",{"id":35,"title":36,"term":35,"englishTitle":10,"definition":10,"discipline":10,"disciplineCode":10,"disciplineLabel":10,"disciplineColor":10,"disciplineIcon":10},"công cụ đánh giá","Công cụ đánh giá là gì? Các nghiên cứu khoa học liên quan",{"id":38,"title":39,"term":38,"englishTitle":40,"definition":41,"discipline":42,"disciplineCode":43,"disciplineLabel":44,"disciplineColor":45,"disciplineIcon":46},"nghiên cứu theo chiều dọc","Nghiên cứu theo chiều dọc là gì? Các phân tích khoa học","Longitudinal Study","Nghiên cứu theo chiều dọc là một thiết kế nghiên cứu quan sát trong đó dữ liệu được thu thập lặp lại từ cùng một nhóm đối tượng qua nhiều mốc thời gian liên tiếp nhằm theo dõi sự biến đổi và thiết lập mối quan hệ nhân quả theo tiến trình tự nhiên.","SOCIAL_SCIENCES","social-sciences","Khoa học xã hội","#E08600","users",{"id":48,"title":49,"term":48,"englishTitle":10,"definition":10,"discipline":10,"disciplineCode":10,"disciplineLabel":10,"disciplineColor":10,"disciplineIcon":10},"phân biệt chủng tộc","Phân biệt chủng tộc là gì? Các nghiên cứu khoa học về Phân biệt chủng tộc",{"id":51,"title":52,"term":51,"englishTitle":10,"definition":10,"discipline":10,"disciplineCode":10,"disciplineLabel":10,"disciplineColor":10,"disciplineIcon":10},"núi lửa","Núi lửa là gì? Các bài báo nghiên cứu khoa học liên quan",{"id":54,"title":55,"term":54,"englishTitle":10,"definition":10,"discipline":10,"disciplineCode":10,"disciplineLabel":10,"disciplineColor":10,"disciplineIcon":10},"phân tâm học","Phân tâm học là gì? Các nghiên cứu khoa học về Phân tâm học",{"id":57,"title":58,"term":57,"englishTitle":10,"definition":10,"discipline":10,"disciplineCode":10,"disciplineLabel":10,"disciplineColor":10,"disciplineIcon":10},"cua biển","Cua biển là gì? Các công bố khoa học về Cua biển",{"id":60,"title":61,"term":60,"englishTitle":10,"definition":10,"discipline":10,"disciplineCode":10,"disciplineLabel":10,"disciplineColor":10,"disciplineIcon":10},"career guidance","Career guidance là gì? Các nghiên cứu khoa học liên quan",{"id":63,"title":64,"term":63,"englishTitle":10,"definition":10,"discipline":10,"disciplineCode":10,"disciplineLabel":10,"disciplineColor":10,"disciplineIcon":10},"epidemiology","Epidemiology là gì? Các nghiên cứu khoa học về Epidemiology"]