Tìm kiếm ảnh dựa vào nội dung Luận văn cử nhân tin học

  • Phát hành Nguyễn Quốc Uy
  • Đánh giá
  • Lượt tải 178
  • Sử dụng Miễn phí
  • Dung lượng 1,8 MB
  • Cập nhật 06/02/2013

Giới thiệu

LUẬN VĂN CỬ NHÂN TIN HỌC

ĐỀ TÀI:
TÌM KIẾM ẢNH DỰA VÀO NỘI DUNG

LỜI MỞ ĐẦU

Sự mở rộng của multimedia, cùng với khối lượng hình ảnh và phim lớn, sự phát triển của những xa lộ thông tin hiện tại đã thu hút ngày càng nhiều những chuyên gia đi vào nghiên cứu những công cụ cung cấp cho việc lấy thông tin từ dữ liệu ảnh từ nội dung của chúng. Lấy thông tin từ dữ liệu ảnh có liên quan đến rất nhiều các lĩnh vực khác, từ những phòng trưng bày tranh nghệ thuật cho t ới nh ững nơi lưu trữ tranh nghệ thuật lớn như viện bảo tàng, kho lưu trữ ảnh chụp, kho lưu trữ ảnh tội phạm, cơ sở dữ liệu ảnh về địa lý, y học, ... điều đó làm cho lĩnh vực nghiên cứu này phát triển nhanh nhất trong công nghệ thông tin.

Lấy thông tin từ dữ liệu ảnh đặt ra nhiều thách thức nghiên cứu mới cho các khoa học gia và các kỹ sư. Phân tích ảnh, xử lý ảnh, nhận dạng mẫu, giao tiếp giữa người và máy là những lĩnh vực nghiên cứu quan trọng góp phần vào phạm vi nghiên cứu mới này. Khía cạnh tiêu biểu của lấy thông tin từ dữ liệu ảnh dựa trên những công bố có sẵn như là những đối tượng nhận thức như màu sắc, vân (texture), hình dáng, cấu trúc, quan hệ không gian, hay thuộc về ngữ nghĩa căn bản như: đối tượng, vai trò hay sự kiện hay liên quan đến thông tin về ngữ nghĩa quan hệ như cảm giác, cảm xúc, nghĩa của ảnh. Thật ra phân tích ảnh, nhận dạng mẫu, hay xử lý ảnh đóng một vai trò căn bản trong hệ thống lấy thông tin từ ảnh. Chúng cho phép sự trích rút tự động hầu hết những thông tin về nhận thức, thông qua phân tích sự phân bổ điểm ảnh và sự phân tích độ đo. Tìm kiếm theo cách thông thường dựa trên v ăn bản giờ đây được bổ sung bởi truy vấn dựa vào nội dung, nhắm vào khía cạnh nhận thức thông tin ảnh. Thực hiện truy vấn ở mức nhận thức đòi hỏi những phương thức mới, cho phép chỉ định đến những thuộc tính liên quan đến thị giác cần tìm. Giao diện đồ họa phải hỗ trợ đặc tả những ví dụ đó như là những mẫu có sẵn. Khi đó người dùng trong một vòng lặp, mô hình giao diện sao cho người dùng có thể truy cập vào sự giống nhau giữa những đối tượng.

1. Sự hình thành bài toán:

Bên cạnh kho dữ liệu văn bản, kho dữ liệu ảnh ngày càng trở nên khổng lồ vượt quá sự kiểm soát của con người. Khi có nhu cầu tìm kiếm một vài tấm ảnh nào đó trong một cơ sở dữ liệu hàng trăm ngàn ảnh, điều này khó có thể thực hiện được khi ta tìm kiếm bằng tay theo cách thông thường, nghĩa là xem lần lượt từng tấm ảnh một cho đến khi tìm thấy ảnh có nội dung cần tìm. Song song với sự phát triển của những phương tiện kỹ thuật số, trong tương lai, số lượng ảnh sẽ còn tăng nhanh hơn nữa, nhiều hơn nữa. Do đó, nhu cầu thật sự đòi hỏi phải có một công cụ hỗ trợ cho việc tìm kiếm này càng sớm càng tốt. Vì vậy đề tài “tìm kiếm dữ liệu ảnh dựa vào nội dung” ra đời để góp phần đáp ứng nhu cầu này.

“Tìm kiếm dữ liệu ảnh dựa vào nội dung” là gì? Đây là một chủ đề nghiên cứu mới trong công nghệ thông tin. Mục đích chính của nó là lấy những ảnh từ cơ sở dữ liệu phù hợp với tiêu chí truy vấn. Thế hệ đầu tiên c ủa hệ thống tìm kiếm ảnh dựa vào nội dung cho phép truy cập trực tiếp đến ảnh thông qua thuộc tính chuỗi. Những tìm kiếm đặc thù cho những hệ thống dạng này là “tìm tất cả những tranh vẽ của trường Florentine trong thế kỷ thứ XV” hay “tìm kiếm tất cả những tấm ảnh về đất đai của Cezanne”. Metadata của hệ thống trong thế hệ đầu tiên dựa trên chuỗi, sơ đồ trình bày, mô hình quan hệ, cấu trúc khung. Thế hệ mới của hệ thống tìm kiếm ảnh hỗ trợ đầy đủ việc lấy thông tin dựa vào nội dung thuộc về thị giác. Chúng cho phép phân tích đối tượng, tự động trích rút đặc trưng.

Những phần tử thuộc về thị giác như là màu sắc, vân, hình dạng đối tượng, quan hệ không gian có liên quan trực tiếp đến khía cạnh nhận thức của nội dung ảnh. Ta trực tiếp đánh vào những phần tử này trong việc tìm kiếm. Do đó, nội dung của đề tài sẽ giải quyết như sau: hệ thống tìm kiếm ảnh dựa vào nội dung, ba đặc trưng là màu sắc, vân và hình dạng. Đề tài chỉ tập chung vào demo một số phương pháp làm củatừng phần.

2. Cách tiếp cận:

Đề tài tiếp cận theo mô hình thống kê. Có ba loại tìm kiếm ảnh đề tài tập chung giải quyết là:
- Tìm kiếm ảnh dựa vào màu sắc.
- Tìm kiếm ảnh dựa vào vân.
- Tìm kiếm ảnh dựa vào hình d ạng.

2.1. Đặc trưng màu sắc:

Màu sắc là vấn đề cần tập chung giải quyết nhiều nhất, vì một ảnh màu thì thông tin quan trọng nhất trong ảnh chính là màu sắc. Hơn nữa thông tin về màu sắc là thông tin người dùng quan tâm nhất; qua đặc trưng màu sắc, có thể lọc được rất nhiều lớp ảnh, thông qua vị trí, không gian, định lượng của màu trong ảnh.

2.2. Đặc trưng vân:

Có những lớp ảnh mà màu sắc không thể giải quyết được, đòi hỏi phải dùng đặc trưng vân. Ví dụ như những ảnh liên quan đến cấu trúc của điểm ảnh như: cỏ, mây, đá, sợi. Vân sẽ giải quyết tốt cho việc tìm kiếm đối với lớp ảnh này.

2.3. Đặc trưng hình dáng:

Đối với những lớp ảnh cần tìm mà liên quan đến hình dạng của đối tượng thì đặc trưng vân và màu không thể giải quyết được. Ví dụ như tìm một vật có hình dạng ellipse hay hình tròn trong ảnh. Tìm kiếm theo hình dáng thật sự là một cái đích của hệ thống tìm kiếm dựa vào nội dung muốn đạt tới.

2.4. Độ đo:

Có ý nghĩa quan trọng trong tìm kiếm ảnh dựa vào nội dung. Độ đo mang ý nghĩa quyết định kết quả tìm kiếm sẽ như thế nào

Download tài liệu để xem thêm chi tiết