Veri Madenciliği

Gönderen Ufuk Aksoy 24 Mayıs 2009 tarihinde Programlama, Teknik | İlk yorumu okuyun

Veri madenciliği

Basit bir tanım yapmak gerekir ise veri madenciliği, büyük ölçekli veriler arasından bilgiye ulaşma, bilgiyi madenleme işidir. Ya da bir anlamda büyük veri yığınları içerisinden gelecek ile ilgili tahminde bulunabilmemizi sağlayabilecek bağıntıların bilgisayar programı kullanarak aranmasıdır. Veri madenciliği deyimi yanlış kullanılan bir deyim olabileceğinden buna eş değer başka kullanımlar da literatüre geçmiştir. Veritabanlarında bilgi madenciliği (knowledge mining from databases), Bilgi çıkarımı(knowledge extraction), data/pattern anaysis (veri ve örüntü analizi), veri arkeolojisi gibi.

Bunların arasındaki en popüler kullanım Veritabanlarında Bilgi Keşfi (VBK - Knowledge Discovery From Databases - KDD) ‘dir. Alternatif olarak veri madenciliği aslında bilgi keşfi sürecinin bir parçası şeklinde kabul görmektedir. Bu adımlar:

1-Veri Temizleme (gürültülü ve tutarsız verileri çıkarmak)
2-Veri Bütünleştirme (birçok veri kaynağını birleştirebilmek)
3-Veri Seçme (Yapılacak olan analiz ile ilgili olan verileri belirlemek )
4-Veri Dönüşümü (Verinin veri madenciliği tekniğinden kullanılabilecek hale dönüşümünü gerçekleştirmek)
5-Veri Madenciliği (Veri örüntülerini yakalayabilmek için akıllı metotları uygulamak)
6-Örüntü Değerlendirme (Bazı ölçümlere göre elde edilmiş bilgiyi temsil eden ilginç örüntüleri tanımlamak)
7-Bilgi Sunumu (Madenciliği yapılmış olan elde edilmiş bilginin kullanıcıya sunumunu gerçekleştirmek),

Veri madenciliği adımı, kullanıcı ve bilgi tabanı ile etkileşim halindedir. İlginç örüntüler kullanıcıya gösterilir, ve bunun ötesinde istenir ise bilgi tabnına da kaydedilebilir. Buna göre, veri madenciliği işlemi, gizli kalmış örüntüler bulunana kadar devam eder.

Bir veri madenciliği sistemi, aşağıdaki temel bileşenlere sahiptir: ·Veritabanı, veri ambarı ve diğer depolama teknikleri ·Veritabanı ya da veri ambarı Sunucusu ·Bilgi Tabanı ·Veri Madenciliği Motoru ·Örüntü Değerlendirme ·Kullanıcı Arayüzü

Veri madenciliği, eldeki verilerden üstü kapalı, çok net olmayan, önceden bilinmeyen ancak potansiyel olarak kullanışlı bilginin çıkarılmasıdır. Bu da; kümeleme, veri özetleme, değişikliklerin analizi, sapmaların tespiti gibi belirli sayıda teknik yaklaşımları içerir.

Başka bir deyişle, veri madenciliği, verilerin içerisindeki desenlerin, ilişkilerin, değişimlerin, düzensizliklerin, kuralların ve istatistiksel olarak önemli olan yapıların yarı otomatik olarak keşfedilmesidir.

Temel olarak veri madenciliği, veri setleri arasındaki desenlerin ya da düzenin, verinin analizi ve yazılım tekniklerinin kullanılması ile ilgilidir. Veriler arasındaki ilişkiyi, kuralları ve özellikleri belirlemekten bilgisayar sorumludur. Amaç, daha önceden fark edilmemiş veri desenlerini tespit edebilmektir.

Veri madenciliğini istatistiksel bir yöntemler serisi olarak görmek mümkün olabilir. Ancak veri madenciliği, geleneksel istatistikten birkaç yönde farklılık gösterir. Veri madenciliğinde amaç, kolaylıkla mantıksal kurallara ya da görsel sunumlara çevrilebilecek nitel modellerin çıkarılmasıdır. Bu bağlamda, veri madenciliği insan merkezlidir ve bazen insan – bilgisayar arayüzü birleştirilir.

Veri madenciliği sahası, istatistik, makine bilgisi, veritabanları ve yüksek performanslı işlem gibi temelleri de içerir.

Veri madenciliği konusunda bahsi geçen geniş verideki geniş kelimesi, tek bir iş istasyonunun belleğine sığamayacak kadar büyük veri kümelerini ifade etmektedir. Yüksek hacimli veri ise, tek bir iş istasyonundaki ya da bir grup iş istasyonundaki disklere sığamayacak kadar fazla veri anlamındadır. Dağıtık veri ise, farklı coğrafi konumlarda bulunan verileri anlatır.

Yazının devamını oku… »

Popularity: 100% [?]

Nisan 2009 Raporu

Gönderen Ufuk Aksoy 07 Mayıs 2009 tarihinde Reklam, TANITIM, Web | İlk yorumu siz yapın

Nisan ayının sonuna doğru artık tüm siteler tek sunucuya taşınmış ve bandwidth lerinde bir problem kalmadan yayına geçtiler. Bu ayki en büyük yenilik sitelere Lightbox eklentisi kurulması oldu. Sonsuz.us ve sibelatasoy.com da ayrıca daha sonra bahsedeceğimiz bir sitemizde aktif olarak kullanılmaktadır. Kurulumu son derece kolay olan bu eklentinin wordpress ve drupal sürümleri mevcuttur.

Chessmoon.com da epey aşama kaydedilmiş ve artık satranc.net olmaya aday hale gelmiştir. Önümüzde ki günlerde toplantısı yapılacak ve son rütuşlar verilecektir.

Bir önceki konu başlığında ki okulforum.net açılmış ve hizmete başlamıştır. SMF tabanlı olan okul forum da ilköğretim öğrencilerinin katkılarıyla okullarda ki hayata yardımcı bir çok bilgi bulunması hedeflenmektedir.

Dahilerokulu.org sitesine IQ testleri ve sorular eklenmiştir. Önümüzde ki aylarda birçok soru eklenecek ve ödüllü yarışmalar düzenlenecektir.

Bu ay yeni bir projeye başlamış bulunuyoruz. Emlak sitesi olan http://www.z-realestateturkey.com/ yayın hayatına başladı. Henüz tamamlanmamış sitenin alt yapısı wordpress. Tamamen emlak üzerine olacak sitenin takibi ve barındırması tarafımızdan sağlanmaktadır.

Sitelerde forumlarda tartışmalar devam etmekte yeni yazılar eklenmektedir.

Acikokul.com ve satranc.net siteleri geçici olarak yayındışıdır. En yakın zamanda yeni sunucuda yayına geçeceklerdir.

Popularity: 52% [?]