Применение вероятностного алгоритма соединения записей для исключения дублирования информации в корпоративной базе данных; Известия Томского политехнического университета [Известия ТПУ]; Т. 309, № 7
| Parent link: | Известия Томского политехнического университета [Известия ТПУ]/ Томский политехнический университет (ТПУ).— , 2000- Т. 309, № 7.— 2006.— [С. 111-116] |
|---|---|
| Hlavní autor: | |
| Shrnutí: | Заглавие с титульного листа Электронная версия печатной публикации Рассмотрена возможность применения вероятностного алгоритма соединения записей для устранения дублирования информации в базе данных крупной организации или предприятия. Отражены теоретические основы алгоритма, предложены способы оценки степени сходства по основным типам атрибутов, рассмотрены возможности усовершенствования модели путем учета степени достоверности данных, поступающих из разных источников. Приведены практические результаты работы на примере задачи устранения дубликатов записей о физических лицах в единой базе данных российского вуза. |
| Jazyk: | ruština |
| Vydáno: |
2006
|
| Edice: | Технические науки |
| Témata: | |
| On-line přístup: | http://www.lib.tpu.ru/fulltext/v/Bulletin_TPU/2006/v309/i7/24.pdf |
| Médium: | Elektronický zdroj Kapitola |
| KOHA link: | https://koha.lib.tpu.ru/cgi-bin/koha/opac-detail.pl?biblionumber=171790 |
MARC
| LEADER | 00000nla2a2200000 4500 | ||
|---|---|---|---|
| 001 | 171790 | ||
| 005 | 20231031164053.0 | ||
| 035 | |a (RuTPU)RU\TPU\book\186262 | ||
| 035 | |a RU\TPU\book\186247 | ||
| 090 | |a 171790 | ||
| 100 | |a 20091208d2006 k y0rusy50 ca | ||
| 101 | 0 | |a rus | |
| 102 | |a RU | ||
| 135 | |a drnn ---uucaa | ||
| 181 | 0 | |a i | |
| 182 | 0 | |a b | |
| 200 | 1 | |a Применение вероятностного алгоритма соединения записей для исключения дублирования информации в корпоративной базе данных |b Электронный ресурс |f А. Е. Пинжин | |
| 203 | |a Текст |c электронный | ||
| 215 | |a 1 файл (365 Кб) | ||
| 225 | 1 | |a Технические науки | |
| 230 | |a Электронные текстовые данные (1 файл : 365 Кб) | ||
| 300 | |a Заглавие с титульного листа | ||
| 300 | |a Электронная версия печатной публикации | ||
| 320 | |a [Библиогр.: с. 116 (12 назв.)] | ||
| 330 | |a Рассмотрена возможность применения вероятностного алгоритма соединения записей для устранения дублирования информации в базе данных крупной организации или предприятия. Отражены теоретические основы алгоритма, предложены способы оценки степени сходства по основным типам атрибутов, рассмотрены возможности усовершенствования модели путем учета степени достоверности данных, поступающих из разных источников. Приведены практические результаты работы на примере задачи устранения дубликатов записей о физических лицах в единой базе данных российского вуза. | ||
| 337 | |a Adobe Reader | ||
| 461 | 1 | |0 (RuTPU)RU\TPU\book\176237 |t Известия Томского политехнического университета [Известия ТПУ] |f Томский политехнический университет (ТПУ) |d 2000- | |
| 463 | 1 | |0 (RuTPU)RU\TPU\book\186202 |t Т. 309, № 7 |v [С. 111-116] |d 2006 |p 274 с. | |
| 610 | 1 | |a вероятностный алгоритм | |
| 610 | 1 | |a записи | |
| 610 | 1 | |a дублирование | |
| 610 | 1 | |a информация | |
| 610 | 1 | |a корпоративные базы данных | |
| 610 | 1 | |a крупные организации | |
| 610 | 1 | |a крупные предприятия | |
| 610 | 1 | |a теоретические основы | |
| 610 | 1 | |a оценка | |
| 610 | 1 | |a сходства | |
| 610 | 1 | |a атрибуты | |
| 610 | 1 | |a данные | |
| 610 | 1 | |a источники | |
| 610 | 1 | |a практические результаты | |
| 610 | 1 | |a дубликаты | |
| 610 | 1 | |a физические лица | |
| 610 | 1 | |a российские вузы | |
| 610 | 1 | |a труды учёных ТПУ | |
| 610 | 1 | |a электронный ресурс | |
| 700 | 1 | |a Пинжин |b А. Е. |c программист отдела информатизации и менеджмента знаний ТПУ |f 1979- |g Алексей Евгеньевич |2 stltpush |3 (RuTPU)RU\TPU\pers\25407 | |
| 801 | 1 | |a RU |b 63413507 |c 20090623 |g PSBO | |
| 801 | 2 | |a RU |b 63413507 |c 20211110 |g PSBO | |
| 856 | 4 | |u http://www.lib.tpu.ru/fulltext/v/Bulletin_TPU/2006/v309/i7/24.pdf | |
| 942 | |c CF | ||