Программа дисциплины «Практикум по экспериментальной психологии и психодиагностика1»



страница7/32
Дата16.08.2018
Размер1.93 Mb.
ТипПрограмма дисциплины
1   2   3   4   5   6   7   8   9   10   ...   32
Выборка стандартизации. При разработке и применении любой точки отсчета следует обращать особое внимание на выборку испытуемых, на которой проводится стандартизация диагностической методики. В математической статистике принято различать такие понятия, как генеральная совокупность (популяция) и выборка.

Всякая большая совокупность людей, которую хотели бы исследовать или относительно которых собираются делать выводы, называется генеральной совокупностью.



Выборка это часть или подмножество совокупности. Проводить исследование всей популяции не принято. Обычно из нее выделяют группу людей — выборку стандартизации — которая реально подвергается тестированию, и с ее помощью оценивается генеральная совокупность. Чтобы оценки носили достоверный характер, выборка должна быть репрезентативна, представительна рассматриваемой популяции, т. е. ее вероятностные свойства должны совпадать или быть близкими к свойствам генеральной совокупности.

По мнению А. Анастази, подавляющее большинство диагностических методик стандартизовано не для столь широких популяций, как многие полагают. Трудно рассчитывать, что по какому-либо тесту имеются адекватные нормы для таких обширных популяций, как, например, «взрослые американцы-мужчины» или «американские дети 14-летнего возраста». Выборки, ориентированные на широкие популяции, не всегда репрезентативны и чаще всего бывают смещены в тех или иных отношениях (т. е. некоторые подгруппы популяции могут быть представлены непропорционально своей численности). Так, если определить популяцию как «14-летние дети», а выборку стандартизации составить из 14-летних школьников, то ее нельзя рассматривать в качестве репрезентативной, поскольку не все 14-летние дети являются школьниками. В этом случае лучше сузить определение популяции (т. е. определить ее как «14-летние школьники»), чем переносить нормы, полученные на школьниках, на популяцию 14-летних детей.

Таким образом, одним из способов обеспечения репрезентативности выборки является ограничение популяции. Ограничить популяцию можно по разным признакам: по возрасту, полу, социальному происхождению, профессии, социально-экономическому статусу, здоровью и т. д. Такая популяция определяется как специфическая, и стандартизация диагностических методик осуществляется на узконаправленных выборках, которые репрезентативны специфической популяции. Создатель диагностической методики должен всегда сообщать, для какой специфической популяции были разработаны нормативные показатели.

Отбор испытуемых в выборку стандартизации осуществляется следующим образом:

1) дается определение популяции с выделением в ее структуре переменных, значимых и малозначимых для изучаемого психического явления (возраст, образование, профессия и т. д.);

2) популяция делится на части в соответствии со значимыми переменными;

3) испытуемые отбираются в случайном порядке и пропорционально численности каждой значимой части совокупности. Случайный отбор может осуществляться по алфавиту, по таблице случайных чисел или другим способом. Важно, чтобы у всех представителей популяции были равные шансы попасть в выборку стандартизации. Это условие подразумевает, что каждый выбор не зависит от остальных.

Объем выборки может варьироваться в широких пределах, но ее минимальный порог, необходимый для получения достоверных результатов, — порядка 200 человек.



&&&

$$$002-004-003$3.2.4.3 Надежность и валидность

Прежде чем психодиагностические методики могут быть использованы для практических целей, они должны пройти проверку по ряду формальных критериев, доказывающих их высокое качество и эффективность. Эти требования в психодиагностике складывались годами в процессе работы над тестами и над их совершенствованием. В результате появилась возможность оградить психологию от всевозможных безграмотных подделок, претендующих на то, чтобы называться диагностическими методиками.

К числу основных критериев оценки психодиагностических методик относятся надежность и валидность. Большой вклад в разработку этих понятий внесли зарубежные психологи (А. Анастази, Е. Гизелли, Дж. Гилфорд, Л. Кронбах, Р. Торндайк и Е. Хаген и др.). Ими были разработаны как формально-логический, так и математико-статисти-ческий аппарат (прежде всего, корреляционный метод и факторный анализ) обоснования степени соответствия методик отмеченным критериям.

В психодиагностике проблемы надежности и валидности методик тесно взаимосвязаны, тем не менее существует традиция раздельного изложения этих важнейших характеристик. Следуя ей, начнем с рассмотрения надежности методик.

В традиционной тестологии термин «надежность» означает относительное постоянство, устойчивость, согласованность результатов теста при первичном и повторном его применении на одних и тех же испытуемых. Как пишет А. Анастази, вряд ли можно с доверием относиться к тесту интеллекта, если по нему в начале недели ребенок имел показатель, равный 110, а к концу — 80. Повторное применение надежных методик дает сходные оценки. При этом в определенной мере могут совпадать как сами результаты, так и порядковое место (ранг), занимаемое испытуемым в группе. И в том, и в другом случае при повторении опыта возможны некоторые расхождения, но важно, чтобы они были незначительными, в пределах одной группы. Таким образом, можно сказать, что надежность методики — это такой критерий, который говорит о точности психологических измерений, т. е. позволяет судить о том, насколько внушают доверие полученные результаты.

Степень надежности методик зависит от многих причин. Поэтому важной проблемой практической диагностики является выяснение факторов, снижающих точность измерений. Была сделана попытка составить классификацию таких факторов. Среди них наиболее часто называются следующие:

1) нестабильность диагностируемого свойства;

2) несовершенство диагностических методик (небрежно составлена инструкция, задания по своему характеру разнородны, нечетко сформулированы указания, как методику предъявлять испытуемым, и т. д.);

3) меняющаяся ситуация обследования (разное время дня, когда проводятся эксперименты, разная освещенность помещения, наличие или отсутствие посторонних шумов и т. д.);

4) различия в манере поведения экспериментатора (от опыта к опыту по-разному предъявляет инструкции, по-разному стимулирует выполнение заданий и т. д.);

5) колебания в функциональном состоянии испытуемого (в одном эксперименте отмечается хорошее самочувствие, в другом — утомление и т. д.);

6) элементы субъективности в способах оценки и интерпретации результатов (когда ведется протоколирование ответов испытуемых, оцениваются ответы по степени полноты, оригинальности и т. п.).

Если все эти факторы иметь в виду и постараться в каждом из них устранить условия, снижающие точность измерений, то можно добиться приемлемого уровня надежности теста. Одним из важнейших средств повышения надежности психодиагностической методики является единообразие процедуры обследования, его строгая регламентация: одинаковые для обследуемой выборки испытуемых обстановка и условия работы, однотипный характер инструкций, одинаковые для всех временные ограничения, способы и особенности контакта с испытуемыми, порядок предъявления заданий и т. д. При такой стандартизации процедуры исследования можно существенно уменьшить влияние посторонних случайных факторов на результаты теста и таким образом повысить их надежность.

На характеристику надежности методик большое влияние оказывает исследуемая выборка. Она может как снижать, так и завышать этот показатель, например, надежность может быть искусственно завышена, если в выборке небольшой разброс результатов, т. е. если результаты по своим значениям близки друг к другу. В этом случае при повторном обследовании новые результаты также расположатся тесной группой. Возможные изменения ранговых мест испытуемых будут незначительными, и, следовательно, надежность методики будет высокой. Такое же неоправданное завышение надежности может возникнуть при анализе результатов выборки, состоящей из группы, имеющей очень высокие результаты, и из группы с очень низкими оценками по тесту. Тогда эти далеко отстоящие друг от друга результаты не будут перекрываться, даже если и вмешаются в условия эксперимента случайные факторы. Поэтому в руководстве обычно делается описание выборки, на которой определялась надежность методики.

В настоящее время надежность все чаще определяется на наиболее однородных выборках, т. е. на выборках, схожих по полу, возрасту, уровню образования, профессиональной подготовке и т. п. Для каждой такой выборки приводятся свои коэффициенты надежности. Приводимый показатель надежности применим только к группам, подобным тем, на которых он определялся. Если методика применяется к выборке, отличающейся от той, на которой проверялась ее надежность, то эта процедура должна быть проведена заново.

Так как надежность отражает степень согласованности двух независимо полученных рядов показателей, то математико-статистический прием, с помощью которого устанавливается надежность методики — это корреляции (по Пирсону или Спирмену). Надежность тем выше, чем ближе полученный коэффициент корреляции подходит к единице, и наоборот.

Основные показатели надежности можно обозначить следующим образом:

♦ показатель, характеризующий измерительный инструмент, предлагается называть коэффициентом надежности;

♦ показатель, характеризующий стабильность измеряемого свойства — коэффициентом стабильности;

♦ показатель оценки влияния личности экспериментатора — коэффициентом константности.

Именно в таком порядке рекомендуется осуществлять проверку методики на надежность: целесообразно сначала проверить инструмент измерения. Если полученные данные удовлетворительны, то можно переходить к установлению меры стабильности измеряемого свойства, а уже после этого, при необходимости, заняться критерием константности.

Валидность. Другим после надежности ключевым критерием оценки качества методик является валидность. Вопрос о валидности методики решается лишь после того, как установлена достаточная ее надежность, поскольку ненадежная методика не может быть валидной. Но самая надежная методика без знания ее валидности является практически бесполезной.

Следует заметить, что вопрос о валидности до последнего времени представляется одним из самых сложных. Наиболее укоренившимся определением этого понятия является то, которое приведено в книге А. Анастази: «Валидность теста — понятие, указывающее нам, что тест измеряет и насколько хорошо он это делает» [10, т. 1 с. 126].

Валидность по своей сути — это комплексная характеристика, включающая, с одной стороны, сведения о том, пригодна ли методика для измерения того, для чего она была создана, а с другой стороны, какова ее действенность, эффективность, практическая полезность.

По этой причине не существует какого-то единого универсального подхода к определению валидности. В зависимости от того, какую сторону валидности хочет рассмотреть исследователь, используются и разные способы доказательства. Другими словами, понятие валидности включает в себя разные ее виды, имеющие свой особый смысл. Проверка валидности методики называется валидизацией.

Валидность в первом ее понимании имеет отношение к самой методике, т. е. это валидность измерительного инструмента. Такая проверка называется теоретической валидизацией. Валидность во втором понимании уже относится не столько к методике, сколько к цели ее использования. Это прагматическая валидизация.

Обобщая, можно сказать следующее:

♦ при теоретической валидизации исследователя интересует само свойство, измеряемое методикой. Это, по существу, означает, что проводится собственно психологическая валидизация;

♦ при прагматической валидизации суть предмета измерения (психологического свойства) оказывается вне поля зрения. Главный акцент сделан на то, чтобы доказать, что нечто, измеряемое методикой, имеет связь с определенными областями практики.

Провести теоретическую валидизацию, в отличие от прагматической, порой оказывается значительно труднее. Не вдаваясь пока в конкретные детали, остановимся в общих чертах на том, как проверяется прагматическая валидность: выбирается какой-нибудь независимый от методики внешний критерий, определяющий успех в той или иной деятельности (учебной, профессиональной и т. п.), и с ним сравниваются результаты диагностической методики. Если связь между ними признается удовлетворительной, то делается вывод о практической значимости, эффективности, действенности диагностической методики.

Для определения теоретической валидности найти какой-либо независимый критерий, лежащий вне методики, гораздо труднее. Поэтому на ранних стадиях развития тестологии, когда концепция валидности только складывалась, бытовало интуитивное представление о том, что тест измеряет:

1) методика называлась валидной, так как то, что она измеряет, просто очевидно;

2) доказательство валидности основывалось на уверенности исследователя в том, что его метод позволяет понять испытуемого;

3) методика рассматривалась как валидная (т. е. принималось утверждение, что такой-то тест измеряет такое-то качество) только потому, что теория, на основании которой строилась методика, очень хорошая.

Принятие на веру голословных утверждений о валидности методики не могло продолжаться длительное время. Первые проявления действительно научной критики развенчали такой подход: начались поиски научно обоснованных доказательств.

Таким образом, провести теоретическую валидизацию методики — это доказать, что методика измеряет именно то свойство, качество, которое она по замыслу исследователя должна измерять.

Так, например, если какой-то тест разрабатывался для того, чтобы диагностировать умственное развитие детей, надо проанализировать, действительно ли он измеряет именно это развитие, а не какие-то другие особенности (например, личность, характер и т. п.). Таким образом, для теоретической валидизации кардинальной проблемой является отношение между психологическими явлениями и их показателями, посредством которых эти психологические явления пытаются познать. Это показывает, насколько замысел автора и результаты методики совпадают.

Не столь сложно провести теоретическую валидизацию новой методики, если для измерения данного свойства уже имеется методика с доказанной валидностью. Наличие корреляции между новой и аналогичной уже проверенной методикой указывает на то, что разработанная методика измеряет то же психологическое качество, что и эталонная. И если новый метод одновременно оказывается более компактным и экономичным в проведении и обработке результатов, то психодиагносты получают возможность использовать новый инструмент вместо старого.

Но теоретическая валидность доказывается не только путем сопоставления с родственными показателями, а также и с теми, где, исходя из гипотезы, значимых связей не должно быть. Таким образом, для проверки теоретической валидности важно, с одной стороны, установить степень связи с родственной методикой (конвергентная валидность) и отсутствие этой связи с методиками, имеющими другое теоретическое основание (дискриминантная валидность).

Гораздо труднее провести теоретическую валидизацию методики тогда, когда такой путь проверки невозможен. Чаще всего именно с такой ситуацией сталкивается исследователь. В таких обстоятельствах только постепенное накопление разнообразной информации о изучаемом свойстве, анализ теоретических предпосылок и экспериментальных данных, значительный опыт работы с методикой позволяет раскрыть ее психологический смысл.

Важную роль для понимания того, что методика измеряет, играет сопоставление ее показателей с практическими формами деятельности. Но здесь особенно важно, чтобы методика была тщательно проработана в теоретическом плане, т. е. чтобы имелась прочная, обоснованная научная база. Тогда при сопоставлении методики с взятым из повседневной практики внешним критерием, соответствующим тому, что она измеряет, может быть получена информация, подкрепляющая теоретические представления о ее сущности.

Важно помнить, что если доказана теоретическая валидность, то интерпретация полученных показателей становится более ясной и однозначной, а название методики соответствует сфере ее применения. Что касается прагматической валидизации, то она подразумевает проверку методики с точки зрения ее практической эффективности, значимости, полезности, поскольку диагностической методикой имеет смысл пользоваться только тогда, когда доказано, что измеряемое свойство проявляется в определенных жизненных ситуациях, в определенных видах деятельности. Ей придают большое значение особенно там, где встает вопрос отбора.

&&&

$$$002-004-100$Лекция № 4.Вопросы для самоконтроля

1. Дайте определение понятию «стандартизация методик».

2. Что такое репрезентативная выборка? Как она строится?

3. Назовите приведенные в главе критерии оценки результатов диагностических испытаний.

4. Что такое надежность методики? Назовите виды надежности.

5. Что такое валидность методики? Назовите ее основные виды.


&&&

$$$002-005-000$3.2.5 Лекция № 5 Экспериментальное исследование и его типы

План:

1. Особенности экспериментального исследования


2. Типы экспериментального исследования
&&&

$$$002-005-001$3.2.5.1 Особенности экспериментального исследования

Вспомним еще раз, что все методы, применяемые для получения эмпирического материала, можно условно разделить на активные и пассивные. К первым относятся лабораторный эксперимент и его различные модификации, квазиэксперимент. Ко вторым — наблюдение, клинический метод, метод анализа продуктов деятельности, измерение и корреляционные исследования, метод сбора информации (servey research), «архивное исследование» и т. д. Применяя методы первой группы, исследователь активно вызывает явление или процесс, воздействуя на объект. Используя же методы второй группы, он лишь довольствуется регистрацией естественного процесса. Другое дело, что регистрировать поведение исследователь может непосредственно или применяя некоторый инструмент (опросник, тест и т. д.). Так же как и воздействовать на испытуемого он может непосредственно в ходе беседы либо организуя деятельность обследуемого в лабораторном эксперименте с помощью исследовательских средств (приборов, заданий и т. д.). Это — второе «измерение» психологических эмпирических методов.

Существует и третье измерение: в какой мере экспериментатор использует естественнонаучный подход к исследованию или «метод понимания» — непосредственной интерпретации поведения испытуемого, его внутреннего мира путем эмпатии или построения модели психики испытуемого в своей субъективной реальности. В чем-то (но не во всем) это измерение психологических методов сходно с измерением «инструментальность — непосредственность».

Наблюдение тоже может быть инструментальным, например, при использовании видеозаписи, магнитофонной записи и другой аппаратуры. Однако, в отличие от измерительного корреляционного исследования, при этом отсутствует взаимодействие испытуемого с инструментом, как при измерении (выполнении теста).

В эксперименте и в ходе измерения испытуемый активно выполняет задания, а при наблюдении и опросе никакой задачи ему не ставится, он ведет себя естественным образом.

Таблица 1


Экспериментатор

Испытуемый

Выполнение задачи

Естественное поведение

Воздействует на процесс

Эксперимент

Беседа, опрос

Фиксирует естественный процесс

Измерение

Наблюдение

Существует еще один важный критерий (он разделяет методы организации исследования на две большие группы). Это — критерий соответствия метода признакам идеального исследования, как он понимается в современной методологии науки.

По этому критерию различаются методы организации исследования:

1. Экспериментальное исследование, систематическое наблюдение или корреляционное исследование. Особенность их состоит в том, что исследователь пытается установить причинную или корреляционные связи между основными переменными, контролируя внешние переменные. Для этого он целенаправленно отбирает группы испытуемых или наблюдаемых индивидов, планирует определенным образом последовательность своих действий.

2. Естественные эксперимент и наблюдение, беседа, клинический метод, метод описания частных случаев и др. Они применяются для выявления особенностей поведения человека. Служат источником для эмпирических обобщений и выдвижения индуктивных гипотез, которые в дальнейшем могут стать материалом для теоретических рассуждений и проверяться в критических экспериментах. Способы контроля переменных (независимой, зависимой, внешних) систематически не применяются, хотя возможно использование сложных техник фиксации данных (карт наблюдения, аудио- и видеоаппаратуры, тестов и др.).

3. Квазиэксперимент. «Промежуточный» между естественными методами проведения исследования и методами, где применяется строгий контроль переменных. Часто его отождествляют (в частности, Ф.-Дж. МакГиган) с методом систематического наблюдения, при котором экспериментатор не воздействует на исследуемый объект. Но такая точка зрения не оправданна. Другое дело, что воздействие может быть выделено в природе как независимое от исследователя, естественно происходящее, но в этом случае мы получаем исследовательский метод, занимающий именно промежуточное положение между экспериментом и наблюдением. Под квазиэкспериментом принято понимать такой метод, при котором не удается полностью реализовать схему, предписываемую идеальным исследованием, но эти отношения частично компенсируются использованием особых квазиэкспериментальных планов.

Согласно традиции, экспериментальное исследование противопоставляется всем неэкспериментальным методам, которые рассматриваются в методологии науки с точки зрения того, чего им недостает, чтобы стать полноценным экспериментальным исследованием.

Так, Ф.-Дж. МакГиган противопоставляет экспериментальный метод следующим:

1) классическому клиническому методу;

2) естественному наблюдению;

3) опросу;

4) архивному исследованию;

5) установлению корреляционной связи;

6) квазиэксперименту.

М. В. Мэтлин приводит иной список методов, противопоставляемых эксперименту:

1. Естественное наблюдение, к которому примыкает полевое исследование и полевой (естественный) эксперимент.

2. Опрос (servey methods).

3. Корреляционное исследование.

4. Архивное исследование.

5. Изучение отдельных случаев (case-study method или case-history technique).

П. К. Козби противопоставляет эксперименту корреляционный метод, а также доэкспериментальные методы: опрос, полевое наблюдение и полевой эксперимент. Отдельно он рассматривает методы измерения поведения, относя к ним архивный метод, самооценку (самоопрос) и тестирование. (Большинство этих методов было рассмотрено в разделе 2.3.)

Экспериментальное исследование в психологии отличается от других методов тем, что экспериментатор активно манипулирует независимой переменной, тогда как при прочих методах возможны лишь варианты отбора уровней независимых переменных. Нормальным вариантом экспериментального исследования является наличие основной и контрольных групп испытуемых. В неэкспериментальных исследованиях, как правило, все группы равноценны, поэтому проводится их сравнение.



&&&

$$$002-005-002$3.2.5.2


Каталог: ebook -> umkd
umkd -> Республики казахстан
umkd -> Программа дисциплины для преподавателя семей 2014 разработано
umkd -> Программа дисциплины для преподавателя семей 2013 предисловие курс «Организация работы местной администрации»
umkd -> Республики казахстан
umkd -> Курс лекций по дисциплине «Системы автоматизированного проектирования»
umkd -> Запрещенные аргументы
umkd -> Республики казахстан
umkd -> Программа дисциплины «Основы системной экологии»
umkd -> Республики казахстан


Поделитесь с Вашими друзьями:
1   2   3   4   5   6   7   8   9   10   ...   32


База данных защищена авторским правом ©znate.ru 2019
обратиться к администрации

    Главная страница