одиниця 4 / 11

Дизайн опитування та кількісний аналіз даних

Прибуток:

  • Здатність виявляти провідні, подвійні та неоднозначні пастки в запитаннях опитування та пов’язувати кожне запитання з концепцією
  • Здатність виконувати реальні статистичні розрахунки в програмі та використовувати штучний інтелект лише для вибору та інтерпретації методів
  • Здатність відрізнити статистичну значущість від практичної значущості та перевірити припущення тесту

Кількісне дослідження — це підхід, який вимірює соціальні явища за допомогою цифр і аналізує їх за допомогою статистики: воно шукає відповіді на такі питання, як, скільки людей, з якою швидкістю, яка різниця між якими групами. Найпоширенішим інструментом цього підходу є опитування — метод збору порівнянних даних від великої кількості людей за допомогою стандартних запитань. Налаштування якісного опитування та правильний аналіз вхідних даних вимагає навичок; Погане питання псує результат із самого початку. У цьому розділі ви дізнаєтеся, як використовувати штучний інтелект для розробки запитань для опитування, побудови шкал (варіантів відповідей, які оцінюють ставлення, наприклад, «повністю згоден … категорично не згоден») та аналізу вхідних даних; але ви дізнаєтеся, чому ви повинні зберігати статистичне судження.

Штучний інтелект є найціннішим у кількісному аналізі не в самих обчисленнях, а в поясненні того, як робити обчислення та що означає результат. ШІ може окреслити для вас код аналізу (наприклад, команди для запуску в R або Python), пояснити простою мовою, коли використовувати статистичний тест, і допомогти вам інтерпретувати результат. Але ніколи не довіряйте цифрам, які штучний інтелект генерує «на голову» в тексті: мовна модель не є калькулятором і може видавати неправильне середнє значення, відсоток або p-значення. Фактичний розрахунок виконується в реальній статистичній програмі.

Крок за кроком: від опитування до огляду

1. Пов’яжіть кожне запитання з поняттям. Кожне запитання, яке ви ставите в опитуванні, має відповідати концепції у вашому дослідницькому питанні. Не додавайте запитання лише тому, що «було б цікаво». AI допоможе вам перевірити відображення концепції та запитання в таблиці.

2. Відсійте погані запитання. Навідні («Чи задоволені ви цим чудовим сервісом?»), подвійне запитання («Чи було обслуговування швидким і дешевим?»), розпливчасті («Чи часто вам це подобалося?») запитання спотворюють дані. ШІ добре позначає ці підводні камені в чернетці опитування.

3. Встановіть шкалу послідовно. Якщо ви використовуєте шкалу Лайкерта (5- або 7-бальну шкалу згоди), дотримуйтеся послідовності напряму та оцінок протягом усього опитування. ШІ вловлює невідповідності.

4. Очистити дані. Вхідні дані можуть містити пропущені відповіді, невідповідності або два записи однієї особи. AI може перерахувати кроки очищення та чорновий код; Ви вирішуєте.

5. Виберіть правильний тест і ІНТЕРПРЕТАЦІЙТЕ його. Ви порівнюєте дві групи, шукаєте стосунки? ШІ пояснює, який тест підходить; Ваше завдання — запустити тест у програмі, прочитати та зрозуміти вихідні дані.

Увага: не кажіть штучному інтелекту «обчислити середнє значення цих даних» і записуйте отримане число безпосередньо в звіт. Мовна модель допускає арифметичні помилки. Виконайте обчислення в електронній таблиці або статистичній програмі; Використовуйте ШІ лише для його методу та інтерпретації.

три міні-чохла

Випадок 1 — виправлено навідне запитання. Чернева анкета запитувала: «Наскільки ви задоволені транспортними послугами нашого успішного муніципалітету?» У нього було запитання. AI зазначив, що прикметник «успішний» підштовхував відповідь до позитивної. Питання: «Як ви оцінюєте транспортні послуги муніципалітету?» було нейтралізовано, і результати були більш збалансованими.

Випадок 2 — ШІ виявив прорахунок. Дослідник вставив 300 рядків даних у вигляді тексту в AI і сказав «знайти середній вік»; YZ сказав 34,2. Коли ті самі дані були введені в таблицю, фактичне середнє значення було 31,7. ШІ помилився в тексті; Це було виправлено при перенесенні облікового запису в програму.

Випадок 3 — Уточнено вибір тесту. Команда хотіла порівняти середній бал двох груп, але не знала, який тест використовувати. YZ пояснив, що t-тест (тест, який перевіряє, чи є різниця між середніми двома групами випадковою) підходить для «двох незалежних груп, безперервної змінної», перерахував свої припущення та надав чернетку кодексу. Команда провела тест у програмі та інтерпретувала результат.

Чотири шаблони, які можна копіювати

1) Аудит опитування:

Перегляньте запитання опитування нижче. Перевірте кожне запитання: чи воно навідне, чи подвійне запитання (дві речі в одному питанні), чи воно неоднозначне, чи варіанти відповідей збігаються/відсутні? Дайте задачу та кращу версію поруч. Перевірте, чи відповідає напрям масштабу. Запитання: [тут]

2) Таблиця відображення поняття-питання:

Моє дослідницьке питання: [питання]. Мої ключові поняття: [список]. Розташуйте наступні запитання опитування в таблиці: яку концепцію вимірює кожне запитання? Позначте питання, які не пов’язані з жодним поняттям («зайві»), і поняття, до яких питань немає («незаймані»). Опитування: [тут]

3) План очищення даних (проект коду):

У мене є набір даних опитування з такими змінними: [variables]. Дайте мені контрольний список очищення даних і чернетку коду З РЯДКАМИ КОМЕНТАРІВ для [R/Python]: відсутні дані, викиди, дублікати записів, непослідовне кодування. Я запусту код і перевірю результат; Не займайтеся підрахунками.

4) Статистичний коментар (розрахунок робив я):

Я запустив [назва тесту] і отримав такий результат: [вихід]. Інтерпретуйте цей результат простою мовою: що це означає на практиці, розрізняйте статистичну значущість і практичну значущість і нагадайте вам, які припущення потрібно перевірити. Не перебільшуйте результат; Скажи мені також свої межі.

Слабка підказка / Сильна підказка

Слабка підказка:

Обчисліть середні значення груп у цих даних і скажіть, яка з них вище. [500 рядків даних]

ШІ намагається обчислити в межах тексту та може видати неправильні числа. Крім того, без статистичного тестування неможливо відповісти на запитання «Чи є значна різниця».

Потужна підказка:

Я хочу порівняти бали двох груп: безперервна змінна, дві незалежні групи. (1) Який статистичний тест підходить і чому? (2) Які його припущення? (3) Проект коду коментаря для [R/Python]. Розрахунок зроблю в програмі; Ви просто надаєте метод і код, а не генеруєте числа.

Різниця: AI більше не використовується як ненадійний калькулятор, а як надійний порадник методів.

Розподіл праці в кількісних завданнях

Квест

Чи безпечний ШІ?

Як використовувати

Аудит оформлення питань

так

Маркування пасток

Постійність шкали

так

контрольний список

Код очищення даних

Так (чернетка)

Ви запускаєте код

Внутрішній текстовий рахунок

немає

Ніколи не довіряй

Вибір тесту

так

Поясніть спосіб

Заключний коментар

Так (підтримка)

Це вам судити

Поширені помилки

  • Безпосередньо використовуючи номер, згенерований штучним інтелектом. Мовна модель помилкова в арифметиці; Зробіть розрахунок у програмі.
  • Постановка навідного запитання. Прикметники та припущення спотворюють відповідь.
  • Плутання статистичної значущості з практичною значущістю. «Значною» може бути навіть невелика різниця; Подивіться на розмір.
  • Пропускаючи припущення. Кожен тест має передумови; Не коментуйте без перевірки.
  • Ставлення додаткових питань. Кожне запитання опитування має бути пов’язане з концепцією; решта завищує дані.

Підсумовуючи

ШІ в кількісних дослідженнях; Він є сильним консультантом у виявленні підводних каменів у питаннях опитування, картографуванні концепцій і запитань, написанні коду очищення й аналізу даних, а також інтерпретації результатів простою мовою. Але ніколи не дозволяйте штучному інтелекту виконувати фактичні розрахунки; Модель мови не є калькулятором. Ви обираєте тест, але запускаєте його в програмі, читаєте вихідні дані та розрізняєте статистичну значущість від практичної. AI прискорює метод; Ви несете відповідальність за проблему та коментар.

Аплікаційне завдання

Напишіть проект опитування з 10 запитань. Майте прапорець ШІ та виправляйте навідні, повторювані та неоднозначні запитання за допомогою шаблону «Аудит питання опитування». Потім створіть невеликий вибірковий набір даних (20-30 рядків) і обчисліть фактичне середнє значення та відсотки в програмі для роботи з електронними таблицями; Передайте ті самі дані ШІ як текст, порівняйте їх із отриманими числами та повідомте про різницю. Нарешті, інтерпретація тестового результату за допомогою шаблону «інтерпретація статистики».

контрольний список

  • [ ] Я пов’язав кожне запитання опитування з концепцією.
  • [ ] Я вилучив навідні, подвійні та двозначні питання.
  • [ ] Я зробив фактичний розрахунок у статистичній програмі, а не ШІ.
  • [ ] Я перевірив тестові припущення.
  • [ ] Я відрізнив статистичну значущість від практичної значущості.