Quantitative metrics for measuring web accessibility
要約
- Webアクセシビリティの定量的な測定方法についての論文
- 定量的アクセシビリティ指標の必要性を提唱
- 定量的アクセシビリティ指標の使用場面として、Webエンジニアリング内の品質保証、情報検索、アクセシビリティモニタリングを提案
- 自動評価ツールのレポートから自動的に計算される定量指標を提案
- 15のウェブサイト(1363ページ)を2つの評価ツールによって測定し、結果を元に指標の信頼性を検証
- 結果は評価ツールに依存するが、Spearmanのテストにより異なるツールの結果間に高い相関があることを示し、ランキング目的で指標が信頼できると結論
- 定量的アクセシビリティ指標は情報検索やアクセシビリティモニタリングのシナリオにおいて有用であり、一部Webエンジニアリングのシナリオにも適用可能
- これにより、ウェブサイトのアクセシビリティを測定し、ランキングするための定量的指標が提案され、その信頼性が検証された
- ウェブサイトのアクセシビリティを測定するためのメトリックを記述
- メトリックは、0から100の範囲で表現されるアクセシビリティ値を生成
- メトリックはWCAG 2.0に基づいて計算され、エラーや警告の重み付けが行われる
- メトリックは、アクセシビリティのレベルを示すために使用される
- メトリックの計算には、異なるページのテストファイルを使用して重み付けを調整する実験が含まれる
- アクセシビリティ値と失敗率の関係を示す理想的なハイパーボラのアプローチが提案される
- メトリックの計算には、エラーと警告の両方が含まれる
- メトリックの結果は、WCAG 1.0に基づいている
- 結果の議論では、異なる重み付けの影響について述べられる
- メトリックは、一般的な問題に影響を受けないように設計されている
- メトリックの計算には、変数、定数、最終値が使用される
- メトリックの評価は、自動評価ツールによって行われる
- 最後に、メトリックの計算方法が示される
以上が要約です。
- 提案されたメトリックの適用可能性を理解するために、EvalAccessとLIFTという2つのウェブアクセシビリティツールを使用して実験的な分析が行われた。
- その結果、EvalAccessとLIFTの得られた結果にはマークされた違いがあり、これにより特定のウェブページにおけるアクセシビリティのレベルにおいて大きな違いが示された。
- さらに、A1とA2、およびA1*とA2*についてSpearmanの相関係数が計算され、それぞれにおいて中程度から強い相関が示された。
- この結果から、提案されたメトリックはウェブサイトのランキングに使用できる可能性があり、アクセシビリティ監視シナリオにおいては特に有用であることが示唆された。
- 同様の結果はEvalAccessとLIFT以外のツールにも適用される可能性がある
- WebエンジニアリングのQAなど、アクセシビリティレベルを定量的に測定する必要のあるタスクでは、ツールの選択が評価者を制約する
- 提案された定量的アクセシビリティメトリクスは、自動評価ツールのレポートから自動的に得られる
- アクセシビリティの値のばらつきが非常に低いウェブサイトがいくつかあり、これらのサイトはテンプレートを多用している
- 将来の作業は、ユーザーとの実験を実施し、メトリックがユーザーが体験するアクセシビリティレベルを反映しているかどうかを調査すること
- これまでの結果から、提案されたメトリックはツール依存的であることがわかった
評価
この論文は、Webアクセシビリティの定量的な測定方法について探求し、その必要性を提唱しています。著者は、Webエンジニアリングの品質保証、情報検索、アクセシビリティモニタリングなどの場面で利用可能な定量的なアクセシビリティ指標を提案します。これらの指標は、自動評価ツールのレポートから自動的に計算されます。
著者は、15のウェブサイト(1363ページ)を2つの評価ツールで測定し、その結果を元に指標の信頼性を検証しました。結果は評価ツールに依存しますが、異なるツール間の結果には高い相関があることが示され、指標がランキング目的で信頼できると結論づけました。
提案されたメトリックは0から100の範囲で表現されるアクセシビリティ値を生成し、WCAG 2.0に基づいて計算されます。これにはエラーや警告の重み付けが含まれ、理想的なハイパーボラのアプローチを用いてアクセシビリティ値と失敗率の関係が示されます。メトリックは一般的な問題に影響を受けないように設計されています。
評価ツールを使用した実験的な分析により、提案されたメトリックの適用可能性が検証されました。その結果、異なる評価ツールが生成する結果には有意な違いがあり、それは特定のウェブページのアクセシビリティ評価に影響を与えることが示されました。
研究では、ジにおけるアクセシビリティレベルの差を明らかにしました。A1とA2、A1*とA2*の間には中から強い相関がありました。これは提案されたメトリックがウェブサイトのランキングに有用であり、特にアクセシビリティ監視シナリオで役立つことを示しています。また、他のツールでも同様の結果が得られる可能性があります。アクセシビリティレベルを定量的に測定する必要がある場合、特にWebエンジニアリングのQAのようなタスクでは、ツールの選択が評価者に制約を与えることがわかりました。提案された定量的アクセシビリティメトリクスは自動評価ツールのレポートから自動的に得られます。一部のウェブサイトではアクセシビリティの値のばらつきが非常に低く、これらのサイトはテンプレートを多用しています。今後の研究では、ユーザーとの実験を通じてメトリックがユーザー体験のアクセシビリティレベルを反映しているかどうかを検証する予定です。これまでの結果からは、提案されたメトリックはツール依存的であることが明らかになりました。
和訳
1 / 1
100%