論文の概要: Learning in Blocks: A Multi Agent Debate Assisted Personalized Adaptive Learning Framework for Language Learning
- arxiv url: http://arxiv.org/abs/2604.22770v1
- Date: Sun, 29 Mar 2026 09:38:41 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-04 02:32:14.167513
- Title: Learning in Blocks: A Multi Agent Debate Assisted Personalized Adaptive Learning Framework for Language Learning
- Title(参考訳): ブロックでの学習: 言語学習のためのパーソナライズされた適応学習フレームワークのためのマルチエージェント議論
- Authors: Nicy Scaria, Silvester John Joseph Kennedy, Deepak Subramani,
- Abstract要約: 本稿では,CEFR対応のルーブリックを用いて,会話能力の実証を行うフレームワークであるLearning in Blocksを紹介する。
ESLの専門家によるCEFR A2会話のスコアリングとレコメンデーションの4つの手法をベンチマークした。
180 CEFR A2の学習者による8週間の研究では、ルーブリックのスコアリングとレコメンデーションをスペースドレビューとマスタリーベースの進捗と組み合わせることで、フィードバック単独よりも優れた学習結果が得られることが示されている。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by-sa/4.0/
- Abstract: Most digital language learning curricula rely on discrete-item quizzes that test recall rather than applied conversational proficiency. When progression is driven by quiz performance, learners can advance despite persistent gaps in using grammar and vocabulary during interaction. Recent work on LLM-based judging suggests a path toward scoring open-ended conversations, but using interaction evidence to drive progression and review requires scoring protocols that are reliable and validated. We introduce Learning in Blocks, a framework that grounds progression in demonstrated conversational competence evaluated using CEFR-aligned rubrics. The framework employs heterogeneous multi-agent debate (HeteroMAD) in two stages: a scoring stage where role-specialized agents independently evaluate Grammar, Vocabulary, and Interactive Communication, engage in debate to address conflicting judgments, and a judge synthesizes consensus scores; and a recommendation stage that identifies specific grammar skills and vocabulary topics for targeted review. Progression requires demonstrating 70% mastery, and spaced review targets identified weaknesses to counter skill decay. We benchmark four scoring and recommendation methods on CEFR A2 conversations annotated by ESL experts. HeteroMAD achieves a superior score agreement with a 0.23 degree of variation and recommendation acceptability of 90.91%. An 8-week study with 180 CEFR A2 learners demonstrates that combining rubric-aligned scoring and recommendation with spaced review and mastery-based progression produces better learning outcomes than feedback alone.
- Abstract(参考訳): ほとんどのデジタル言語学習カリキュラムは、会話の習熟度ではなく、リコールをテストする離散的なクイズに依存している。
クイズ性能によって進行が促進される場合、学習者は相互作用中に文法と語彙を用いることで、持続的なギャップにもかかわらず前進することができる。
LLMに基づく最近の評価研究は、オープンエンドな会話を採点するための道筋を示唆しているが、対話証拠を用いて進行とレビューを促進するためには、信頼性と検証の可能なスコアリングプロトコルが必要である。
本稿では,CEFR対応のルーブリックを用いて,会話能力の実証を行うフレームワークであるLearning in Blocksを紹介する。
このフレームワークは異種多エージェント討論(HeteroMAD)を2段階に分けて採用しており、ロール特化エージェントが文法、語彙、対話コミュニケーションを独立して評価し、対立する判断に対処するための議論を行い、裁判官がコンセンサススコアを合成する、特定の文法スキルと語彙トピックをターゲットレビューのために識別するレコメンデーションステージである。
進歩には70%の熟達の証明が必要です。
ESLの専門家によるCEFR A2会話のスコアリングとレコメンデーションの4つの手法をベンチマークした。
HeteroMADは0.23の変奏率と90.91%のレコメンデーションアクセプタビリティで優れたスコアアグリーメントを達成している。
180 CEFR A2の学習者による8週間の研究では、ルーブリックのスコアリングとレコメンデーションをスペースドレビューとマスタリーベースの進捗と組み合わせることで、フィードバック単独よりも優れた学習結果が得られることが示されている。
関連論文リスト
- Interactive ASR: Towards Human-Like Interaction and Semantic Coherence Evaluation for Agentic Speech Recognition [52.63676763985825]
トークンレベルの精度を超えた認識品質を評価するための意味認識評価指標を提案する。
我々は,人間のようなマルチターンインタラクションをシミュレートするエージェント・フレームワークを設計し,認識出力の反復的改善を可能にする。
対話型およびエージェント型ASRにおける今後の研究を促進するためのコードをリリースする。
論文 参考訳(メタデータ) (2026-04-10T09:02:42Z) - Scaling Equitable Reflection Assessment in Education via Large Language Models and Role-Based Feedback Agents [2.825140278227664]
形式的フィードバックは、学生学習の最も効果的な要因の1つである。
大規模または低リソースのコースでは、インストラクターは学生のリフレクションのレビューや応答に必要な時間、スタッフ、帯域幅を欠いていることが多い。
本稿では,5つの協調型ロールベースLLMエージェントを用いて学習者の反射をスコアリングする理論基底システムを提案する。
論文 参考訳(メタデータ) (2025-11-14T09:46:21Z) - Disco-Bench: A Discourse-Aware Evaluation Benchmark for Language
Modelling [70.23876429382969]
本研究では,多種多様なNLPタスクに対して,文内談話特性を評価できるベンチマークを提案する。
ディスコ・ベンチは文学領域における9つの文書レベルのテストセットから構成されており、豊富な談話現象を含んでいる。
また,言語分析のために,対象モデルが談話知識を学習するかどうかを検証できる診断テストスイートを設計する。
論文 参考訳(メタデータ) (2023-07-16T15:18:25Z) - Self-supervised Dialogue Learning for Spoken Conversational Question
Answering [29.545937716796082]
音声対話質問応答(SCQA)では、複数の会話を含む固定された音声文書を検索して分析することにより、対応する質問に対する回答を生成する。
本研究では,不整合判定,挿入検出,質問予測などの自己教師付き学習手法を導入し,コア参照の解決と対話のコヒーレンスを明確に把握する。
提案手法は,従来の事前学習言語モデルと比較して,より一貫性があり,意味があり,適切な応答を提供する。
論文 参考訳(メタデータ) (2021-06-04T00:09:38Z) - Towards Quantifiable Dialogue Coherence Evaluation [126.55560816209756]
量的対話コヒーレンス評価(QuantiDCE)は,量的対話コヒーレンス尺度の学習を目的とした新しいフレームワークである。
QuantiDCEには、Multi-Level Ranking (MLR) pre-training (KD) fine-tuning (Multi-Level Ranking)とKD (KD) fine-tuning (KD) という2つの訓練段階が含まれている。
実験結果から,QuantiDCEによりトレーニングされたモデルは,他の最先端の指標に比べて,人間の判断と強い相関関係を示すことが示された。
論文 参考訳(メタデータ) (2021-06-01T14:11:17Z) - Structural Pre-training for Dialogue Comprehension [51.215629336320305]
本稿では,SPIDER, Structure Pre-trained DialoguE Readerについて述べる。
対話のような特徴をシミュレートするために,元のLM目的に加えて,2つの訓練目標を提案する。
広く使われている対話ベンチマークの実験結果から,新たに導入した自己教師型タスクの有効性が検証された。
論文 参考訳(メタデータ) (2021-05-23T15:16:54Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。