論文の概要: CARD: Controlled Agentic Reddit Discussions for Credit Card Simulation
- arxiv url: http://arxiv.org/abs/2608.09790v2
- Date: Tue, 11 Aug 2026 11:49:18 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-12 16:08:30.749389
- Title: CARD: Controlled Agentic Reddit Discussions for Credit Card Simulation
- Title(参考訳): CARD: クレジットカードシミュレーションのためのエージェントRedditの議論を制御
- Abstract要約: リアルなクレジットカードディスカッションスレッドを生成するためのフレームワークであるCARDを紹介する。
CARDは、返信構造、コメント機能、スタンス、トーン、会話のバリエーションに関する非バーバティムガイダンスを使用する。
我々は,レキシカル,セマンティック,ビヘイビア,構造的メトリクスを用いて,リアルクレジットカードの議論においてCARDを評価する。
- 参考スコア(独自算出の注目度): 20.718960922741427
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Online credit card discussions provide a natural setting for studying how consumers communicate about financial products. Simulating these discussions requires more than just generating individual comments, the generated threads should also match how real users express themselves and interact with others. We introduce CARD, a framework for generating realistic credit card discussion threads. Given a credit card post and its matched real thread, CARD uses non-verbatim guidance on reply structure, comment function, stance, tone, and conversational variation. A planner organizes these controls, a writer generates the discussion, and a calibration loop updates comments' populations that contribute to differences between the generated and real thread distributions. We evaluate CARD on real Reddit credit card discussions using lexical, semantic, behavioral, and structural metrics. CARD matches the distributions of real credit card discussions better than simulation baselines across multiple LLMs and also demonstrates smaller effect sizes and distribution distances across metrics. These results show that structured planning and targeted revision can generate the realism of simulated credit card discussions.
- Abstract(参考訳): オンラインクレジットカードに関する議論は、消費者が金融商品についてどのようにコミュニケーションするかを研究するための自然な環境を提供する。
これらの議論をシミュレートするには、個々のコメントを生成するだけでなく、生成されたスレッドは、実際のユーザが自分自身を表現し、他の人と対話する方法と一致する必要がある。
リアルなクレジットカードディスカッションスレッドを生成するためのフレームワークであるCARDを紹介する。
クレジットカードの投稿とそのマッチした実スレッドが与えられた場合、CARDは返信構造、コメント機能、スタンス、トーン、会話のバリエーションに関する非バーベティムガイダンスを使用する。
プランナーがこれらのコントロールを整理し、ライターが議論を生成し、キャリブレーションループがコメントの人口を更新し、生成されたスレッドと実際のスレッドの分布の違いに寄与する。
我々は,レキシカル,セマンティック,ビヘイビア,構造的メトリクスを用いて,実際のRedditクレジットカードに関するCARDを評価した。
CARDは、複数のLCMにわたるシミュレーションベースラインよりも、実際のクレジットカードの議論の分布とよく一致し、メトリクス間の効果サイズと分布距離を小さくする。
これらの結果から,構造化計画とターゲットリビジョンは,シミュレーションされたクレジットカードの議論の現実性を生み出すことが示唆された。
関連論文リスト
- Credit Cards, Confusion, Computation, and Consequences: What Can We Uncover About Language Model Reasoning? [5.08084484463297]
我々は、実際のクレジットカード契約に基づく数値推論のための最初の金融リテラシーベンチマークであるCreditCardQAを紹介する。
このデータセットには1,800の質問が含まれている。
我々は、Chain-of-Thought (CoT) と Program-of-Thought (PoT) のプロンプトにより、幅広い言語と推論モデルを評価する。
論文 参考訳(メタデータ) (2026-07-29T14:20:13Z) - Revising Context, Shifting Simulated Stance: Auditing LLM-Based Stance Simulation in Online Discussions [62.99524765341952]
ソーシャルメディアのユーザーをシミュレートするために、大規模な言語モデルがますます使われている。
LLMに基づくスタンスシミュレーションを監査するための枠組みとして,反実的文脈修正について検討する。
その結果、テキストのみの戦略とマルチモーダル戦略の両方において、効果的かつ堅牢なスタンス遷移が明らかとなった。
論文 参考訳(メタデータ) (2026-06-04T17:41:54Z) - MiroBench: Benchmarking Realism in Agentic Simulation of Real-world Discussions [20.708736547926286]
実際のRedditスレッド4,292から構築されたRedditディスカッションシミュレーションのベンチマークであるMiroBenchを紹介した。
ミロベンチは統計テストを用いて、反復と意味的均一性、物語の内容、毒性と攻撃性、構造的複雑さの4つの主要な側面で生成された議論と実際の議論を比較している。
論文 参考訳(メタデータ) (2026-05-10T04:03:47Z) - A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations [112.81207927088117]
PersonaConvBenchは、大規模言語モデル(LLM)とのマルチターン会話におけるパーソナライズされた推論と生成を評価するためのベンチマークである。
我々は,複数の商用およびオープンソース LLM を統一的なプロンプト設定でベンチマークし,パーソナライズされた履歴を組み込むことで大幅な性能向上が得られることを観察した。
論文 参考訳(メタデータ) (2025-05-20T09:13:22Z) - Automating Credit Card Limit Adjustments Using Machine Learning [0.0]
ベネズエラの銀行は歴史的に、委員会を通じて手動でクレジットカード制限の調整を行った。
経済改善は今後数カ月でベネズエラのクレジットカード保有者を増やすと予想されている。
クレジットカードのリミットを配る作業を自動化するために,コスト依存型学習を用いた機械学習モデルを提案する。
論文 参考訳(メタデータ) (2025-01-14T17:22:57Z) - Hold On! Is My Feedback Useful? Evaluating the Usefulness of Code Review Comments [0.0]
本稿では,コードレビューコメント(CRコメント)の有用性について,テキスト機能ベースおよび機能レスアプローチを用いて検討する。
我々のモデルは最先端の性能を達成することでベースラインを上回ります。
本分析では,ドメイン,プロジェクト,データセット,モデル,およびCRコメントの有用性を予測する特徴の類似点と相違点について述べる。
論文 参考訳(メタデータ) (2025-01-12T07:22:13Z) - PunchBench: Benchmarking MLLMs in Multimodal Punchline Comprehension [69.73137587705646]
マルチモーダルなtextbfPunchline comprehension textbfPunchBenchmark を導入する。
評価精度を高めるために、原文のキャプションを変更して、同義語と無称のキャプションを生成する。
そこで我々は,パンチライン理解における最先端のMLLMと人間の間に大きなギャップがあることを明らかにする。
論文 参考訳(メタデータ) (2024-12-16T15:52:59Z) - ConMe: Rethinking Evaluation of Compositional Reasoning for Modern VLMs [95.15814662348245]
構成推論(CR)は属性、関係、単語の順序の重要さを把握する。
近年の視覚言語モデル (VLM) は、そのような推論タスクにおいて顕著な習熟性を示している。
論文 参考訳(メタデータ) (2024-06-12T12:54:27Z) - Disentangling Online Chats with DAG-Structured LSTMs [55.33014148383343]
DAG-LSTMはTree-LSTMの一般化であり、間接的な非循環的依存関係を処理できる。
提案する新モデルでは,リプライ・トゥ・リレーション(Repend-to-Relation)を回復する作業において,アート・ステータスの状態を達成できることが示される。
論文 参考訳(メタデータ) (2021-06-16T18:00:00Z) - ConvoSumm: Conversation Summarization Benchmark and Improved Abstractive
Summarization with Argument Mining [61.82562838486632]
我々は、さまざまなオンライン会話形式のニュースコメント、ディスカッションフォーラム、コミュニティ質問応答フォーラム、電子メールスレッドに関する4つの新しいデータセットをクラウドソースする。
我々は、データセットの最先端モデルをベンチマークし、データに関連する特徴を分析します。
論文 参考訳(メタデータ) (2021-06-01T22:17:13Z) - Conversational Structure Aware and Context Sensitive Topic Model for
Online Discussions [0.32228025627337864]
本稿では,コメントに対する応答数を定量化し,単語の発生頻度を拡大する「人気度」尺度を提案する。
我々は,人気度と推移度に基づいて対話型構造認識トピックモデル(CSATM)を構築し,トピックとコメントへの課題を推測する。
論文 参考訳(メタデータ) (2020-02-06T16:57:27Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。