<?xml version="1.0" encoding="UTF-8"?>        <rss version="2.0"
             xmlns:atom="http://www.w3.org/2005/Atom"
             xmlns:dc="http://purl.org/dc/elements/1.1/"
             xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
             xmlns:admin="http://webns.net/mvcb/"
             xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#"
             xmlns:content="http://purl.org/rss/1.0/modules/content/">
        <channel>
            <title>
									📊 Metrics &amp; Evaluation - CONTEXT EDUCATION Forum				            </title>
            <link>https://contextenglish.education/community/metrics-evaluation/</link>
            <description>CONTEXT EDUCATION Discussion Board</description>
            <language>en-GB</language>
            <lastBuildDate>Mon, 28 Sep 2026 09:09:05 +0000</lastBuildDate>
            <generator>wpForo</generator>
            <ttl>60</ttl>
							                    <item>
                        <title>What’s harder to evaluate — reasoning quality or interaction quality?</title>
                        <link>https://contextenglish.education/community/metrics-evaluation/whats-harder-to-evaluate-reasoning-quality-or-interaction-quality/</link>
                        <pubDate>Thu, 24 Jul 2025 07:59:47 +0000</pubDate>
                        <description><![CDATA[What’s harder to evaluate — reasoning quality or interaction quality?]]></description>
                        <content:encoded><![CDATA[<p>What’s harder to evaluate — reasoning quality or interaction quality?</p>]]></content:encoded>
						                            <category domain="https://contextenglish.education/community/metrics-evaluation/">📊 Metrics &amp; Evaluation</category>                        <dc:creator>M. R. Legend</dc:creator>
                        <guid isPermaLink="true">https://contextenglish.education/community/metrics-evaluation/whats-harder-to-evaluate-reasoning-quality-or-interaction-quality/</guid>
                    </item>
				                    <item>
                        <title>How do you measure success in your agent: accuracy, user satisfaction, or task completion?</title>
                        <link>https://contextenglish.education/community/metrics-evaluation/how-do-you-measure-success-in-your-agent-accuracy-user-satisfaction-or-task-completion/</link>
                        <pubDate>Thu, 24 Jul 2025 07:57:45 +0000</pubDate>
                        <description><![CDATA[How do you measure success in your agent: accuracy, user satisfaction, or task completion?]]></description>
                        <content:encoded><![CDATA[<p>How do you measure success in your agent: accuracy, user satisfaction, or task completion?</p>]]></content:encoded>
						                            <category domain="https://contextenglish.education/community/metrics-evaluation/">📊 Metrics &amp; Evaluation</category>                        <dc:creator>M. R. Legend</dc:creator>
                        <guid isPermaLink="true">https://contextenglish.education/community/metrics-evaluation/how-do-you-measure-success-in-your-agent-accuracy-user-satisfaction-or-task-completion/</guid>
                    </item>
				                    <item>
                        <title>Should AI agents be tested more like software, humans, or both?</title>
                        <link>https://contextenglish.education/community/metrics-evaluation/should-ai-agents-be-tested-more-like-software-humans-or-both/</link>
                        <pubDate>Thu, 24 Jul 2025 07:56:46 +0000</pubDate>
                        <description><![CDATA[Should AI agents be tested more like software, humans, or both?]]></description>
                        <content:encoded><![CDATA[<p>Should AI agents be tested more like software, humans, or both?</p>]]></content:encoded>
						                            <category domain="https://contextenglish.education/community/metrics-evaluation/">📊 Metrics &amp; Evaluation</category>                        <dc:creator>M. R. Legend</dc:creator>
                        <guid isPermaLink="true">https://contextenglish.education/community/metrics-evaluation/should-ai-agents-be-tested-more-like-software-humans-or-both/</guid>
                    </item>
				                    <item>
                        <title>What’s your process for debugging behavior in a dynamic, evolving agent?</title>
                        <link>https://contextenglish.education/community/metrics-evaluation/whats-your-process-for-debugging-behavior-in-a-dynamic-evolving-agent/</link>
                        <pubDate>Thu, 24 Jul 2025 07:55:50 +0000</pubDate>
                        <description><![CDATA[What’s your process for debugging behavior in a dynamic, evolving agent?]]></description>
                        <content:encoded><![CDATA[<p>What’s your process for debugging behavior in a dynamic, evolving agent?</p>]]></content:encoded>
						                            <category domain="https://contextenglish.education/community/metrics-evaluation/">📊 Metrics &amp; Evaluation</category>                        <dc:creator>M. R. Legend</dc:creator>
                        <guid isPermaLink="true">https://contextenglish.education/community/metrics-evaluation/whats-your-process-for-debugging-behavior-in-a-dynamic-evolving-agent/</guid>
                    </item>
							        </channel>
        </rss>
		