<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>KIBenchmark &#8211; MEIDCRAFT</title>
	<atom:link href="https://www.meidcraft.de/tag/kibenchmark/feed/" rel="self" type="application/rss+xml" />
	<link>https://www.meidcraft.de</link>
	<description></description>
	<lastBuildDate>Sun, 05 Apr 2026 08:53:31 +0000</lastBuildDate>
	<language>de</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.0.4</generator>

<image>
	<url>https://www.meidcraft.de/wp-content/uploads/2020/08/cropped-logo-32x32.jpg</url>
	<title>KIBenchmark &#8211; MEIDCRAFT</title>
	<link>https://www.meidcraft.de</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>Google-Studie zeigt: KI-Benchmarks ignorieren menschliche Meinungsvielfalt</title>
		<link>https://www.meidcraft.de/google-studie-zeigt-ki-benchmarks-ignorieren-menschliche-meinungsvielfalt/</link>
		
		<dc:creator><![CDATA[Meidcraft]]></dc:creator>
		<pubDate>Sun, 05 Apr 2026 08:53:31 +0000</pubDate>
				<category><![CDATA[KI News]]></category>
		<category><![CDATA[Bewerter]]></category>
		<category><![CDATA[KIBenchmark]]></category>
		<category><![CDATA[Studie]]></category>
		<category><![CDATA[Testbeispiel]]></category>
		<category><![CDATA[Wie]]></category>
		<guid isPermaLink="false">https://www.meidcraft.de/google-studie-zeigt-ki-benchmarks-ignorieren-menschliche-meinungsvielfalt/</guid>

					<description><![CDATA[Wie viele Bewerter benötigt ein guter KI-Benchmark? Eine neue Studie zeigt, dass drei bis fünf Bewerter pro Testbeispiel häufig nicht ausreichen. Ebenso entscheidend ist die richtige Verteilung des Budgets. Der Artikel Google-Studie zeigt: KI-Benchmarks ignorieren menschliche Meinungsvielfalt erschien zuerst auf The Decoder.]]></description>
		
		
		
			</item>
		<item>
		<title>Neues KI-Ranking: GPT-5.2 führt vor Claude Opus 4.5 und Gemini 3 Pro</title>
		<link>https://www.meidcraft.de/neues-ki-ranking-gpt-5-2-fuehrt-vor-claude-opus-4-5-und-gemini-3-pro/</link>
		
		<dc:creator><![CDATA[Meidcraft]]></dc:creator>
		<pubDate>Tue, 06 Jan 2026 19:53:43 +0000</pubDate>
				<category><![CDATA[KI News]]></category>
		<category><![CDATA[AgentenFähigkeiten]]></category>
		<category><![CDATA[Claude]]></category>
		<category><![CDATA[GPT]]></category>
		<category><![CDATA[KIBenchmark]]></category>
		<category><![CDATA[Opus]]></category>
		<guid isPermaLink="false">https://www.meidcraft.de/neues-ki-ranking-gpt-5-2-fuehrt-vor-claude-opus-4-5-und-gemini-3-pro/</guid>

					<description><![CDATA[GPT-5.2 schlägt Claude Opus 4.5 knapp: neuer KI-Benchmark misst jetzt auch Agenten-Fähigkeiten Der Artikel Neues KI-Ranking: GPT-5.2 führt vor Claude Opus 4.5 und Gemini 3 Pro erschien zuerst auf The Decoder.]]></description>
		
		
		
			</item>
	</channel>
</rss>
