<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>Mathematikern &#8211; MEIDCRAFT</title>
	<atom:link href="https://www.meidcraft.de/tag/mathematikern/feed/" rel="self" type="application/rss+xml" />
	<link>https://www.meidcraft.de</link>
	<description></description>
	<lastBuildDate>Sun, 17 May 2026 08:53:49 +0000</lastBuildDate>
	<language>de</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.0.4</generator>

<image>
	<url>https://www.meidcraft.de/wp-content/uploads/2020/08/cropped-logo-32x32.jpg</url>
	<title>Mathematikern &#8211; MEIDCRAFT</title>
	<link>https://www.meidcraft.de</link>
	<width>32</width>
	<height>32</height>
</image> 
	<item>
		<title>Mathe-Benchmark zeigt: KI-Modelle liefern selbstbewusst Antworten auf unlösbare Aufgaben</title>
		<link>https://www.meidcraft.de/mathe-benchmark-zeigt-ki-modelle-liefern-selbstbewusst-antworten-auf-unloesbare-aufgaben/</link>
		
		<dc:creator><![CDATA[Meidcraft]]></dc:creator>
		<pubDate>Sun, 17 May 2026 08:53:49 +0000</pubDate>
				<category><![CDATA[KI News]]></category>
		<category><![CDATA[Aufgaben]]></category>
		<category><![CDATA[Konsortium]]></category>
		<category><![CDATA[Mathematikern]]></category>
		<category><![CDATA[Modelle]]></category>
		<category><![CDATA[Prozent]]></category>
		<guid isPermaLink="false">https://www.meidcraft.de/mathe-benchmark-zeigt-ki-modelle-liefern-selbstbewusst-antworten-auf-unloesbare-aufgaben/</guid>

					<description><![CDATA[Ein Konsortium aus Mathematikern hat mit SOOHAK einen neuen KI-Benchmark aus 439 handgeschriebenen Aufgaben vorgelegt, darunter 99 absichtlich unlösbare Probleme. Googles Gemini 3 Pro führt mit 30 Prozent auf dem Forschungslevel. Doch beim Erkennen fehlerhafter Aufgaben scheitern alle Modelle unter 50 Prozent. Mehr Rechenleistung verbessert das Lösen, macht die Modelle aber nicht zurückhaltender beim Eingestehen, [&#8230;]]]></description>
		
		
		
			</item>
	</channel>
</rss>
