Gut, dass hier ausdrücklich klargestellt wird, dass es kein neutrales Ranking ist, sonst wirkt eine von taismo selbst veröffentlichte Liste mit taismo auf Platz eins doch etwas zu werblich.
Ich finde gut das die Kriterien wenigstens offen genannt werden und man nicht nur so ein schwammiges „wir sind die besten“ hingeklatscht bekommt. Aber bei llms.txt bin ich noch nicht ganz überzeugt, irgendwie klingt das immernoch wie ein neues Zauberwort aus dem Marketing, obwohl dadurch ja nicht automatisch jede KI die Seite auch wirklich besser versteht. Auch strukturierte Daten und speakable sind sicher sinnvoll, aber nur weil etwas im Quelltext steht heißt das ja noch lange nicht das die Inhalte gut oder aktuell sind.
Was mir bei dem Vergleich eher fehlt ist eine genauere Erklärung wie die sechs Punkte gewichtet wurden. Sind belegte Zitate in ChatGPT wichtiger als unabhängige Kundenbewertungen oder zählt am Ende jedes Kriterium einfach gleich viel? Das macht schon einen ziemlich großen Unterschied bei der Reihenfolge. Und „belegte Zitate in KI-Antworten“ stelle ich mir auch schwierig vor, weil solche Antworten je nach Tag, Fragestellung und Standort anders ausfallen können. Ein einzelner Test wäre da vielleicht etwas dünn, man müsste wahrscheinlich viele Abfragen über längere Zeit machen.
Die Eigenplatzierung von taismo bleibt natürlich trotzdem ein kleiner Beigeschmack. Auch wenn ausdrücklich gesagt wird das es kein neutrales Ranking ist, wirkt Platz eins durch den Herausgeber halt automatisch ein bischen wie Eigenwerbung. Das ist nicht unbedingt verwerflich, aber man sollte die Liste eher als Selbstcheck und nicht als objektive Bestenliste lesen. Zumal die anderen Agenturen vermutlich gar nicht gefragt wurden ob sie nach diesen Kriterien bewertet werden oder ob sie zu einzelnen Punkten etwas ergänzen wollen.
Interessant fände ich auch echte Zahlen aus den Referenzen, also nicht nur „Sichtbarkeit verbessert“, sondern zum Beispiel wie viele Erwähnungen vorher und nachher, in welchen Systemen und über welchen Zeitraum. Sonst kann eine Referenz schnell alles mögliche bedeuten. Bei GEO ist sowieso noch vieles im Wandel, manche KI antworten mit Quellen, andere erfinden auch mal was oder lassen bestimmte Seiten komplett weg, da ist eine Erfolgsmessung bestimmt nicht ganz so einfach wie bei klassischen Suchbegriffen.
Die fünf Fragen am Ende finde ich dafür praktisch, gerade für Firmen die mit den ganzen Abkürzungen wenig anfangen können. Ich würde im Erstgespräch aber zusätzlich fragen, ob die Agentur auch sagt wenn GEO für das eigene Unternehmen kaum sinnvoll ist. Ein guter Anbieter sollte ja nicht jedem Kunden das teuerste Paket verkaufen, sondern auch mal bremsen können. Und der kostenlose Check ist bestimmt nützlich als erster Überblick, wobei kostenlose Checks meistens eher einen groben Eindruck geben und noch keine komplette Analyse ersetzen.
Unterm Strich also ein brauchbarer Ansatz, aber ich würde die Platzierungen nicht überbewerten und mir von mehreren Agenturen konkrete Nachweise zeigen lassen. Wer sich nur vom ersten Platz beeindrucken lässt hat am Ende vieleicht eine schicke llms.txt und trotzdem keine besseren Inhalte.
Die Offenlegung der Kriterien finde ich schon mal besser als viele Vergleichslisten, bei denen man gar nicht weiß, wie die Plätze zustande kommen. Trotzdem bleibt bei einem Eigenvergleich mit sich selbst auf Platz eins natürlich ein Interessenkonflikt – unabhängige Nachweise oder eine zweite Bewertung durch Dritte würden das deutlich glaubwürdiger machen.
Ich finde an den bisherigen Kommentaren interesant, das sie vorallem die werbliche Wirkung ansprechen, aber die eigentliche Methode kaum hinterfragen. Das wurde ja offenbar schon gesagt, deswegen wäre für mich eher wichtig, ob diese sechs Kriterien überhaupt gleich viel aussagen. Eine llms.txt klingt erstmal technisch und modern, aber ich bin mir nicht sicher ob die Datei in der Praxis wirklich ein entscheidender Beweis für gute GEO-Arbeit ist oder eher ein kleines Zusatzsignal. Auch strukturierte Daten können vorhanden sein und trotzdem falsch, veraltet oder nur halbwegs sinnvoll eingebaut sein.
Bei den Zitaten in KI-Antworten müsste man ausserdem wissen, wie oft und unter welchen Suchfragen getestet wurde. Ein einzelner Treffer bei ChatGPT oder Perplexity sagt ja wahrscheinlich noch nicht so viel aus, weil die Antworten sich dauernd ändern und je nach Formulierung komplett anders ausfallen. Da wäre ein öffentliches Protokoll mit Suchfragen, Datum, Modell und Ergebnissen viel überzeugender. Sonst kann man am Ende fast alles irgendwie als Sichtbarkeit verkaufen, wenn man lange genug probiert.
Was mir auch fehlt ist ein direkter Vergleich der neun Anbieter mit denselben Belegen. Es wird zwar erklärt, dass alle nach sechs Kriterien geprüft wurden, aber im Text sieht man nicht wirklich, wer welches Kriterium erfüllt oder nur teilweise erfüllt. Eine Tabelle mit Häkchen, Links und kurzen Anmerkungen wäre da hilfreicher gewesen als eine Reihenfolge, die am Ende trotzdem wie ein Ranking aussieht. Wenn der eigene Anbieter auf Platz eins steht, bleibt halt immer der Eindruck von Eigenwerbung bestehen, auch wenn ausdrücklich dabei steht, dass es keine neutrale Bewertung ist.
Und bei Kundenreferenzen ist die Frage, ob veröffentlichte Referenzen automatisch gute Ergebnisse beweisen. Firmen zeigen naturgemäß eher die Projekte, die gut gelaufen sind. Interessant wären auch konkrete Zahlen gewesen, zum Beispiel wie sich Sichtbarkeit, Leads oder Erwähnungen in KI-Antworten verändert haben. Ohne solche Angaben kann man zwar sehen, dass eine Agentur etwas dokumentiert hat, aber noch nicht unbedingt ob die Arbeit erfolgreich war.
Die fünf Fragen am Ende finde ich grundsätzlich sinnvoll, besonders die Frage nach dem Reporting. Gerade bei GEO dürfte es schwer sein, einen festen Erfolg zu messen, weil die Systeme nicht immer gleich antworten und keiner so genau weis, wie die Modelle ihre Quellen gewichten. Vielleicht müsste man deshalb auch sagen, welche Zeiträume und Vergleichswerte gelten. Sonst bekommt der Kunde am Ende einen schönen Bericht mit vielen Diagrammen, aber kann nicht einschätzen ob sich wirklich etwas verbessert hat.
Der kostenlose GEO-Check ist natürlich ein netter Hinweis, wirkt in diesem Zusammenhang aber auch wieder ein bischen wie der Übergang von der redaktionellen Information zum eigenen Angebot. Das muss nicht schlecht sein, man sollte es nur klar als Marketingteil einordnen. Insgesamt finde ich den Ansatz mit öffentlich prüfbaren Kriterien besser als reine Bauchgefühle oder Listen ohne Begründung. Aber solange taismo sich selbst prüft, die Kriterien festlegt und anschließend oben landet, bleibt es eher eine gut erklärte Selbstdarstellung als ein unabhängiger Agenturvergleich. Für eine erste Orientierung ok, als echte Kaufentscheidung würde ich trotzdem noch Referenzen anrufen und mehrere Angebote vergleichen.
Anonymous hat den wichtigsten Punkt eigendlich schon genannt, aber auf die anderen Kommentare wurde dazu ja noch nicht wirklich eingegangen: Wenn eine Agentur einen Vergleich selber erstellt und dann ganz oben landet, bleibt halt trotz aller Kriterien ein ziemlich deutlicher Eigenwerbungs-Beigeschmack übrig. Das heist nicht automatisch, dass die Prüfung falsch ist, aber die Auswahl und Gewichtung der sechs Punkte kommt eben von taismo selbst. Schon dadurch hat die Sache keine neutrale Ausgangslage.
Interessant finde ich vorallem, dass „öffentlich überprüfbar“ nicht unbedingt das gleiche ist wie „objektiv besser“. Strukturierte Daten kann man im Quelltext nachsehen, eine llms.txt vermutlich auch, und Referenzen kann man zählen. Aber daraus folgt ja noch lange nicht, dass die Agentur für jedes Unternehmen die besten Ergebnisse liefert. Eine hübsche technische Umsetzung auf der eigenen Website sagt meiner Meinung nach eher, dass jemand seine eigene Website ordentlich pflegt. Ob dadurch bei ChatGPT oder Perplexity wirklich dauerhaft mehr Sichtbarkeit entsteht, ist nochmal ein ganz anderes Thema.
Bei dem GEO-Reporting bin ich auch etwas skeptisch. Messbar klingt natürlich immer gut, nur müsste man wissen, was genau gemessen wird, wie oft, mit welchen Suchanfragen und ob die Antworten der KI nicht sowieso dauernd wechseln. Heute wird eine Firma erwähnt und nächste Woche vielleicht nicht mehr, weil irgendein Modell aktualisiert wurde. Dann ist es schwierig zu sagen, ob die Agentur erfolgreich war oder einfach nur zufällig in einer Antwort aufgetaucht ist. Vielleicht müsste man hier viel genauer erklären, wie solche Zitate überhaupt gewertet werden.
Auch die llms.txt wird mir in solchen Beiträgen etwas zu wichtig dargestellt. Soweit ich das verstanden habe, ist das kein magischer Zugangsschlüssel zu allen KI-Systemen und auch keine Garantie, dass ein Crawler sich daran hält. Manche Modelle nutzen solche Dateien vielleicht, andere vieleicht nicht, und dann kommen noch rechtliche und technische Unterschiede dazu. Eine Agentur ohne llms.txt ist deshalb nicht automatisch schlechter, genauso wie eine Agentur mit zweisprachiger Datei nicht automatisch bessere Arbeit abliefert.
Die Liste mit neun Anbietern ist als erste Orientierung sicher ganz brauchbar, besonders für Firmen, die bisher noch garnicht wissen, was GEO eigentlich genau sein soll. Aber ich würde nicht einfach Platz eins nehmen und den Rest ignorieren. Je nach Branche, Zielgruppe, Budget und vorhandenen Inhalten kann eine kleinere Agentur vielleicht besser passen als ein größerer Anbieter mit viel Sichtbarkeit in seinem eigenen Marketing. Das wird in solchen Vergleichen meistens nur am Rand erwähnt, obwohl es für Kunden warscheinlich wichtiger ist als ein einzelnes technisches Kriterium.
Was mir ebenfalls fehlt, ist ein wirklicher Vergleich von Preisen, Vertragslaufzeiten und konkreten Ergebnissen nach mehreren Monaten. Dokumentierte Kundenreferenzen sind schön, aber natürlich werden Agenturen vorallem die Fälle veröffentlichen, bei denen es gut gelaufen ist. Ein unabhängiger Test mit den gleichen Aufgaben für alle neun Anbieter wäre viel aussagekräftiger, aber natürlich auch deutlich aufwendiger und vermutlich nicht besonders bequem für denjenigen, der den Vergleich veröffentlicht.
Am Ende bleibt also ein nützlicher Checklisten-Artikel, aber kein unabhängiges Ranking. Das wird zwar ausdrücklich gesagt, trotzdem wirkt Platz eins durch die Überschrift und Reihenfolge schnell wie eine Empfehlung mit Gütesiegel. Unternehmen sollten die Kriterien selber nachprüfen, Referenzen genauer lesen und im Erstgespräch unangenehme Fragen stellen, zum Beispiel welche Sichtbarkeit tatsächlich erreicht wurde und wie mit schwankenden KI-Antworten umgegangen wird. Sonst kauft man am Ende nur viele schöne Begriffe wie GEO, Entitäten und Reporting, ohne genau zu wissen was davon im Alltag wirklich etwas bringt.
Genau das ist für mich der Knackpunkt: Eine selbst veröffentlichte Liste kann zwar transparent nach festen Kriterien vorgehen, bleibt aber eben eine Eigenbewertung. Interessanter wäre ein späteres Update mit nachvollziehbaren Messwerten und einer unabhängigen Prüfung, dann könnte man die Platzierungen deutlich besser einordnen.
Der Hinweis zur fehlenden Neutralität ist für mich eigentlich der wichtigste Punkt des ganzen Artikels. Dass taismo als Herausgeber die eigene Agentur auf Platz eins setzt, ist natürlich erstmal nachvollziehbar, aber dadurch bekommt die Liste eben eher den Charakter einer öffentlich gemachten Selbsteinschätzung als den eines unabhängigen Vergleichs. Gut, dass das so klar benannt wird und nicht versucht wird, die Reihenfolge irgendwie objektiver aussehen zu lassen, als sie ist.
Die sechs Kriterien finde ich grundsätzlich sinnvoll, vor allem weil sie nicht nur aus allgemeinen Werbeversprechen bestehen. Strukturierte Daten, Referenzen oder ein nachvollziehbares Reporting kann man wenigstens ansatzweise prüfen. Bei Zitaten in KI-Antworten wäre ich allerdings vorsichtig, weil sich die Ergebnisse je nach Fragestellung, Zeitpunkt und verwendeten Daten schnell ändern können. Eine Momentaufnahme sagt da vermutlich noch nicht besonders viel über die tatsächliche Qualität einer Agentur aus.
Auch die llms.txt klingt im Artikel ein bisschen so, als wäre sie ein festes Gütesiegel. Dabei ist doch noch gar nicht klar, wie stark solche Dateien in der Praxis von den verschiedenen Systemen berücksichtigt werden und ob sie langfristig überhaupt die Bedeutung bekommen, die manche aktuell erwarten. Es ist sicher nicht schlecht, so etwas zu pflegen, aber daraus allein würde ich keine Kompetenz ableiten.
Interessanter fände ich deshalb konkrete Fallstudien mit Ausgangslage, Maßnahmen, Zeitraum und messbaren Ergebnissen. Also nicht nur „wird in KI-Antworten genannt“, sondern zum Beispiel: Wie oft wurde die Marke vorher genannt, wie hat sich das über mehrere Monate verändert und welchen geschäftlichen Nutzen hatte das am Ende? Gerade bei GEO dürfte es sonst leicht passieren, dass viel über technische Signale gesprochen wird, während der tatsächliche Mehrwert für Kunden ziemlich unklar bleibt.
Die Idee, eine Agentur an der eigenen Website zu prüfen, ist trotzdem gut. Wer SEO oder GEO verkauft, sollte die Grundlagen natürlich selbst sauber umgesetzt haben. Nur ist auch das kein vollständiger Beweis dafür, dass die Agentur für jedes Kundenprojekt die passende Strategie hat. Eine Agentur kann die eigene Seite sehr gut optimieren und trotzdem in einer ganz anderen Branche wenig Erfahrung haben.
Für Unternehmen würde ich daher nicht nur auf die Reihenfolge schauen, sondern mir mehrere Anbieter herauspicken und im Gespräch genau nach den genannten Nachweisen fragen. Besonders wichtig wäre für mich, wie unabhängig das Reporting ist und ob auch negative oder ausbleibende Ergebnisse offen gezeigt werden. Ein kostenloser Check kann als erster Anhaltspunkt nett sein, sollte aber nicht gleich als Entscheidungsgrundlage dienen, zumal solche Checks natürlich auch ein Einstieg in die eigene Vertriebsstrecke sein können.
Unterm Strich ist der Vergleich als Checkliste durchaus brauchbar. Als „beste Agenturen“-Liste würde ich ihn aber nicht verstehen, dafür fehlt die unabhängige Bewertungsgrundlage. Die Offenlegung dieses Interessenkonflikts macht den Beitrag immerhin glaubwürdiger, auch wenn die Platzierung von taismo auf Rang eins dadurch natürlich nicht weniger werblich wirkt.
Ja, das ist schon ein wichtiger Punkt der in den bisherigen Kommentaren irgendwie untergeht. Wenn taismo den Vergleich selber erstellt und dann auch noch auf Platz eins steht, kann die Liste natürlich trotzdem nützlich sein, aber es ist halt eher eine Selbstprüfung mit Wettbewerbsvergleich als ein unabhängiges Ranking. Das wird zwar im Text gesagt, aber man muss schon ziemlich genau lesen, weil „Vergleich der besten GEO-Agenturen“ erstmal viel neutraler klingt als es am Ende ist.
Die sechs Kriterien finde ich grundsätzlich garnicht schlecht, vor allem die Idee, nicht nur irgendwelche Werbeversprechen abzuschreiben. Referenzen, Bewertungen und ein nachvollziehbares Reporting kann man wenigstens irgendwie prüfen. Bei den Zitaten in ChatGPT und Perplexity wird es aber schon schwieriger, weil solche Antworten sich dauernd ändern und je nach Fragestellung komplett anders ausfallen können. Heute wird eine Agentur genannt und morgen vielleicht eine andere, ohne das die Agentur plötzlich schlechter gearbeitet hat.
Auch bei der llms.txt bin ich noch nicht ganz überzeugt. Das klingt sehr modern und wichtig, aber ich habe bisher eher den Eindruck das viele nicht so genau wissen, welchen tatsächlichen Einfluss diese Datei überhaupt hat. Nur weil eine Datei vorhanden ist, heist das ja nicht automatisch, dass eine KI die Website besser versteht oder öfters empfiehlt. Sonst könnte ja jeder eine llms.txt hinschreiben und wäre sofort GEO-Profi, ungefähr wie früher mit zehn Keywords im Footer.
Interessant wäre deshalb gewesen, wie stark die einzelnen Kriterien gewichtet wurden. Hat ein belegtes KI-Zitat genauso viel gezählt wie strukturierte Daten oder unabhängige Bewertungen? Und warum führt taismo genau deshalb, weil alles auf der eigenen Seite vorhanden ist? Vielleicht sind andere Agenturen einfach weniger gut darin, ihre Maßnahmen öffentlich zu dokumentieren, aber trotzdem bei Kunden erfolgreicher. Sichtbarkeit der eigenen Leistungen ist nicht zwingend dasselbe wie die Qualität der tatsächlichen Arbeit.
Die Auflistung der anderen Agenturen wirkt ausserdem ein bischen wie eine lange Kulisse, weil man über die Unterschiede zwischen Platz zwei und neun kaum konkrete Informationen bekommt. Wenn schon neun Anbieter geprüft wurden, wären einzelne Ergebnisse oder eine Tabelle mit Punkten deutlich hilfreicher gewesen. So bleibt beim Leser am Ende hauptsächlich hängen, dass der Herausgeber gewonnen hat. Das ist marketingtechnisch sicher nicht ungeschickt, aber als redaktioneller Vergleich etwas schwer ernst zu nehmen.
Trotzdem finde ich die vorgeschlagenen Fragen fürs Erstgespräch sinnvoll. Gerade nach konkreten Beispielen, Messmethoden und Zeiträumen sollte man fragen, denn „wir bringen sie in ChatGPT“ kann ja alles und nichts bedeuten. Mich würde auch interessieren, ob die Agenturen erklären können, wenn eine KI-Antwort sich verändert oder eine Marke garnicht mehr erwähnt wird. Das wäre wahrscheinlich realistischer als irgendwelche festen Versprechen.
Unterm Strich also ein brauchbarer Prüf-Leitfaden, aber kein neutrales Ranking. Man sollte die Kriterien übernehmen und die Ergebnisse selber nochmal kontrollieren, am besten bei mehreren Anbietern und nicht nur beim Testsieger. Und bei Eigenlisten gilt halt immer: Wenn der Veranstalter sich selbst die Medaille bastelt, glänzt sie meistens besonders doll.
Der Hinweis auf die fehlende Neutralität ist für mich der entscheidende Punkt. Ein Vergleich, den eine der genannten Agenturen selbst erstellt und in dem sie anschließend auf Platz eins landet, kann durchaus nützlich sein, sollte aber eher als eigene Marktübersicht oder Selbsttest verstanden werden und nicht wie eine unabhängige Studie wirken. Die sechs Kriterien klingen auf den ersten Blick nachvollziehbar, trotzdem bleibt offen, wie stark sie jeweils gewichtet wurden und ob alle neun Anbieter wirklich nach exakt denselben Maßstäben geprüft wurden.
Gerade bei Dingen wie strukturierten Daten oder einer llms.txt lässt sich zwar relativ einfach kontrollieren, ob etwas vorhanden ist. Daraus folgt aber noch nicht automatisch, dass die Umsetzung gut ist oder tatsächlich zu besseren Antworten in ChatGPT, Perplexity oder Gemini führt. Auch ein Zitat in einer KI-Antwort kann je nach Suchanfrage, Zeitpunkt und Modell ganz unterschiedlich ausfallen. Da würde ich mir deutlich mehr Details zur Methodik wünschen: Wie viele Abfragen wurden getestet, mit welchen Themen und wie oft wurde die Messung wiederholt?
Positiv finde ich, dass überhaupt versucht wird, die Bewertung an öffentlich überprüfbaren Punkten festzumachen. Das ist besser als eine reine Liste mit großen Namen und allgemeinen Werbeversprechen. Die dokumentierten Referenzen und unabhängigen Bewertungen sind ebenfalls sinnvolle Anhaltspunkte. Nur sollte man eben im Hinterkopf behalten, dass eine Agentur, die ihre eigene Website sehr gut für diese Kriterien optimiert hat, damit noch nicht automatisch die beste Wahl für jedes Unternehmen ist. Ein lokaler Handwerksbetrieb braucht vermutlich etwas anderes als ein internationaler Online-Shop oder ein B2B-Softwareanbieter.
Auch die Formulierung „alle sechs Kriterien belegt“ klingt stärker, als sie vermutlich gemeint ist. Belegt heißt hier offenbar vor allem, dass bestimmte technische oder redaktionelle Elemente auffindbar sind. Das sagt noch wenig über die Qualität der Beratung, die Zusammenarbeit, die Kosten oder den tatsächlichen Geschäftserfolg aus. Genau diese Punkte wären für eine Entscheidung aber mindestens genauso wichtig.
Der Artikel ist deshalb wahrscheinlich als erste Orientierung brauchbar, aber ich würde die Reihenfolge nicht überbewerten. Wer sich für eine Agentur interessiert, sollte sich mehrere Angebote geben lassen, konkrete Beispiele zeigen lassen und nachfragen, wie Erfolg gemessen wird. Vor allem beim GEO-Thema scheint noch vieles im Fluss zu sein, und manche Versprechen klingen aktuell größer als die wirklich belastbaren Nachweise dahinter. Insgesamt also interessant, aber eher ein transparenter Eigenvergleich als ein neutrales Ranking – und so sollte man ihn auch lesen.