xAI und Grok AI

Ich habe gemeint, dass ich mich auch bisher schon im Auto gerne mal mit Grok unterhalte. Der Grok auf meinem Telefon hat keinerlei Zugriff auf das Auto.

Ich meinte ein <xyz>. Aber da ich den Eindruck habe, dass du es absichtlich nicht verstehen möchtest, beende ich unsere Unterhaltung in diesem Thread hiermit.

1 „Gefällt mir“

Das mag zwar alles sein, aber was ist jetzt daran „unglaublich“?
Und davon abgesehen: „Grok ist billig, qualitativ aktuell nicht auf der Höhe“ ist Deine persönliche Meinung.

Ich kann Dir sagen, dass Grok bei mir immer gute bis sehr gute Ergebnisse liefert. Und wenn sich Grok auf die Nase legt tut es ChatGPT ebenso.

Ich habe mir gerade einige Leaderboards angeschaut: Ja, aktuell ist Grok nicht unbedingt vorne, ChatGPT ist es aber auch nicht. Gerade scheinen Claude und Gemini eher die Nase vorn zu haben.
Also ggfs. ist es doch nicht so sinnvoll zuviel Kohle in eine OpenAI-IPO zu schieben, weil mittelmäßig sind die auch aber nicht preiswert. :wink:

1 „Gefällt mir“

Nochmal der kleine Hinweis

Keine Meinung, Daten, Benchmarks und ApI Kosten.

Grok ist nirgends mehr vorn, die sollten mal was liefern ausser billigen Tokens. Merkt man auch völlig wenn man es mal zu aktuellen Modellen vergleicht. Letztes Update war 2025, das ist halt nicht mehr ganz auf der Höhe aktuell. Mal sehen wie Grok5 wird, jetzt haben sie ja Druck.

Ja, genau das ist der Punkt: Das Rennen ist so eng gerade, das jedes neue Modell die Reihenfolge blitzschnell verändert. Letztes Jahr war Grok noch gang vorne, dann konnte ChatGPT wieder aufholen, wurde dann aber in den Leaderboards vielfach von Gemini und besonders Claude überholt.
Wir reden hier über 6 Monate, 8 wenn es hoch kommt. Da ist nichts „unglaubliches“ passiert. Da ist technische Weiterentwicklung passiert. Mehr nicht.

3 „Gefällt mir“

In den letzten 6 Monaten ist Softwareentwicklung komplett disruptiert worden, das sind die entscheidenden 6 Monate in denen es gekippt ist. Grok hat dazu nichts beigetragen. OpenAI und Anthropic sowie Google haben den Markt, das andere Modell ist Nische (Bildgenerierung für Hirne auf Pubertätsniveau, image2Video, billig).

1 „Gefällt mir“

Es gibt schon die Hoffnung, dass es bald soweit ist, dass sich die AIs selbst weiterentwickeln. Wenn das wirklich funktioniert geht es dann Schlag auf Schlag und neue Versionen kommen so schnell sie trainiert werden können. Dann gewinnt wahrscheinlich wer die meiste Rechenleistung im Orbit hat. :wink:

1 „Gefällt mir“

Wieder nur persönliche Meinung ohne Quelle oder Fakten.

Grok 4.2 soll nächste Woche rauskommen, mal schauen was dann die Leaderboards sagen.

Auch das ist keine Meinung, das Ding gewinnt keinen Preis aktuell und ist in seriösen Kreisen verbrannt.
Agentic leistet es auch gar nix derzeit, angeblich wollen sie ja was bringen was mit Codex und Code konkurriert.
Ausser Ankündigungen kam da nicht viel.

Und wieder Meinung als Fakt getarnt.
Lassen wir es gut sein.
Wir brauchen den Thread hier nicht mit dieser Sinnlos-Diskussion zumüllen.

An alle anderen: Sorry, war nicht meine Absicht.

Colossus rechnet noch. Bis jetzt war immer das neueste Modell das beste und der letzte Grok Release ist mittlerweile in AI-Jahren gerechnet aus der Zeit der Dinosaurier.

1 „Gefällt mir“

Sogar xAI selbst hat für die Entwicklung Claude genutzt, bis sie geblockt wurden. xAI hat nichts was da mithalten kann.

xAI hat sich etwas verzettelt. Zurzeit läuft das Rennen zwischen Anthropic, Google und OpenAI.

Also, hat es nen eigenen Coding Agenten wie Codex oder Claude Code, nope.
Das kannst Du ja einfach nachprüfen, es ist nicht so.

Sie haben ein bisschen was mit einer Agentic API gemacht, aber sonst nix geliefert. Aktuell wird aber oft genauso gearbeitet.
Skills und Extensions haben sie nicht und das Modell loost in allen Benchmarks.

Alles völlig transparent und nachvollziehbar. Dafür tolle Ausfälle mit Bildgenerierung und kein Alignment :wink:

Ich muss einen wunden Punkt getroffen haben, wenn Beistand von Hendrik kommt.

Und was kommt ist eine Behauptung ohne Quelle:

Und was kommt nach etwas suche dabei raus: Es wurden Code-Tools von Claude zum Erstellen und validieren von Code genutzt. Mehr nicht. Nichts für die Erstellung und Training des Grok-Modells

Ach ja: Zwei andere Klitschen wurden wegen der Nutzung auch gespeert:

In August of the same year, OpenAI itself fell under restrictions: it turned out that their programmers actively used Claude Code before the GPT-5 presentation

Diese OpenAI (kennt die wer?) hat wohl auch „nichts was da mithalten kann.“. :wink:

1 „Gefällt mir“

Naja, spricht zumindest dafür, dass sie Pretraining abkürzen müssen/wollen.

Umso schlimmer wenn hinten solange nix besseres rausfällt.

der Blick zurück ist immer einfach. Wenn aber neue Dinge vor der Türe stehen und dann erklärt wird, dass das ja überhaupt nicht gehen kann…das war mein Punkt.

Zu dem Zeitpunkt nicht und auch jetzt gilt Claude im produktiven Umfeld als führend vor OpenAI.

OpenAI muss auch aufpassen, sich nicht zu verzetteln. Aber immerhin haben sie im produktiven Umfeld was im Angebot, dass noch wettbewerbsfähig ist und profitieren von ihrer Bekanntheit.

Z.B. sieht man es auch an der Umsatz-Runrate:
OpenAI 20 Mrd $
Anthropic 13 Mrd $
xAI 0.5 Mrd $

Und sie haben jetzt OpenClaw ins Boot geholt :wink:

Denke das passt ganz gut zu der Strategie auch ein Hardware-Device rauszubringen mit Jony Ive :wink:

Kommerziell sind OpenAI und Anthropic die relevanten Firmen, sehe ich auch so, plus Google.

Nun ja, wir sollten verschiedene Bedürfnisse unterscheiden.

Claude ist für reines Coding unschlagbar. Wir finden die Spezifikationsbehandlung und die Agent-Hooks in AWS Kiro jedoch deutlich produktiver und flexibler, wenn es darum geht, echte Lösungen zu bauen.

Ich persönlich mag OpenAI nicht besonders, weil die Antworten dort so stark vom Kontext, vom Thema und vom Blickwinkel der Frage abhängen. Wir haben fast alle unsere Nutzer inzwischen auf Claude umgestellt.

1 „Gefällt mir“