Ox Alpha ist GLM 5.3 Flash // Apple M6 und M5 Ultra // Model Hardware Standard // Gemini 3.5 Transcribe // Nvidia und Hugging Face // Claude Fable 5.1
- // Podcast
- // News 36/26
Shownotes
Diese Woche geht’s um Ox Alpha, Apples neue Chips M6 und M5 Ultra, Anthropics Model Hardware Standard und Claude Fable 5.1. Dazu kommen Gemini 3.5 Transcribe und ein paar Kurzmeldungen. Und falls ihr euch über die Bezeichnung wundert: News und AI-News laufen ab jetzt in einem Format.
Ihr habt noch kein Ticket für die programmier.con 2026? Dann nutzt jetzt noch die Chance und nehmt am 25. und 26 November an unserem Event rund um Web und AI teil! Mehr unter: https://con.programmier.bar/
Fabi und Philipp klären auf, was hinter Ox Alpha steckte, dem anonymen Modell auf OpenRouter: das offene GLM 5.3 Flash von Z.ai mit 320 Milliarden Parametern. Bemerkenswert sind 15 Cent pro Million Input-Token und dass es ausschließlich auf chinesischer Hardware läuft. Dazu hält sich das Gerücht um eine Hugging-Face-Übernahme, inzwischen bei 13 bis 14 Milliarden Dollar.
Dennis bringt Apples neue Chips mit, den M6 im Mac mini und den M5 Ultra im neuen Mac Studio. Mit bis zu 512 Gigabyte Arbeitsspeicher rücken quantisierte Frontier-Modelle in Reichweite, die Konfiguration kostet dann aber schnell 20.000 Euro. Unser Fazit: Wir nutzen weiter APIs.
Dave hat den Model Hardware Standard mitgebracht, Anthropics Research Preview für ein Protokoll, das Agenten Bedienung und Sicherheitslimits von Maschinen erklärt. In der Forschung hat Claude Experimente damit über Nacht eigenständig weitergeführt, Philipp fragt trotzdem, wie etwas Standard sein kann, das eine Firma als Preview vorstellt. Frisch ist außerdem Claude Fable 5.1 samt Mythos 5.1: im Schnitt 25 Prozent günstiger und besser.
- Dennis
- Hallo und herzlich willkommen zu den Programmieren news 36 26. Und wir reden heute über OX Alpha, das ist ein neues KI Modell, wo man nicht genau weiß, was dahintersteckt. Wir haben Model Hardware Standard als Thema. Apple hat neue Chips rausgebracht für noch mehr KI. Wir reden über das Übernahme, die Übernahme von Hackingface und Germany 3 Punkt 5 Transcribe und dann ist auch noch in 1 neuen Version rausgekommen und ein, 2 kleinere Themen. Neben mir sitzt David Koschitzki aka Dave, was geht? Wohin? Ich bin Dennis Becker.
- Philipp
- Ich bin der Fabi Fink, hallo. Und ich bin der Philipp.
- Dennis
- Schön, dass ihr alle da seid und jetzt direkt noch mal natürlich zum Anfang, falls ihr euch wundert über das Cover beziehungsweise die Bezeichnung dieser Folge. Wir haben uns ja entschieden, dass wir AI News und News wieder zusammenbringen, weil wir gemerkt haben, okay, im Alltag ist immer mehr AI. Die ganz harten, wir reden nur über Parameter, Updates in Models Zeiten sind vielleicht auch ein bisschen vorbei und von daher können wir das ganz gut wieder zusammenbringen. Von daher schön, dass Philipp da ist, sage ich gerade so stottert, weil er kurz
- Dave
- Ja, er hat sich kurz doch wieder nicht da. Sehr labile Verbindung hier.
- Dennis
- Ah, wir Okay, ich finde das von unserem Aufnahmetool. Man hat wirklich das Gefühl jedes Mal, wir machen das allererste Mal im Podcast. Ja. Es ist jetzt 19 nach Aufnahmezeit, also es haben 19 Minuten gebraucht, dieses Setup so ans Laufen zu bekommen, dass wir miteinander reden können.
- Dave
- Aber es ist immer noch suboptimal, muss man sagen.
- Dennis
- Und es ist
- Dave
- immer noch nicht gut. Es ist immer noch nicht gut.
- Fabi
- Subboptimal ist sehr positiv ausgedrückt, ja.
- Dave
- Ja, oh Gott.
- Dennis
- Ich mein
- Philipp
- Leute, einfach mit 'ner anderen Kamera dann für denjenigen, der zuschaut.
- Dennis
- Sehr gut. Okay. Und wollten wir jetzt Grog Ono als Täter? Da da habt ihr eben nicht gehört, wenn wir nicht zurücktreten konnten, ob das Mikrofon ich euch gehört hat. Grog Ono auf die Themenliste packen? Machen wir. Okay, machen wir. Dann rein da.
- Dave
- Voll die vollgepackte Folge jetzt schon.
- Dennis
- Jetzt, Das war jetzt zu voll. Ich bin
- Dave
- die nächste Folge.
- Dennis
- Ox Alpha, Fabi.
- Fabi
- Ox, ich erst mal die Frage, ich würde schon O-x-einfach ausgesprochen nicht Ox Alpha oder?
- Philipp
- Nee, ist tatsächlich Ox Alpha, weil
- Dave
- Ja, das ob man Ox
- Fabi
- braucht oder?
- Philipp
- Ja und es gibt 'n Muster, das also es ist 'n anonymes, war 'n anonymes Modell, was auf Open Roter und 'n Open Code veröffentlicht wurde. Und es gab bisher weitere anonyme Modelle auf Open Roter und alle hatten Tier Vornamen. Das heißt, das ist son, na ja und alle waren bisher von chinesischen Providern und Ox Alpha war sozusagen das letzte letztes Wochenende, letzten Freitag oder so, aber Genau,
- Fabi
- vielleicht noch 'n paar Ergänzesachen. Na ja genau, OX Alpha war wusste erst mal nicht, von welchem Lab es kommt. Warum Eigentlich wusste
- Philipp
- es jeder direkt.
- Dave
- Auch wisst ihr's, ich warte
- Fabi
- es Es wurde mutmaßt und die Mutmaßung haben zum Gropen gestimmt,
- Dennis
- so können wir's vielleicht sagen.
- Fabi
- Aber stand's will noch nicht direkt, aber wusste wusste man auch schon, wie's heißt alle? Haben wir alle richtig getippt?
- Dave
- Auf jeden Fall heiß. Auf jeden Fall heißt
- Fabi
- der GLM 5 Punkt 3 Flash, kommt von ZAI war jetzt auch, was die Open Modelle angeht auf Open Router, das am schnellsten wachsende Modell, also was die Tokenusage angeht. Ich glaube, nach den ersten 3 Tagen, also wenn man die ersten 3 Tage nach Launch sich anguckt irgendwie, da war offenbar X Alpha das Modell, was am häufigsten genutzt wurde. Ist 'n offenes Modell, 23000000000 Parameter Mixedurve Experts, wovon 18000000000 irgendwie aktiv sind. Ich glaub, ganz interessant ist, wenn man sich's anschaut, Flash, die Benahme würde jetzt erst, würde man jetzt erst mal denken, dass es sich schnelles Modell handelt, aber auf wie schnell es ist, kommen wir gleich noch mal drauf, besonders schnell nicht, aber es ist eben klein. Also wenn man die Größe des Modells sich sozusagen anguckt, nicht so klein und ich glaub, es wird 'n bisschen verwechselt, dass Du's jetzt auf lokal auf 'ner Hardware irgendwie laufen lassen kannst, also kannst ja nicht auf 'n MacBook laufen lassen mit 23000000000 Parametern, aber im Vergleich zu den Flagship Modellen natürlich schon, reiht sich son bisschen in die Größe von Typy Luna ein. Und auch irgendwie Pricing, für was es leistet, ist, würde ich sagen, vergleichbar. Artificial Intelligence Index ist er bei 57, was schon ziemlich hoch ist für son für son offenes Modell und das Pricing ist natürlich superinteressant. Also es sind nur 15 Cent pro Million Input Token und 50 Cent pro Million Output Token. Ist relativ, sagen wir mal, geschwätzig, also hat relativ viele Output Tokens, die es da generiert, weshalb's so ist, dass, wenn man sich diesen Artificial Intelligence Index auch noch mal 'n bisschen anschaut, dann ist es für die Task, also für das für das Durchführen des Indexes sozusagen ist Luna günstiger als als GLM 5 Punkt 3 Flash, obwohl's teurer ist, also mit, ich glaube, 20 Cent Input und irgendwie über Dollar 20 Output Tokens. Aber dafür kriegt man eine ganze Menge mehr Reasoning. Also Luna war so bei Anfang, ich glaub bei irgendwie 52 oder so was auf dem Index und GLM 5 Punkt 3 Flash ist da eine ganze Ecke oben drüber. Wenn man Geschwindigkeiten mal vergleicht, glaub, Luna ist so bei 100 Token die Sekunde. Wenn man jetzt das GLM 5 Punkt 3 Flash über ZAI gehostet nutzt, dann ist man so bei die 40 Tokens pro Sekunde. Was insofern ganz interessant ist, weil ich hatte auch noch mal 'n Artikel dazu gelesen, ne, es läuft ja auf im Grunde genommen Hardware in China, die ja nicht an die NVIDIA Chips Chips rankommen und da wurd's son bisschen verglichen, wo sind denn aktuell eigentlich grade so die Chips, die die die Huawei oder ähnliche herstellen und was die Geschwindigkeiten angeht. Und wahrscheinlich ist es so, dass es auf 'ner Hardware läuft, die ungefähr so 60 Prozent der Fähigkeiten von 'nem h-einhundert, von Nvidia haben, was ja auch schon mittlerweile 'n 4 Jahre alte 4 Jahre alter Chip ist. Und ganz interessant daran ist, dass es günstiger ist als vieles andere, obwohl man, wenn man jetzt so guckt, so westliche Anbieter, meistens sagt man so, dass beim Pricing sind so 80 Prozent ist ja das sozusagen Hardware und Stromkosten sind nur so 10 bis 20 Prozent. Wohingegen bei den chinesischen Chips man jetzt sagt, wenn man das 'n bisschen hochrechnet, alte Chips, auch dadurch müssen müssen mehr Hardware eingesetzt werden, diese Modelle laufen zu lassen, sind wahrscheinlich bei diesen Tokenpreisen 50 Prozent Stromkosten, die die bei diesem die bei diesem Pricing mit 15 Cent Input, 50 Cent Output drin sind, weil's auf jeden Fall sehr, sehr interessant ist. Und das ist auch der Grund, warum es im Vergleich langsamer ist. Also wenn man das auf, wenn man das auf westlicher Hardware aktuell laufen lässt, dann ist man eher so bei, ich glaub, 60 bis 70 Tokens pro Sekunde, je nachdem, welchen Anbieter man wählt. Aber bei ZRR selbst ist man so bei 42 Tokens, glaub ich, die Sekunde. Was auf jeden Fall super superinteressant ist, ne, neues Open Source Modell, ich glaub jetzt sehr, sehr interessant, grade auch was Pricing irgendwie angeht und mal wieder 'n neuer Player im Markt.
- Philipp
- Ja, vielleicht noch 2 ergänzende Dinge, weil es vielleicht nicht klar wurde mit dem OX Alpha und wie es kam. Die Open Router Usage, also die 28 Trillion Tokens oder so was, war über die ersten 3 Tage, wo es free war. Also es wurde letzte Woche Donnerstag oder Freitag vorgestellt, so, hey, ist free auf Open Router, jeder kann das nutzen. Und Sie haben sie haben Kapazität für 100 Trillion Tokens. Das heißt, es wurde nicht irgendwie limitiert. Und wie ist es halt mit kostenlosen Dingen? Jeder nutzt es. Und es war überall auch auf Social Media und keiner wusste genau, was fürn Modell es ist, weil es halt auch irgendwie gut war. Es gab viele Spekulationen, weil 'n paar son Benchmarks laufen lassen haben oder war's irgendwie auf 10 Beispielen besser als Opus 5. Und was halt noch mal besonders ist, ich glaub, das ging vielleicht 'n bisschen unter ist, Sie haben auch bei jedem Announcement gesagt, dass es ausschließlich aus aus auf chinesischer Hardware läuft und bisher immer viel spekuliert wurde auch von in den USA oder generell, dass China gar keine Möglichkeit hat, überhaupt solche Modelle zu hosten in diesem Scale. Und 28 Trillionen Tokens ist jetzt nicht irgendwie etwas, was sich auf 2 h einhundert laufen lassen kann oder irgendwie so was. Also wenn man irgendwie von 20 Tokens die Sekunde oder 40 Tokens die Sekunde ausgeht und nicht das hochskalier auf von Tokens nur über 3 Tage, das ist ja nicht keine lange Zeit, dann brauch ich schon viele Chips. Und das ist halt das, find ich, wirklich krass Beeindruckende. Und Du hast es ja gesagt, er ist MIT Leistungs. Also wenn ich irgendwie Grafikkarten oder so was hab, kann ich's wirklich frei nutzen, wie ich's möchte.
- Fabi
- Ja. Und vielleicht noch kurz dazu, weil Du grade meintest, war Free auch aktuell dieses 15 Cent Input, 50 Cent Output Tokens. Aktuell ist sie auch noch mit 50 Prozent Discoten, also aktuell Genau. Kaufen wir's auch noch zur Hälfte des Preises. Also das ist sozusagen der Preis, auf dem sie's einpendeln wird. Aber aktuell, grade auch über sind die immer noch discounterd. Und nur
- Dennis
- noch mal nachfrage, weil am Ende sagt das Habi, ein neuer Player, aber
- Fabi
- ein neues Modell ist kein neuer Player, ne. ZRR ist kein neuer Player. Die sind ja 2019 aus 'ner Uni gegründet worden. Die DLM Modelle kennen wir auch schon. Also mit neuem Player meinte ich jetzt hier, ein neues, relevantes Modell.
- Dennis
- Ja. Okay. Ich grätsch mal direkt dazwischen mit Hardware, weil Du grade meintest, läuft nicht auf lokale Hardware und vielleicht können wir dann da kurz drüber Ja. Sortieren. Und zwar hat Apple neue Chips vorgestellt, und zwar einmal den m 6 und den m 5 Ultra. Ist ja in der Vergangenheit auch schon häufig so gewesen, dass die Reihen praktisch erst auch die kleineren Versionen haben und dann auch nicht die kompletten, was ist da, Max Pro Ultra Varianten irgendwie davon gibt. Aber genau, die beiden sind neu rausgekommen, ne, den mx m 6 gibt es in dem im Mac mini und das ist der 1. Chip, der jetzt eine 2 Nanometer Chip Architektur hat und der m 5 Ultra. Ich glaub, das sind ja dann einfach immer nur so 4 zusammengestöpselte m 5
- Philipp
- oder so was. Also da wollen
- Dennis
- wir diese, ja, die die Verbindungen und machen's einfach stärker dadurch. Und also einmal interessant einfach, wie stark Apple das Marketing so auf KI und lokale KI entforst hat. Das heißt, so in den Marketingvideos ist so okay und da sagen, man kann's wahnsinnig viel lokal machen. Und tatsächlich, der M-fünf- Ultra hat bis zu 512 Gigabyte Arbeitsspeicher, was einfach sehr, sehr groß ist und einen Durchsatz von 1.2 Terabyte pro Sekunde. Und zumindest hab ich jetzt grad noch mal parallel Celli gefragt und er meint also in 'ner Quantisierung, nicht im vollen Modell, weil das würde wahrscheinlich 640 Gigabyte brauchen, aber in irgendwie 'ner f p 8 oder q 8 Quantisierung würde das dann auch auf 'nem m 5 Ultra Chip laufen. Also ich glaub, man ist dann nicht mehr so weit weg davon, dass man auch solche Frontiermodelle lokal laufen lassen kann.
- Philipp
- Außerhalb Hab ich ja was falsch gesagt. 20000 US Dollars.
- Dennis
- Hardware meinst Du. Ja.
- Philipp
- Ich mein, was kostet der ganz große?
- Dave
- Ist das ist das so? Ja.
- Dennis
- Kostet der M-sechs? Nein, gut.
- Dave
- Gibt's den M-sechs überhaupt schon? Nein, ne? Der kommt doch raus.
- Dennis
- Nee, nee, die der die gibt's jetzt. Aber das ist ja der der, also der M-sechs ist der kleinere, der kommt im Mac mini und den Du haben willst, das zu machen, das wäre der M-fünf-Ultra. Ja. Und den gibt es in dem Mac, wie heißt der denn, Pro, diese Borkenkäfer. Genau. Und vorher als Vorsitzender 1 Firma, bei der
- Fabi
- ich mal gearbeitet hab, würde das nennen.
- Dave
- Peanuts? Ja.
- Dennis
- Machen wir auch Waren
- Philipp
- wir Ausschreibungen über 10 Jahre.
- Dennis
- Ich find's einfach trotzdem, von der dem Also einfach so die Vorstellung, also selbst wenn es jetzt 20000 kosten würde, ne, einfach, dass Du halt so ein wirklich Modell, was an diese an diese Benchmarks reinkommt, irgendwie auf lokale Hardware laufen lassen könntest, ist ja schon irgendwie auch wieder von der Vorstellungskraft, dass das so geht. Eigentlich ganz cool.
- Philipp
- Ich wollte den mal kurz konfigurieren. Auf der Apple Seite steht leider 512 Gigabyte Arbeitsspeicher für den m 5 Ultra gibt's leider erst ab Oktober. Das heißt, wenn ihr jetzt panisch und auf die Webseite gehen wolltet und den kaufen, geht noch nicht. Noch nicht, noch nicht. Der aktuelle mit 256 Gigabyte und 8 Terabyte Festplatte kostet nämlich nur schlappe 17000 Euro. Wenn ihr dann aber 16 Terabyte Festplattenspeicher wollt, dann seid ihr schon bei 20000.
- Fabi
- Ja, und ich mein, wenn's wenn's nur darum geht, auf lokale Hardware laufen zu lassen, ne, Du kannst ja auch 'n paar NVIDIA, also Du kannst ja jegliche Hardware lokal hinstellen oder Ja, ich
- Philipp
- glaub, der große Unterschied ist, wir hatten's ja mit den Stromkosten. Ich glaub, Du möchtest wirklich keine NVIDIA Grafikkarten zu Hause bei dir laufen lassen, weil was die an Watt brauchen für die gleiche Leistung ist schon frech.
- Fabi
- Ja, ich glaub Gut. Ja, wenn Du's Geld hast, sie dir hinzustellen, hast Du auch Geld für Stromkosten.
- Dennis
- Ja. Nutzen mal weiter Abis, oder? Ja, würd ich auch sagen. Okay, sehr gut. Dave. Yes. Ich weiß überhaupt nicht, was sich hinter deinem Titel versteckt. Du hast Model Hardware Standard
- Dave
- Ja. Als Research Preview Genau.
- Dennis
- Als Titel.
- Fabi
- Find ich aber gut wie
- Dave
- diesen Sixsieben Moves noch mal so, Research Preview. Sehr gut. Ja genau, es wird richtig futuristisch und ich glaube, es ist einfach sogar, was dir richtig gefallen wird, Clemens.
- Fabi
- Okay,
- Dave
- ich hör zu. Denn nämlich AI bricht damit aus der digitalen Welt aus und zwar hat Ant Tropy, wie Du schon richtig gesagt hast, sone Research Preview rausgehauen und ein Standard vorgestellt mit dem Namen Model Hardware Standard. Und jetzt, wenn man gesagt, kurz MHS, denkt man jetzt auch im im Kontext von AI MCP irgendwie nah dran, beides irgend mit m. Und zwar kann man sich das irgendwie so ungefähr vorstellen, dieses MHS ist quasi MCP für unsere physische Welt mehr oder weniger. Das heißt, ein standardisiertes Protokoll, damit Agenten verstehen, wie man mit Maschinen in der echten Welt umgehen soll. Das ist so quasi das das Versprechen von dem Ganzen. Mhm. Vielleicht erst mal, woher das Ganze kommt, also was da eigentlich der Ursprung ist, was das Problem war. Der Ursprung ist in der Forschung, aber die sagen auch so Produktionsstätte, wo Du halt Maschinen hast und irgendwie Abläufe, die dann halt automatisiert irgendwie stattfinden sollen. Da ist das nämlich das Problem an diesen ganzen Geräten meistens, keine Ahnung, Du hast jetzt irgendwie 'n Mikroskop und irgend eine Kamera und eigentlich musst Du dann immer individuell schauen, okay, wie sprichst Du die an von deinem Programm, ne, also deren API bedient und so, damit das alles irgendwie automatisch läuft. Und dann willst Du ja vielleicht irgendwie 'n Roboter haben, der mit seinen Armen nutzt und dann irgendwie was pipettiert und was reinmacht, dann muss das aber noch in eine Zentrifuge. Die Zentrifuge muss mit irgendeiner Geschwindigkeit gedreht werden und das Substrat und so weiter, ne, also Forschung, Forschungsstab insgesamt. Und das musst Du alles immer individuell halt irgendwie selbst entwickeln und versucht da jetzt mal 'n Agent noch einzubinden, der sagt, hey, mach das mal alles in den Abläufen und wenn da was schiefläuft, dann wiederholt das noch mal in uns was alles. Und dem erst zu erklären, hey, wie funktioniert die Maschine? Und da soll halt eben dieser Model Hardware Standard helfen, den Agents zu erklären, hey, wie benutzt man eigentlich diese Maschine hier? So. Das heißt, zum einen, was es weiterhin haben wird, sind so so primitives, ne, also einfach so, zum Beispiel, hey, was ist die Temperatur in dem Behälter oder ich möchte, dass die Temperatur auf 40 Grad eingestellt ist, solche Sachen. Aber viel wichtiger, den den Agenten wird auch erklärt so, ey, was hat es mit dieser Maschine auf sich? Was sind so Charakteristika der Maschine, ne? Also grad wenn wir jetzt diesen Roboterarm haben, was ist was ist der Gewicht dieses Arms? So, ne, damit Du dich halt einfach aus Versehen irgendwie 'n Mensch damit umballerst, so. Dass man weiß, okay, den sollst Du vorsichtig bewegen, den kannst Du auch bewegen, so, ne. Also was ist die Range of Motion von diesem Gerät? Wenn Du jetzt 'n Laser bedienst, was ja auch 'n Gerät ist, was ist so die maximale Leistung von diesem Laser, damit er nicht passiert? Genau. Und generell einfach so will man da erklären so, ich finde das gut, diese AdLiffs. Das ist quasi, Du bist grade ich in der Situation. Genau, also generell kann man sagen so, was kann das Gerät? Mhm. So, was kann man alles einstellen an diesem Gerät und was sind irgendwie Sicherheitslimits von diesen Geräten, die auf jeden Fall gegeben sein müssen, so.
- Dennis
- Ist nicht also eigentlich eine Bedienungsanleitung.
- Dave
- Genau, mehr oder weniger. Aber genau das hat in Fraport auch gesagt, so meistens genau diese Sachen sind halt in irgendwelchen Handbüchern versteckt, in irgendwelchen Manuals, so und die sind auch nicht ausm Code irgendwie, wenn Du auch eine irgendwie eine API hast oder so, nicht direkt erkennbar, ne. Du weißt nicht, wie viel Roboter amwiegt im Code.
- Dennis
- Wie bei MCP, sofort mein Take wird man bald nicht mehr brauchen.
- Dave
- Aber aktuell doch. Okay. Genau und auf jeden Fall aus diesen ganzen Sachen wird dann sone Referenzdatei erstellt und dann kann das an den Agenten übergeben werden und der Agent kann dann dann selbst noch mal sagen, hey, okay, wie möchte ich eigentlich überhaupt dann mit mit dem dann insgesamt umgehen, ne? Nutzt ich einfach eine klassische API, so, die es ja immer noch weiter geht. MCP ist trotzdem noch benutzbar so. Wenn das halt irgendwie angeboten wird, kann das darüber auch kommunizieren. Also es gibt viele verschiedene Kanäle, wie dann der Agent mit diesen Maschinen umgehen kann und vielleicht, damit das irgendwie son bisschen greifbarer wird. Ich ich ich fand das schon interessant, wieder wie das in der Forschung jetzt verwendet wurde. Da gab's dann 'n paar Beispiele auch. Und zwar der Agent hat dann halt dieses Wissen über diese Hardware und orchestiert halt quasi die gesamten Experimente und kann das auf 'ner sehr hohen Flughöhe machen. Und 2 Beispiele fand ich da wirklich sehr spannend. Zum einen wurd gesagt, dass Claude das auf 'ner sehr explorativen Art und Weise gemacht hat, wie es auch Forscher machen würden. Also es ging dann irgendwie sone 'n Laser und da sollte irgendwas, keine Ahnung, wie das Licht gebrochen wird oder so, dann festgestellt werden. Und hat dann mit der Kamera selbst analysiert, ah okay, das passiert hier grade, ich mach's mal hoch. Ah okay, nee, das ist nicht so das Ergebnis, was ich haben will, wieder zurückmacht und hat selbst daraus erkannt so, hey, ich möchte das grade mal 'n bisschen selbst testen, hat sich dann selbst 'n Skript geschrieben, das halt die Stufe des Lasers immer 'n bisschen höher stellt von der niedrigen Sache und dann immer Messung dann durchführt und guckt, hey, gibt's irgendwie 'n interessanten Punkt ab der und der Energie, dass da etwas Krasses, Auffälliges passiert? Also auch son bisschen dieses wissenschaftliche, ich glaub, Cerendipity nennt man das so, dieses man ist aufmerksam nach irgendwie neuen Erkenntnissen, während man forscht. Und was ich auch sehr beeindruckend fand, 'n Wissenschaftler hatte auch eine PDF Datei erstellt und quasi einfach nur erklärt so, hey, das ist Experiment, das wollen wir testen, so soll das ablaufen, das klort gegeben und weil klort ja dann mithilfe von dem neuen Standard jetzt quasi wissen konnte, wie er die Maschinen bedienen muss, konnte er das dann aber machen und dieses Experiment dann komplett eigenständig durchlaufen lassen. Wenn da irgendwas schief gegangen ist, hat er's dann auch automatisch gefixt. Der hat gesagt, ah okay, das war nichts, ihr macht ich mach's wieder von vorne. Wo 'n Mensch natürlich erst mal sagt, hey okay, ich mach Feierabend, hat Claude das dann halt über die Nacht weitergemacht, noch mal neu nachjustiert et cetera pp. Und und das war, glaub ich, so das das also der die Zusammenfassung der der Forschenden irgendwie, dass Experimente, die sonst einfach über Wochen gelaufen wären, können jetzt halt innerhalb von Tagen gemacht werden. Und wenn wir das natürlich dann irgendwie so als Standard erreichen, dass wir das agentlich noch mal in der Forschung krasser vorantreiben, ist das ja 'n wahnsinniger Geschwindigkeitsboost in der Forschung.
- Dennis
- Ist auf jeden Fall Futter für Albträume von hinten Dystopen, Ja. Die das alles 'n bisschen kritisch sehen sollen. Genau, genau. Sag jegliche Maschine anschließen, sag Bescheid, brauchst 'n Laser, brauchst Du 'n Roboterhand. Erschießt mal Menschen. Genau, in irgendwelchen, alles. Genau. Ist auch praktisch.
- Philipp
- Für mich, ich weiß nicht, ob Sie's schreiben, aber für mich sind 2 Dinge schwierig. Wann was warum oder wie kann etwas 'n Standard sein, wenn das in Preview ist und nur von 1 Company vertreten wird? Also ich weiß nicht, normalerweise entwickelt sich ja 'n Standard durch 'n Konsortium von mehrere, die versuchen 'n konkretes Problem zu lösen. Das klingt jetzt sehr stark nach Marketing und wir von Antropé Ketten gern mehr standardisierte Roboter Robotiksdaten, damit wir unser Modell besser machen können. Hier ist 'n gutes Beispiel, was wir gefeiert haben mit Robotics Company XYC. Vielleicht solltest Du das auch machen.
- Dave
- Das waren aber 2 Unternehmen, glaub ich, oder?
- Dennis
- Also ich
- Dave
- glaub, da waren nicht nur 1, sondern 2 sogar. Also da sind wir 'n bisschen diversifiziert.
- Philipp
- Und deswegen, ich bin mal gespannt, ob das irgendeiner irgendjemand anderes adoptiert oder nicht oder ob das halt 'n schönes Forschungsprojekt mit 'nem schönen Marketing dazu ist. Weil ich mein, MCP oder Skills oder wie auch immer wurden ja nicht vorgestellt mit, hey, hier ist 'n neuer Standard, sondern hey, hier, wir haben wir eine Idee, wie wir das machen können.
- Dennis
- Mhm.
- Philipp
- Und so ging's ja los. Also ich bin gespannt. Und ich bin auch wirklich gespannt, ob das hilft, weil ich ich, wenn ich da an die Robotics Projekte denk, die wir bei uns mit Gemini machen oder es gab ja auch vor 2, 3 Wochen das neue Gemini Robotics Modell. Es ist nicht so, dass ich viele Maschinen hab, die ich nicht weiß, wie ich die bedien. Es ist eher so 1 zu 1, dass es halt sehr genau noch aktuell ist und sehr spezifiziert ist. Also ich geh nicht irgendwie auf eine Webseite, logg mich ein und plötzlich hab ich 4 Roboterarme, die ich kontrollieren kann, halt 'n Ziel zu lösen. Mhm. Deswegen bleibt's spannend.
- Dave
- Mhm. Ja cool, da noch mal den Einblick zu haben
- Philipp
- von der Auffassung. Ist echt cool. Also ich weiß nicht, ob's geteilt würde, während ich weg war, aber Germany hat diesen Boston Dynamics Roboter komplett alleine gesteuert und konnte dann auch mit dem rumlaufen und Essen verteilen und so was und alles komplett autonom.
- Dave
- Mhm. Krass.
- Dennis
- Gut, dann wollen wir noch grad noch bei Germany, wenn wir da schon da sind. Germany 3 Punkt 5. Genau.
- Philipp
- Also ich weiß nicht, wie viel ihr in euren Editoren oder nutzt, aber ich glaub, bei mir sind's über 50 Prozent mittlerweile. Und ich hab's auch immer in Google Meet an oder sonst wo. Das heißt, alles, was irgendwie gesprochen wird, wird mittlerweile transkribiert und 3 Punkt 5 Transcribe ist 'n spezielles Gemini Modell, das die, sag ich mal, das Reasoning und die multimodalverständnis von Gemini nutzt und halt 'n besseres Transcribe Modell daraus macht. Das heißt einfach, es hat intelligentes Prozessen. Das heißt, wenn Du irgendwie sprichst oder undeutliche Sätze hast oder irgendwas nicht richtig sagst, dann filtert halt das dieses im raus. Und das hat auch, ich weiß nicht, wenn Ich hab oft den den Case, dass wenn ich in meinen Codingeitorien redik so, hey, bitte ändere den Button zu gelb, halt nee doch, mach ihn rot. Dann hast Du ja diese diesen Satz drin und Gemini erkennt das halt und ersetzt das durch, hey, mach den Button rot. Also es erkennt sozusagen das vor und zurück und passt es dann an. Und was sehr, sehr für meine Use Cases gut ist, also wenn ihr's testen wollt, gibt's 'n Anti Gravity oder auch 'n, ich glaub, eine Geminar App und auf Android auch mittlerweile. Es hat zum einen Visual Kontext oder auch Textkontext. Das heißt, wenn Du in 'nem Editor bist und irgend einen File offen hast mit und Du hast ja meistens beim Programmieren verschiedene, das heißt irgendwie Pascale Case, Snape Case oder was auch immer. Und wenn Du dann sagst, hey, ich weiß nicht, Und hast Du ja oftmals als 2 Wörter und halt nicht als Funktion mit Snake Case und das wurde dann auch mit. Also es, ich hab mittlerweile Cases, wo ich 5 Minuten einfach reinrede und es halt wirklich anpasst basierend auf mein Projekt, wo ich bin, weil es halt den Projektkontext hat mit den ganzen Klassen und mit den Kommentaren und auch sieht, was ich aufm Bildschirm hab. Das heißt, wenn Du irgendwie dich korrigierst oder was anpasst, dann erhebt's das auch und kann man jetzt über API oder halt andere Gemini Produkte nutzen. Ist echt cool.
- Dennis
- Aber irgendwie eine universelle Mac App gibt's noch nicht dafür, ne?
- Philipp
- Ja, ja, doch. Hat 1 ausm Team gebaut, kann ich gerne oder können wir teilen. Ja, genau. Und dann ist so ähnlich wie Flow Visper, Super Visper oder wie auch immer das heißt.
- Dennis
- Ja. Ja, es
- Fabi
- ist mittlerweile Toolagnostisch haben wir's auch mittlerweile, also Whisper, Flow ist auch immer auf meinem iPhone. Ich mache mittlerweile alles nur noch Speech. Also Tech, also hippen ist wirklich outdated.
- Philipp
- Aber ich find's sehr viel besser. Also ich hab auch über die letzten Wochen das Voice Input von Code Code oder von Codecs genutzt oder auch Cursor. Die sind schon auch gut, aber die haben halt nicht dieses außen rum, dass es halt sich anpasst, dass wenn Du redest und dich selber korrigiert oder sagst, hey, warte mal, mach das doch nicht so, dass es halt nicht das Ganze jetzt Input hat, sondern halt das Processes sozusagen. Ja. Der Whisper of Flower war
- Fabi
- auf jeden Fall auch schon generell da 'n krasser Schritt, so, aber schon schon da hab ich schon häufiger jetzt auch noch Probleme mit so. Also der kriegt's auch gar relativ gut hin. Man hat immer das Gefühl so, der Kontext ist son bisschen größer und wenn ich mich irgendwie selbst korrigiere, passt das auch irgendwie an, aber auf jeden Fall wird's nicht komplett verändert. Cool, aber teil auf jeden Fall mal den Link, das würde
- Philipp
- ich gerne mal ausprobieren. Ja. Yes.
- Dennis
- Und dann mach doch grad noch weiter Philipp mit die.
- Philipp
- Genau, ich mein, Dennis hat ja vorher drüber geredet, ob man sich Hardware lokal kaufen kann. Vielleicht kann ich das bald. Nein.
- Dave
- Nee,
- Philipp
- also es geht dadrum, dass seit einigen Wochen News gibt, dass Nvidia Huggingface gern kaufen möchte und zwar für schlappe 13000000000 Dollar und was natürlich für alle Huggingface Mitarbeiter oder ehemalige Huggingface Mitarbeiter sehr cool klingt, Aktuell noch 'n Gerücht, aber die Gerüchte halten sich irgendwie. Also es hat zum einen der Information und Business Insider berichtet. Es gab jetzt gestern wieder irgend einen weiteres Gerücht, dass anstatt 13000000000, es sind 14000000000 mit irgendwie 'nem Retention Package. Das heißt, es gibt auf jeden Fall Verhandlungen und eventuell kauf ich mir dann bald son großen Mac, mal schauen.
- Dennis
- Und
- Fabi
- da runterrum zu probieren.
- Philipp
- Ja, weil dann kann ich mir Open Modelle von Higigface runterladen oder beziehungsweise Nvidia.
- Dennis
- Nvidia dann, ja. Nee, ist
- Philipp
- auf jeden Fall spannend, also es würd mich freuen. Es es scheint auch 'n relativ gutes Verhältnis sein. Ich mein, Nvidia stellt Grafikkarten her, nutzt Grafikkarten, Modelle laufen zu lassen. Das heißt, da ist irgendwie sone Art natürliche Synergie. Nvidia investiert sehr viel in Open Source und Open Modelle, deswegen
- Fabi
- Ich glaub, passt's auch, ne. Ist immer die Frage, ne, wenn natürlich dabei auch 'n bisschen mit Microsoft GitHub Übernahme und so, ist das jetzt so gut fürs Produkt. Ich würd auch schon sagen, Nvidia und Hackingface klingt nach 'nem ganz guten ganz guten Match. Aber auf jeden Fall große großes Multiple, wenn man überlegt, was im Moment grad der Umsatz von Hackingface ist und da muss halt irgendwie bisschen strategisch noch hinten dran sein, dann geht's 160 50000050 160, also irgendwie Faktor Aber
- Philipp
- ich mein, ist ja dasselbe wie bei GitHub. Also GitHub wurde damals für 9000000000 gekauft, wenn ich's richtig weiß von Microsoft und die wurden ja auch damals nicht gekauft wegen dem Umsatz, sondern es war ja die Plattform und die Community, die dahintersteht. Und wenn Du aktuell halt überlegst, okay, woher bekomm ich mein Modell oder wo kann ich Open Modelle nutzen und suchen, dann ist halt, es hat irgendwie es. Also es gibt keine Alternative so in dem Sinne, die sich irgendwie durchgesetzt hat oder die existiert. Klar, es gibt die ganzen API Provider und Inference Provider, aber so dieses Plattformkonstrukt an sich ist nur huging face, deswegen bleibt's auf jeden Fall spannend. Ich würd mich freuen, weil dann hätten Sie vielleicht, müssten nicht mehr auf dieses schauen, sondern könnten sich voll und ganz auf diesen Community Plattform Aspekt fokussieren, was ja natürlich dann auch Vorteile haben könnte.
- Fabi
- Ja, ich mein, da hat der Movein, ich mein ja auch bei vielen sieht man, dass sie dass sie großen Unternehmen irgendwie nach Plattformen im AR Bereich irgendwie suchen, Strippe mit Open Router, der die war ja auch 'n bisschen in die Richtung und hat zwar noch 'n bisschen mehr zum Businessmodell gepasst, aber war 'n bisschen klarer, was sie wie sie damit Geld verdienen wollen, aber ich glaub grundsätzlich irgendwie so Plattformen im Portfolio zu haben, die irgendwie mehr eine Rolle spielen.
- Philipp
- Ja, aber ich mein, wenn Die Ersten. Wenn Open Modelle zugänglicher und einfacher zu nutzen sind, dann brauchst Du mehr Grafikkarten. Und ja, ich mein Ja, definitiv.
- Fabi
- Ja. Natürlich, genau, wenn Du so rumsiehst, dann ist 'n Huggingface selbst nicht der Business Case, sondern 'n Teil von Ihrem ursprünglichen Business Case.
- Philipp
- Und zusätzlich vielleicht ganz noch kurz, HingFace hatte ja auch son Robotik, Slapp oder Idee, wo da gab's diesen
- Dennis
- spannender als diese komischen Da hab ich mir schon fast gedacht, ja, diese komische Beschreibung.
- Dave
- Immer noch bewährt, was soll.
- Philipp
- Ja, genau. Also es gab diesen Roboter, Regiey Mini hieß der. Das war son kleiner, wie sone Art Tischlampe, der den Kopf bewegen konnte und mit der er les reden konnte und 'n bisschen Kamera hatte. Und Sie haben jetzt Mini Duck, sorry, Micro Duck vorgestellt für 399 Dollar. Und Micro Duck ist wieder in der Kooperation mit, ich weiß es nicht genau, Popo Popo Popo. Ja, genau, Pollen Robo. Kann man sich jetzt schon bestellen. Wenn ihr's jetzt bestellt, erwartet 'n bisschen höhere Lieferzeiten, weil es wurden schon 10000 Stück vorbestellt. Man kann sich das son bisschen vorstellen wie 'n Roboter aus Star Wars, der aussieht wie eine kleine Ente. Und dieser Roboter kostet 400 Dollar, den kann man programmieren, man kann sogar darauf trainieren, wenn man möchte. Er hat 15 Akku Autoren, das sind, glaub, diese beweglichen Dinge, wenn ich's richtig weiß, hat leider Kameras, Lautsprecher, NFC, WLAN und Bluetooth. Das heißt, man kann sich mehr oder weniger ein komplett autonomes, autarkes Roboter Haustier halten, was dann zum Beispiel mit GMR Live gesteuert werden könnte oder mit Modelle über Websockets oder direkt auf dem Device. Und die, es gibt 'n Marketingvideo dazu, was schon sehr süß und sehr cool aussieht. Das heißt, wenn ihr euch irgendwie damit beschäftigt oder damit bauen wollt, dann ist ja zu empfehlen. Man kann den auch 'n bisschen anpassen. Also sie haben irgendwie gesagt, man kann so Rollosgate auch drunter machen. Er soll irgendwie 'n Ball schießen können, kann stillstehen und man kann halt wirklich damit experimentieren und arbeiten. Das heißt, Du kannst Modelle trainieren, die dann dem Modell versuchen, etwas beizubringen. Du kannst den Modell nutzen, Dinge aufzunehmen
- Dennis
- und dann halt weiter damit Dinge machen. Du kannst auch einfach erst mal 'n MHS schreiben, Wie man das Ding besitzt. Ist das richtig? Ja, ja, genau.
- Philipp
- MHS schreiben
- Dennis
- und gibt's wahrscheinlich schon jetzt.
- Dave
- Also, MHS ist ja schon Standard. Wir haben eine stetiger Standard im Datenbank kurz sehen.
- Philipp
- Könnt ihr vielleicht noch mal ganz kurz für die, die vorher abgeschaltet haben, was 'n MHS ist.
- Dennis
- Aber ich
- Fabi
- find, diese Minecraft sieht ja megasüß aus. Ich hab Ja, ja. Ich hatte kennt, kennt ihr diesen Benny Kamera AI Roboter, der bei Kickstarter auch grad superviel Kohle eingesammelt hat, wo's auch schon einige Youtube Reviews gibt so. Das vom ganzen Designer sieht der sauähnlich aus. Er hat auch aus wie sone kleine Ente oder so was. Das hat aber eigentlich so 2 Rollen und ist eher so gedacht, als Use Case so kameramäßig, ist so die GoPro als Roboter und kann den hinterherfahren und
- Dave
- da gibt's Videos davon. Das ist
- Fabi
- auch so geil, wie sich dieses Ding bewegt und irgendwie springen kann, Salto vorwärts Salto rückwärts Salto und sieht's, also hab mich 1 zu 1 dran erinnert, aber dieses Microdock sieht cool aus, muss ich mal angucken. Ja, wie
- Dave
- was war das Fabi? Benny Dinging? Benny.
- Fabi
- Bany. First altering Camera Roboter.
- Dave
- Jetzt guck
- Fabi
- dir mal das Video an der Leine. Der geht auch so richtig ab, ne? Der ist richtig schnell. Ja, ja, der ist sau schnell. Der kann richtig kann's richtig rennen und der rast hinter dir her, der hat halt Reifen, ne? Nicht so wie Microdoc hat ja, glaub ich, eher so viel Obwohl, das hat auch irgendwas Rollerskade mäßig.
- Philipp
- Ja, ja, es kann kannst Du auch. Also das ist der Gedanke dahinter ist halt einfach Robotics zugänglicher zu machen. Also nicht als Spielzeug, sondern wirklich als ich lerne dabei. Das große Thema war ja immer bei Roboter, da es generell mit Hardware ist, dass es extrem teuer ist. Also ich weiß nicht, wenn ich jetzt irgendwie Robotics, wenn ich die Start ups mir da anschaut, das sind ja Millionenbeträge, überhaupt reinzukommen. Und der Gedanke hier ist halt, okay, wie kann ich das zugänglich machen, dass ich schon mit Learning halt wirklich Projekte starten, Forschung machen kann, experimentieren, den einfach verbessern. Und wenn ich halt sone Technologie mehr Menschen zugänglich mach, dann steig zum einen das Interesse daran. Das heißt, dass wahrscheinlich sich mehr Leute damit beschäftigen, darin arbeiten möchte und man bekommt eventuell auch mehr noch Innovation. Die das Einzige, was ich schade find, ist, er kann sich nicht selber laden. Also Du hast die Akkus und musst die dann selber austauschen, weil es wär schon irgendwie cool, wenn, keine Ahnung, der würde rumlaufen und Du gibst ihm halt 'n System instruks und so von wegen, hey, Du bist microdoc, Du bist jetzt meine Katze, verhalte dich wie eine Katze. Und dann läuft er durch deine Wohnung und macht irgendwie was oder dann klingelt's plötzlich an der Tür und er rastet voll aus. Wär schon irgendwie cool, so weit sind wir noch nicht. Aber wenn euch das irgendwie interessiert, 93 US Dollar, ich weiß nicht genau, was das in Euros sind, 340 Euro, aber hat eventuell paar Monate Lieferzeit, wenn ihr denn jetzt bestellt.
- Fabi
- Ja, sieht auf jeden Fall cool aus. Das erinnert mich
- Dave
- an irgendwie an den nächsten Stufen von Lego Mindstorms.
- Dennis
- Da hat
- Dave
- er auch son Lego
- Philipp
- so mutig zugelegt zu sein. Oder Lego Technik für Erwachsene.
- Dave
- Genau Lego Technik irgendwie so was. Mindstorms. Ja, genau.
- Dennis
- Ja, bei Benny, das sieht halt auch mega cool aus, nur da muss man halt auch gleich wieder Sportler sein. Also also ich mein, da muss ich
- Dave
- immer cool Sachen machen. Dennis ist raus, Dennis ist raus.
- Dennis
- Skateboard fahren können oder irgendwie 'n ohne Cut mit dem spazieren gehst. Jetzt aber auch schnell laufen, oder? Alle Sachen, die ich nicht kann. Ja, oder
- Fabi
- Du lässt einfach nur Saltos machen und irgendwie scheiß drauf, dass er dich filmen kann.
- Dennis
- Ja, okay, aber dann dann lieber die Ente.
- Fabi
- Ja. Ja, ich find die halt Macodak find ich jetzt auch, find ich find ich cool.
- Philipp
- Ist 5 Cent 25 Zentimeter groß. Ja. Das ist riesig.
- Dennis
- Juli, dann würd ich sagen, sprechen wir noch über ein neues Modell. Und zwar nichts Geringeres als Fable 5 Punkt 1. Genau, das hat Anthropic gejobbt vor 1, 2 Tagen. Gestern. Und ja, wenn die Ist
- Dave
- auch in Folge raus,
- Philipp
- wenn die Newsfolge rauskommt. Ach so, wie werden die nicht mehr mittwochs releast?
- Dennis
- Ein, 2 Tage. Immer donnerstag. Donnerstag.
- Fabi
- Immer donnerstag, dass wir das so gut wissen.
- Dave
- Ja, ja, doch, wissen wir, wir sind Profis. Das ist die über fünfhundertste Folge.
- Dennis
- Über, über Donnerstags. Genau. Und ja, also da, einhergehend, wie früher auch, es gibt einen Metaphis 5 Punkt 1 und eine Fable 5 Punkt 1, die grundsätzlich die gleichen Modelle sind. Allerdings ist es so, dass bei Fable für die Allgemeinheit sind, was Security Sachen angeht. Das heißt, wenn ich irgendwie frage, hey, kannst Du das mal hacken? Dann sagt es, nein. Wohingegen Methhers das erlaubten, Methhers ist aber nur in einem sonem Zugangsprüf, diesem Project Glaswing, wo Unternehmen sich bewerben können, dass sie Zugriff auch auf dieses Modell bekommen. Ganz interessant fand ich noch, also neben den gleichen Details, die noch kommen, fand ich bis jetzt war es ja so, dass da eine andere Nutzungsbedingungen praktisch war bei den Modellen, weil dieses diese Einordnung, hey, ist das was gefährlich ist oder nicht, praktisch noch mal 'n Zwischenschritt auf den Servern war, was also dieses deine Trainingsdaten oder die Daten, die Du hast, bleiben komplett bei uns und so was mit dem Modell nicht so richtig funktioniert haben. Und wo Sie jetzt auch schon angekündigt haben, da wird es einen besonderen Modus für geben, dass dieser Part auf unternehmenskontrollierten Servern laufen dann zukünftig.
- Philipp
- Mhm. War das nicht nur auf den kontrollierten Servern, also im Sinne von, wenn Du Antropic über Amazon nutzt, dass es auf Amazon Servern ist? Wenn Du's Antropic über Google nutzt, ist es auf Google Server und nicht auf deinen eigenen Servern. Also ich
- Dennis
- hab so gelesen, lass mich ganz kurz, ob ich da hinkomme. Ich komm nicht so schnell darin, gleichzeitig zu reden.
- Philipp
- Wir können nachschauen. Du erzählst weiter.
- Dennis
- Genau und ja, ich mein, das hat jetzt erst mal grundsätzlich, also die die Tagline ist letztendlich, es ist besser und günstiger. Das heißt so, im Durchschnitt soll's 25 Prozent weniger kosten für einen normalen Workflow und was vor allen Dingen günstiger geworden ist, diese, dass wenn der Cash gelesen wird. Und dadurch kann es sein, wenn's jetzt grade so Sachen denn die laufen, dass die Kosteneinsparungen bis zu 45 Prozent sein können. Reaktion bis jetzt son bisschen gemischt. Also erst mal war, okay, ziemlich cool und krass und wenn man irgend 'n OPOS vorher genutzt hat, dann gibt's eigentlich nicht viel, was einen davon abhält, eher jetzt Fable 5 Punkt 1 zu seinem Standard zu machen. Zu dem Preispunkt, 'n paar Benchmarks, die so ausm Blauen heraus das getestet haben, waren dann doch sehr tokenintensiv und in dem Sinne dann auch wieder teuer. Ja, ich glaube, das muss ich noch 'n bisschen rauskristallisieren, zu welchem Zeitpunkt und wann es sinnvoll ist. Bei der Anthropic Subscription oder Cloud Subscription ist weiterhin so, dass da nur zu 50 Prozent, wie drückt man das eigentlich richtig aus, dass 50 Prozent der Inklusivnutzung auf das Model Modell laufen können. Ist das so richtig ausgedrückt?
- Dave
- Das begrenzt es darauf, richtig? Ja, ja, genau.
- Dennis
- Genau. Ja, und vielleicht darauf achten, dass man nicht die die Thinking Models auf besonders hochstellt, weil da potenziell es deutlich teurer wird, ohne die Leistung im gleichen Maße zu steigern. Also vielleicht eher mal Dinge in high oder ich weiß nicht, wie das darunter heißt aktuell, low. Medium. Medium high.
- Dave
- Aber immer noch günstiger als Opus 5, richtig?
- Dennis
- Ja. Ah, okay. Genau.
- Philipp
- Meinung dazu? Ich hab nur gelesen, dass es den Rekord gebrochen hat auf Artificialanalystes in Sachen Kosten pro Task. Also dass es das Teuerste ist mit irgendwie 8000 Dollar oder so, 8 Dollar? Ich weiß nicht. Also irgendwie dreißigmal teurer als das, was das aktuelle Gemini Modell macht. Aber dann natürlich für auch 'n ersten Platz auf den den Benchmark. Das heißt, wird wirklich spannend in Zukunft.
- Fabi
- Ja, 50000 Tokens pro Task im Vergleich 5, 6 Zoll hat 7 17000 zum Beispiel. Also auch mehr als Fable 5 nutzt es.
- Philipp
- Und Ja. Also würd, ich freu mich auf die ganzen Modelautos, weil nicht, dass Dennis weiterhin einfach zu schreibt hallo und dann kriegt er 'n Hallo zurück und hat wieder 4 Euro verbraucht. Und ich hab grad eben noch das hier in den Chat reingepostet. Ich glaub, wir können wir mit anpassen. Und ob ich halt gestern einen Blogpost noch mit released. Und da habe ich jetzt die Grafik, die ich gesehen hab. Das heißt, Du sendest 'n API Request und der geht in eine Box und die Box ist bezeichnen mit. Das heißt, worüber Du Cloud nutzt und deine Daten werden gespeichert auf der jeweiligen Infrastruktur. Das heißt, wenn Du Cloud über Antropic, über Amazon, Google oder Microsoft nutzt, dann werden deine Activity Data und es lebt scheinbar in deinem Cloud Account und wird verschlüsselt und hat irgendwelche Access Policies, wie auch immer. Auf jeden Fall kann Antropic darauf zugreifen und das dann klassifizieren und dann würde es zu antropic trotzdem geschickt. Das heißt, wenn Du's in der Cloud nutzt, wird's in deinem Cloud Account, wie auch immer gespeichert, aber antropic kann dann darauf zugreifen, wenn irgendwas wird. Aber auch dein Security Team bekommt Bescheid. Also es irgendwas zwischen Antropic stordes und ich stordes, klingt irgendwie, ich stordes. Ich kann's zwar nicht verhindern, aber Antropic hat trotzdem irgendwie Zugang darauf, was Ich weiß nicht, ob das 'n Unterschied jetzt macht für die Unternehmen. Okay. Also zumindest hört es sich, es las
- Dennis
- ich so, als ob es halt, wenn Unternehmen damit Probleme haben, dann soll das eine Lösung sein. Ja. Gut, das war doch knackig, oder? Ah, ist gar nicht so lang geworden. Jetzt wir haben ja immer noch ein Thema offen.
- Dave
- Haben wir das? Ja, irgend irgendwas mit mit Crogpots. Crogrockpots. Mit Crogpots. Ja, ich ich ich
- Philipp
- ich mach's mach's ganz kurz. Das sind sogar 3 kurze Themen. Zum einen hat gestern Meta Meta Muse Code vorgestellt. Ist eine neue Coding, ist so ähnlich wie Cloud Code, gibt Coding Pläne mit ab 5 Dollar, was die sehr großzügig sein sollen. Das heißt, wenn ihr irgendwas neues Codeing mäßiges ausprobieren wollt, OpenAI hat auch Hardware oder die ersten Sachen von ihrem Jalapenio veröffentlicht, was sehr krasse Performance zeigen soll. Also mal schauen, was da in der Zukunft noch auf uns zukommt. Warte, was
- Dave
- ist das? Jalapenio?
- Dennis
- Das hatten wir hier schon mal.
- Dave
- Und ganz kurz in 2 Sätzen für mich, was ist?
- Philipp
- Open AI baut eigene Hardware und Sie haben jetzt zu der eigenen Hardware die ersten Benchmarks, sag ich mal, veröffentlicht und zusätzlich gesagt, dass Kodex mehr oder weniger selbstständig Kernals geschrieben hat, dass Modelle schneller auf der Hardware laufen. Mhm. Trotzdem noch bisschen in der Zukunft. Ich glaub, das kommt auf jeden Fall noch mal. Und dann das Letzte, was mich 'n bisschen überrascht hat, dass es noch nicht kam, Curse wurde ja offiziell von SpaceX jetzt erklärt und den ersten Release, den Sie den Sie zusammen hatten, war Crok Bot. Ist so ähnlich wie, sieht aus wie iMessage. Ich kann mit verschiedenen Agenten schreiben. Wir haben, glaub ich, auch schon mal über geredet, wo ich ja in iMessage meinen Agenten hab, der son bisschen ist. Crok Bot ist dasselbe. Ich kann son Agenten definieren. Ich schreib mit dem, wie's so in iMessage. Das heißt, ich hab kein Streaming, sondern er sagt mir irgendwie, hey, okay, danke, ich arbeite daran und kommt dann irgendwann später mit so 'ner normalen Textnachricht zurück. Das große Neue hier ist, dass Du automatisch Cloud Agenten deploynen kannst. Das heißt, wenn Du zu deinem Crocbot sagst, hey, bitte arbeite an dem Cursor Projekt, startet das son Cursor Agent und Agenten können sich gegenseitig Nachrichten wenden. Das heißt, Du hast vielleicht son Chief of Staff, son Marketingwriter oder irgendjemand anderes, dann kannst Du sozusagen kannst Du zu dem einen Agenten sagen, hey, nutzt bitte mein Research Agent, der soll irgendwas tun, ne, dann noch irgendwas entwickeln und dann, wenn Du fertig bist, schreib mein Marketing Agent, dass der das irgendwie zusammenpackt und präsentiert und dann irgendwie Dennis eine E-Mail schreibt. Das heißt, Du hast sone Art Agent to Agent Kommunikation mit integriert. Die ersten Tests, die ich gemacht hab, sind echt cool. Also ist son für Nichtentwickler sehr cool auf jeden Fall, weil Du's son bisschen Person hast zuweisen kannst und dadurch, dass Du halt Textnachrichten hin- und herschickst, haben alle 'n neuen Kontext.
- Fabi
- Und das ist aber alles nur mit Grog Modellen, ne? Das ist nicht so das
- Philipp
- also es gibt kein Model Selektor und es gibt 'n paar Leaks, dass je nachdem, was für eine Task genutzt wird, auch zum Beispiel Champions wird. Also dass Du für zum Beispiel irgendwie, wo er irgendwas visuell an anschauen soll oder 'n Video oder so was, oftmals einfach zu Gemini geschickt wird. Das läuft alles irgendwie über das Curser Bag End, soweit ich's gecheckt hab. Natürlich ist viel Croc mit dabei, ist auch dabei oder andere. Es ist einfach wirklich eine, Anwendung kannst Du mit deiner oder nutzen, hast dies sone Art iMessage als App und es gibt auch eine Handy App und dann fängst Du einfach an. Also es gibt kein Onboarding, sondern Du schreibst die 1. Nachricht und das Onboarding ist mehr oder weniger Teil
- Dennis
- von dem Agenten. Und wie so rechte Management und Zugriff auf Sachen gehandelt? Weißt Du das?
- Philipp
- Du sagst deinem Bot, hey, kannst Du bitte Gmail hinzufügen? Dann kriegst Du eine kleine Karte, dann drückst Du auf die Karte und dann machst Du über o auf und dann hat er G Zugriff zu Gmail. Ist echt cool. Also sehr zu empfehlen, mal zu testen. Es geht auch mit der 20 Dollar Subskription. Hat man, klar, natürlich nicht so viel Usage, aber son bisschen reinzuschauen und bisschen Inspiration zu bekommen ist echt cool.
- Fabi
- Cool. Meine Möglichkeit mal mehr mit Grog Modellen rumzuprobieren, hab ich's echt wenig gemacht.
- Philipp
- 4 von 6 ist echt gut. Also
- Fabi
- Cool, noch eine Subscription, geil.
- Philipp
- Ja. Ich mein, ist ja nur 5 50 Prozent, da musst Du ja irgendwie die anderen 50 Prozent über die andere Subscription holen.
- Fabi
- An deren Ach, das ist das da aufhört.
- Dennis
- Gut, dann danke an euch alle, dass ihr dabei wart. Feedback Sehr gerne. An diese, wie immer an Podcast at Programmier Punkt bar oder über einen der Kanäle. Ja. Ach so, hast Du?
- Philipp
- Ja, wie
- Dennis
- immer. Konferenz. Wenn ihr eine coole Konferenz besuchen wollt, dann ist die Programmier von eure Konferenz am fünfundzwanzigsten, sechstensten November. Oh, haben wir schon die 100 Tickets geknackt? Noch nicht, aber bald. Kurz davor. Kurz davor. Meistens werden wir die Folge aufnehmen. Gehen wir raus und zack.
- Dave
- Aue, dann sind die 100. Ja. Nice.
- Dennis
- Macht's gut, ihr Lieben. Macht's gut in der Woche.
- Dave
- Tschau. Tschüs.
- Dennis
- Tschüs. Tschau.