Was mich an GPT 6 Astra bisher am meisten beeindruckt, ist immer noch die Fähigkeit von Computer Use. Im Gegensatz zu GPT 5.6, bei dem man früher noch etwas warten musste, bevor die verschiedenen Aktionen ausgeführt wurden, kann es jetzt sehr schnell und sehr präzise dabei helfen, meine App zu testen. Ihm beim Klicken zuzusehen, ist wirklich ein Vergnügen https://x.com/victornunez/status/2095975651094261777/video/1
Das bringt eigentlich den größten Vorteil mit sich: Es ermöglicht Agenten, einen vollständigen Kreislauf von der Entwicklung bis zur Abnahme zu bilden.
Stell dir vor, wie wir jetzt entwickeln: Nach Abschluss der Entwicklung gibt es immer noch viele Schritte, die manuell überprüft werden müssen, einschließlich des Testens von Live-Systemen. Dabei verlässt man sich meist auf Code-Operationen und End-to-End-Testframeworks wie PlayWright. Früher war Computer Use zwar auch nicht dazu unfähig, aber die Kosten waren vergleichsweise hoch, die Genauigkeit niedriger und die Geschwindigkeit nicht schnell genug.
GPT 6 könnte jedoch einen Wendepunkt für Computer Use erreicht haben: hohe Genauigkeit, hohe Geschwindigkeit. Bei den Kosten ist es derzeit zwar noch nicht gerade günstig, aber man kann davon ausgehen, dass sie in Zukunft weiter sinken werden.
Ich empfehle dir, es auszuprobieren: Wenn du GPT 6 Aufgaben zuweist, lass es selbst Computer Use verwenden, um die Tests und die Abnahme durchzuführen. Das kann deine manuelle Abnahmearbeit erheblich reduzieren.
Außerdem kannst du bei einigen früheren automatisierten Tests von Apps auch versuchen, GPT-6 Computer Use aufrufen zu lassen, um Szenarien abzudecken, die mit End-to-End-Testframeworks bisher nicht abgedeckt werden konnten oder deren Kosten zu hoch waren.
Das bringt eigentlich den größten Vorteil mit sich: Es ermöglicht Agenten, einen vollständigen Kreislauf von der Entwicklung bis zur Abnahme zu bilden.
Stell dir vor, wie wir jetzt entwickeln: Nach Abschluss der Entwicklung gibt es immer noch viele Schritte, die manuell überprüft werden müssen, einschließlich des Testens von Live-Systemen. Dabei verlässt man sich meist auf Code-Operationen und End-to-End-Testframeworks wie PlayWright. Früher war Computer Use zwar auch nicht dazu unfähig, aber die Kosten waren vergleichsweise hoch, die Genauigkeit niedriger und die Geschwindigkeit nicht schnell genug.
GPT 6 könnte jedoch einen Wendepunkt für Computer Use erreicht haben: hohe Genauigkeit, hohe Geschwindigkeit. Bei den Kosten ist es derzeit zwar noch nicht gerade günstig, aber man kann davon ausgehen, dass sie in Zukunft weiter sinken werden.
Ich empfehle dir, es auszuprobieren: Wenn du GPT 6 Aufgaben zuweist, lass es selbst Computer Use verwenden, um die Tests und die Abnahme durchzuführen. Das kann deine manuelle Abnahmearbeit erheblich reduzieren.
Außerdem kannst du bei einigen früheren automatisierten Tests von Apps auch versuchen, GPT-6 Computer Use aufrufen zu lassen, um Szenarien abzudecken, die mit End-to-End-Testframeworks bisher nicht abgedeckt werden konnten oder deren Kosten zu hoch waren.