Publikation von Christoph Puppe
ChatGPT o1: Sun Tzu, moderne IT-Sicherheit und die Rolle der Hyperscaler
Erster Teil eines Zweimodell-Experiments: Dieselbe Aufgabe, Sun Tzus Lehren auf IT-Sicherheit und die Hyperscaler anzuwenden, ging an ChatGPT o1 und Gemini 2.0. Die o1-Fassung arbeitet die Parallelen sauber ab: Selbsterkenntnis als Asset-Inventar, Feindeskenntnis als Threat Intelligence, Täuschung als Honeypot, dazu die doppelte Rolle der Hyperscaler mit dem falsch konfigurierten S3-Bucket als Pointe. Der Wert liegt im Vergleichsformat: Es zeigt, wie unterschiedlich zwei Frontier-Modelle dieselbe Aufgabe anlegen, und nimmt die Bewertungsfrage vorweg, die whoami-bench später systematisch stellt.