• Liebe User, bitte beachtet folgendes Thema: Was im Forum passiert, bleibt im Forum! Danke!
  • Hallo Gemeinde! Das Problem leidet zurzeit unter technischen Problemen. Wir sind da dran, aber das Zeitkontingent ist begrenzt. In der Zwischenzeit dürfte den meisten aufgefallen sein, dass das Erstellen von Posts funktioniert, auch wenn das Forum erstmal eine Fehlermeldung wirft. Um unseren Löschaufwand zu minimieren, bitten wir euch darum, nicht mehrmals auf 'Post Reply' zu klicken, da das zur Mehrfachposts führt. Grußworte.

Wie nutzt ihr KI?

Mitglied seit
15.09.2000
Beiträge
1.813
Reaktionen
436
Die Verschwörungstheorie halte ich hier für weit hergeholt.

Hugging Face hat das den Angriff ja schon vor ner Woche publiziert, jetzt hat OpenAI eingestanden, dass sie das (versehentlich) waren.

Wenn dann müssten sie den Angriff schon absichtlich gestartet haben. Das wäre aber halt schon auch einfach eine klare Straftat der Beteiligten Personen mit dem Risiko von langen persönlichen Haftstrafen in den USA. Ausserdem gibt der Vorfall denen die Regulierung fordern massiven Rückenwind. Für nen PR Stunt für nen Börsengang, will man schon auch zeigen, dass man Kontrolle über sein System hat.
 
Mitglied seit
31.03.2001
Beiträge
27.503
Reaktionen
618
Wenn dann müssten sie den Angriff schon absichtlich gestartet haben. Das wäre aber halt schon auch einfach eine klare Straftat der Beteiligten Personen mit dem Risiko von langen persönlichen Haftstrafen in den USA. Ausserdem gibt der Vorfall denen die Regulierung fordern massiven Rückenwind. Für nen PR Stunt für nen Börsengang, will man schon auch zeigen, dass man Kontrolle über sein System hat.
Das traurige ist das es so oder so eine Straftat sein sollte...wenn deine AI strafbare Dinge tut und du sie nicht unter Kontrolle hast, sollte das nicht einfach nur ein oopsie sein.

Ansonsten könnte man das natürlich auch lesen als "vielleicht haben wir Skynet bereits erschaffen" :mond:
 
Mitglied seit
15.09.2000
Beiträge
1.813
Reaktionen
436
Naja, es ist am Ende kein wirklicher Schaden entstanden. Huggingface hatte etwas Aufwand, aber dafür haben sie jetzt auch zahlreiche Sicherheitslücken geschlossen. Jetzt werden sie von OpenAIentschädigt und für Huggingface ist die Aufmerksamkeit sicherlich hilfreich. Ohne Vorsatz und ohne Schaden ist es dann auch keine Straftat mehr, es braucht schon das eine oder das andere.

Perspektivisch ist das strafrechtlich natürlich eine andere Frage. Früher oder später wird ernsthafter Schaden entstehen. Wer haftet für eine selbstständing agierende KI? Hier ist der Fall noch klar, da die gleiche Firma das Model trainiert hat, die Datacenter hostet und die Prompts (Skills) eingab. Aber was wenn das 3 verschiedene Akteure sind und alle einen Teil beitragen, dass die KI ausser Kontrolle gerät? Wer ist dafür verantwortlich das unter Kontrolle zu haben?
 

Shihatsu

Administrator
Mitglied seit
26.09.2001
Beiträge
50.580
Reaktionen
10.641
Nur sagt das halt absolut niemand im Gegensatz zu dem anderen. ;)
Dazu hätte ich gerne einen Quote.

Edit: Und am liebsten auch etwas temporalen und kausalen Kontext.
Hier kann ich den gerne liefern: "Wir testen unser multi-Agenten-KI-Modell, das wir darauf trainiert haben Exploits zu finden, in einer Sandbox. Mit Zugang zum Internet. Und sind ÜBERRASCHT das unsere KI da raus kommt. MAGIE!" ... Ich glaub den Fehler muss ich nicht erklären.
 
Zuletzt bearbeitet:
Mitglied seit
31.03.2001
Beiträge
27.503
Reaktionen
618
Naja, es ist am Ende kein wirklicher Schaden entstanden.
Es ist kein Schaden entstanden von dem man weiß. Huggingface hatte zumindest genug Security um es zu merken...vielleicht hat OpenAI ja auch noch andere Firmen gehackt die das nur nicht klar auf OpenAI (oder auch nur "eine KI") zurückführen konnten.
Nur sagt das halt absolut niemand im Gegensatz zu dem anderen. ;)
Naja wir haben zumindest den Teil der User die selbst nie Probleme benennen und alle von anderen benannten hand-wavy wegwischen wollen mit irgendwelchen Ausreden. Klar kann man jetzt die Ausrede versuchen, dass die ja vermutlich nie wortwörtlich gesagt haben "Es gibt keine Probleme!" :mond:
 
Mitglied seit
25.09.2014
Beiträge
5.373
Reaktionen
1.501
Dazu hätte ich gerne einen Quote.

Edit: Und am liebsten auch etwas temporalen und kausalen Kontext.
Hier kann ich den gerne liefern: "Wir testen unser multi-Agenten-KI-Modell, das wir darauf trainiert haben Exploits zu finden, in einer Sandbox. Mit Zugang zum Internet. Und sind ÜBERRASCHT das unsere KI da raus kommt. MAGIE!" ... Ich glaub den Fehler muss ich nicht erklären.
Ich soll dir jetzt Quotes raussuchen, in denen Leute die Fähigkeiten von AI bezweifeln und das Ganze als Hype abtun? :eek3:

Was den Vorfall angeht: Ich habe mich da jetzt mit den Details noch nicht beschäftigt und werde sicherlich den angekündigten Report überfliegen, wenn er da ist.
Aber, ehrlich gesagt, durchschaue ich die Sicherheitsphilosophie, die du andeutest, nicht so ganz: Wenn wir mal unterstellen, dass das Ziel ist, extrem fähige Modelle in die freie Anwendung zu bringen, auf welchem anderen Weg würdest du das erreichen, wenn nicht sie fortwährend unter möglichst anwendungsnahen Bedingungen zu testen und das schrittweise mit jeder neuen Modellgeneration?

Letztlich ist es ein Trade-off auch zwischen Sicherheit und Geschwindigkeit in der Entwicklung.
Da bessere Modelle einen großen Benefit versprechen, sehe ich grundsätzlich aber nicht weshalb maximale Sicherheitsstandards, trivialerweise der richtige Weg, sind. Totale Sicherheit ist ohnehin eine Illusion: Irgendwann willst du diese Modelle ja einsetzen und du kannst ihnen nur Kompetenzen übertragen, die sie auch technisch ausfüllen können.
Da würde ich grundsätzlich vorziehen, dass man die Grenzen dessen, wozu die Modelle fähig sind, im Guten wie im Schlechten, bereits in der Entwicklung austestet, bevor sie allgemein verfügbar sind.
 
Zuletzt bearbeitet:
Mitglied seit
15.09.2000
Beiträge
1.813
Reaktionen
436
Dazu hätte ich gerne einen Quote.

Edit: Und am liebsten auch etwas temporalen und kausalen Kontext.
Hier kann ich den gerne liefern: "Wir testen unser multi-Agenten-KI-Modell, das wir darauf trainiert haben Exploits zu finden, in einer Sandbox. Mit Zugang zum Internet. Und sind ÜBERRASCHT das unsere KI da raus kommt. MAGIE!" ... Ich glaub den Fehler muss ich nicht erklären.

Laut Aussage von OpenAI hatte das Model in der Sandbox keinen Internetzugang, sondern hat einen ZeroDay Exploit in der SandboxSoftware gefunden.

Oder meinst Du physischen Zugang zum Internet? Ist das in modernen Datacenters überhaupt noch möglich nen Cluster effektiv vom Netz zu nehmen indem man alle Kabel aussteckt und im Anschluss noch sinnvoll zu betreiben?

Hier noch paar mehr Details zur Story:

 

Shihatsu

Administrator
Mitglied seit
26.09.2001
Beiträge
50.580
Reaktionen
10.641
Ja, das ist nicht nur möglich, sondern in den Prozessen auch explizit vorgesehen und abgebildet. LLMs sind am Ende des Tages Recht ähnlich zu Hyperscalern aufgebaut. Alles ist modular, alle ist redundant, alles ist darauf ausgelegt zu funktionieren wenn irgendwelche Dinge nicht so tun wie sie sollen. Es ist nicht nur möglich sondern immer wieder vorgesehen einzelne Teile (vulgo: Racks, Räume, Komponenten) von Netzen zu trennen. Zu den Netzen gehören auch "Das Internetz".
Wenn ich etwas testen will, das Exploits ausnutzt, dem ich beigebracht habe aus Sandboxen auszubrechen, dann mach ich das entweder Air-Gapped oder stümpere rum. Es gibt da kein Grau. Entweder man macht das Air-Gapped oder eben nicht, und macht man sowas nicht ist man Dum.
 
Oben