You are viewing a single thread.
View all comments
2 points
*

Oh, das jetzt aber gar nicht einmal so gut.

Wo trainiere ich dann bitte meine speech to text modelle? Also nicht ich sondern openai bspw…

Wenn man Stille in einer Aufnahme hat und whisper rüber jagt hat man oft copyright Angaben von öffis, die Existenz dieser Artefakte weißt darauf hin das ein größerer teil der Daten aus diesen Quellen stammt.

https://github.com/openai/whisper/discussions/928

Ironisch wie der Einsatz von “ki” trainingsdaten vergiftet. Das fühlt sich ein wenig an wie der stahl aus schiffen vor den Atombombentest: pre-AI-Data .

Oder kurzum, besser als jetzt werden die Trainingsdaten nie gewesen sein

permalink
report
reply

DACH - jetzt auf feddit.org

!dach@feddit.de

Create post

Diese Community wird zum 01.07 auf read-only gestellt. Durch die anhäufenden IT-Probleme und der fehlende Support wechseln wir als Community auf www.feddit.org/c/dach - Ihr seid herzlich eingeladen auch dort weiter zu diskutieren!

Das Sammelbecken auf feddit für alle Deutschsprechenden aus Deutschland, Österreich, Schweiz, Liechtenstein, Luxemburg und die zwei Belgier. Außerdem natürlich alle anderen deutschprechenden Länderteile der Welt.

Für länderspezifische Themen könnt ihr euch in folgenden Communities austauschen:

Eine ausführliche Sidebar findet ihr hier: Infothread: Regeln, Feedback & sonstige Infos

Auch hier gelten die Serverregeln von https://feddit.de !

Banner: SirSamuelVimes

Community stats

  • 1

    Monthly active users

  • 6.1K

    Posts

  • 76K

    Comments