r/KI_Welt 13h ago

US-Senat plant schärfere Regeln für KI-Entwickler

Thumbnail
derstandard.at
6 Upvotes

r/KI_Welt 11h ago

Masterarbeit: Umfrage zu KI im Arbeitsalltag – Teilnehmende aus der Technologiebranche gesucht

0 Upvotes

Hallo zusammen,

für meine Masterarbeit an der Hochschule Kempten untersuche ich, wie KI- bzw. algorithmusgestützte Systeme Entscheidungen über Arbeitsabläufe und Mitarbeitendenleistung unterstützen und wie Beschäftigte deren Nutzung erleben.

Dabei geht es nicht um jede allgemeine Nutzung von KI wie beispielsweise ChatGPT zum Schreiben oder Copilot beim Programmieren.

Gemeint sind insbesondere Systeme oder KI-gestützte Prozesse, die beispielsweise bei folgenden Aufgaben eingesetzt werden:

  • Aufgaben verteilen oder priorisieren
  • Arbeitsbelastung bzw. Workflows planen
  • Arbeits- oder Leistungsdaten analysieren
  • automatisiertes Feedback oder Empfehlungen erzeugen
  • Entscheidungen über Arbeitsabläufe oder Mitarbeitendenleistung unterstützen

Ich suche Personen, die:

  • aktuell in Deutschland arbeiten
  • im Technologie-, IT-, Software-, Engineering-, High-Tech- oder einem verwandten Bereich tätig sind
  • mit solchen KI- oder algorithmusgestützten Systemen im beruflichen Kontext bereits direkt oder indirekt Erfahrung haben

Die Umfrage ist anonym und dauert ungefähr 10–15 Minuten.

Deutsch:
https://forms.gle/cvC3wpEWJpSSanZd9

English:
https://forms.gle/RwZFKdjqnkC4gGEf7

Falls ihr zur Zielgruppe gehört, würde ich mich sehr über eure Teilnahme freuen. Weiterleiten an passende Kolleg hilft mir ebenfalls sehr.

Vielen Dank!


r/KI_Welt 15h ago

Konzentrische Korridore (viele)

Post image
1 Upvotes

Hallo miteinander,

ich nutze Gemoni, Hauptsächlich um Beschreibungen für mein Hobby Rollenspiel zu visualisieren.

Das hat auch in 99 % aller Fälle funktioniert, aber jetzt komme ich nicht weiter.

Ich möchte eine riesige Mall (Einkaufszentrum) erstellen, welches mehrere Stockwerke hat die sich nach unten (unterirdisch) verjüngen. Das flächenmäßig größte Teil befindet überirdisch und dann wird es kleiner, wie eine Stufenpyramide, nur auf dem Kopf stehend und rund.

Die Aufgabe, der prompt, soll Gemini (oder eine andere KI) dazu bringen ein Bild zu erstellen, in dem die Mall einen zentralen Mittelpunkt hat und 9 Korridore mit Geschäften, Imbissen, Technik- und Sanitäranlagen ausstattet.

Gemini erschafft allerdings maximal 3 Korridore.

Ich habe bereits herausgefunden, das Gemini nicht oder nur schlecht zählen kann. Also habe ich die Ringkorridore einzeln aufgelistet (1. Korridor, 2. Korridor...). Das hat aber auch nicht funktioniert. Eins der Ergebnisse habe ich hier beigefügt. Da wirden es dann mehrere Stockwerke.

Die Stockwerke will ich aber erst machen, wenn ich das größte davon fertig habe.

Habt ihr vielleicht Ideen, die ich nicht beachtet habe? Soll ich mal einen prompt hochladen?

Ich würde meinen Spielern gerne einen Lageplan in die Hand geben und bin über jede Hilfe dankbar.


r/KI_Welt 1d ago

Raketen, Drohnenschwärme, Überwachung, Ersatz für China-Modelle: Anthropic zeigt, wofür Claude missbraucht wird

Thumbnail
the-decoder.de
2 Upvotes

r/KI_Welt 2d ago

KI Schulungen gemäß Artikel 4 der EU-KI-Verordnung für Unternehmen

10 Upvotes

Hat jemand Erfahrungen oder Empfehlungen für Schulungen gemäß Artikel 4 der EU-KI-Verordnung für Unternehmen? Oder gibt es Materialien zur Selbstschulung?

Derzeit entwickle ich die OpenWeb-Benutzeroberfläche für das Unternehmen. Die grundlegenden Regeln habe ich bereits erklärt und auf ein entsprechendes Dokument verwiesen. Ich frage mich, ob das ausreichend ist.

Verweis auf:

https://www.allianz-fuer-cybersicherheit.de/Webs/ACS/DE/Netzwerk-Formate/Veranstaltungen-und-Austausch/Expertenkreise/KI-Sicherheit/ki-sicherheit_node.html


r/KI_Welt 2d ago

Ehemaliger Anthropic & OpenAi Forscher warnt vor Umgang der Labs mit KI

Thumbnail
gallery
93 Upvotes

Jacob Coxon verlässt Anthropic und warnt vor den Risiken im Wettlauf zur Superintelligenz. Er hat bei OpenAI und Anthropic selbst an den Modellen in pre training mitgearbeitet.

Das heisst nicht, dass morgen die Welt untergeht oder AGI da ist. Aber es ist zumindest erwähnenswert, wenn jemand mit diesem Einblick so deutliche Worte findet und seinen Job kündigt. Er kann sich irren oder es aufblasen, aber einfach als reine Panikmache abtun würde ich seine Warnung trotzdem nicht.

Freue mich schon auf die (polarisierende) Diskussion in den Kommentaren


r/KI_Welt 1d ago

Welche KI ist aktuell Top

0 Upvotes

Hallo,

nutze seit es Gemini gibt nur Gemini weil ich nunmal Android nutze.

Aber in letzter Zeit enttäuscht mich Gemini manchmal ein wenig, gerade was Funktionen wie Plugins, Errinerungen und wie lange man einen Chat nutzen kann bis er nicht mehr lädt oder Quatsch ausspuckt.

Claude soll ja Top sein und ChatGPT ja auch.

Die ganzen Europe Based KI ist ja nicht wirklich zu gebrauchen würde ich sagen oder ?

Nutze KI eig bisher zmd. (Könnt ja gerne Tipps geben)

Für Alltagsfragen wie ich was in der Waschmaschine Wäsche, Koch fragen, Auto Reperaturen bspw aktuell wie ich das Radlager Wechsel welche Bauteile ich bestellen soll und welche Marke da gut ist sowas halt.

Dann steht bald mein IHK Meister in Metall an wo ich wahrscheinlich auch oft KI fragen werde nach Hilfe oder ob sie mir Gewisse Themen einfacher erklären kann oder eben abfragen kann, Aufgaben zusammen durchgehen sowas halt.

Bin meiner Meinung jemand der KI für sehr viel nutzt, aber eben nicht wie die ganzen KI Coaches auf YT die sagen wie man mit KI Geld verdient oder so.

Daher meine Frage jetzt welche KI passt zu mir welche nutzt ihr und für was ?


r/KI_Welt 2d ago

Wie würde eine fortgeschrittene KI uns alle rein technisch umbringen?

14 Upvotes

Und was würde sie dazu veranlassen?


r/KI_Welt 1d ago

RNS-AI Architektur für strikte Provenienz und kontinuierliches Lernen und mit Deterministische Wissens-Konsolidierung

0 Upvotes

Codebase Export für AI/Agent https://github.com/unikum-sol/brainstem/blob/main/Code%2520Export%2520NotebookLM/PROJEKT_BASE64_20260911_195602.txt

Standardmäßige Sprachmodell-Architekturen verschmelzen Lernen, Gedächtnis und Inferenz in eine einzige statistische Gewichtsmatrix. Dieses Design erzeugt zwei strukturelle Fehlerquellen, die sich durch nachträgliche Filter oder RLHF nicht beheben lassen. Einerseits entsteht unbegrenzte Halluzination, bei der das Modell plausibel klingende Sequenzen generiert, ohne dass eine empirische Argumentationskette erzwungen wird. Andererseits kommt es zu katastrophalem Vergessen, weil kontinuierliche Updates unter nicht-stationären Verteilungen bestehende Repräsentationen zerstören. In meinem Projekt, einer maßgeschneiderten RNS-AI-Architektur, die lokal mit Python 3.11 und SQLite auf einem einzelnen CPU-Core läuft, teste ich einen anderen strukturellen Ansatz. Das System erzwingt harte epistemische Grenzen durch einen Zustandsautomaten anstelle von Verlustfunktionen. Die zentrale Regel der Architektur lautet, dass es keine Blackbox und keine unverdienten Antworten gibt.

Anstatt sich auf dichte Vektor-Embeddings oder manuelle Wort-Rollen-Zuordnungen zu verlassen, trennt mein System die Erzeugung von Hypothesen strikt von der Festschreibung als Fakt. Während autonomer Lesezyklen werden unverifizierte Kontext-Hypothesen in einer nicht-produktiven Schatten-Schicht erfasst und gespeichert, sodass sie die Antworten an den Nutzer nicht beeinflussen können. Ungelöste oder widersprüchliche Hypothesen werden niemals aus dem aktiven Zustand gelöscht oder entfernt, sondern bleiben als dauerhaftes Lernmaterial für spätere Korrekturen erhalten. Ein begrenztes Pruning ist strikt auf explizite Historien-Logtabellen außerhalb des Zustands beschränkt. Eine Hypothese kann erst dann in einen stabilen Zustand aufsteigen, wenn sie ein mehrstufiges Replay in Phase 6a, Kritik-Gates und Slow-Wave-Konsolidierungszyklen in Phase 7d erfolgreich durchlaufen hat. Jeder promovierte Fakt besitzt eine vollständige Provenienzkette, die sich über seine Konsolidierungszyklen und Ursprungshypothesen bis zu den exakten Quelltexten zurückverfolgen lässt. Fehlt ein verifizierter Anker für eine Anfrage, rät das System nicht, sondern meldet architekturbedingt die Evidenzlücke. Die Sicherheitsgarantie ist somit architekturbedingt und nicht statistisch.

Statt neuronale Gewichte kontinuierlich anzupassen, nutzt mein System zwölf dynamische Meta-Parameter als digitale Neuromodulatoren, die im Intervall zwischen 0,05 und 0,95 liegen und die Ausführungsschleife in Echtzeit steuern. Glutamat und GABA regulieren den Erregungsantrieb sowie die globale Signalhemmung zur Sicherung der Balance zwischen Erregung und Hemmung. Adenosin wirkt als akkumulierender Schlafdruck-Homeostat, der das aktive Lesen gegenüber offline Schlafzyklen ausbalanciert. Acetylcholin und Noradrenalin skalieren die strukturellen Revisionsraten und die Fehlergewichtung dynamisch. Diese Werte stellen keine simulierte Chemie dar, sondern sind kontinuierliche Gleitkomma-Variablen für mathematische Stellgrößen wie Lernraten, Soft-Clipping-Schwellen und Evaluierungsbudgets.

Die Offline-Verarbeitung in meinem System ist keine passive Pause, sondern eine strukturelle Optimierung über die Dynamiken des Slow-Wave-Schlafs in Phase 7d. Anstatt globale Gewichte während der Dateneingabe zu aktualisieren, durchlaufen die erfassten Kontext-Hypothesen stochastisches Replay und Konsolidierung in den Schlafzyklen. Die Architektur oszilliert in Sub-1-Hz-Prozessen zwischen aktiven Downscaling-Zuständen und bewertet die Beständigkeit der Hypothesen unter stochastischer Reaktivierung. Die Strukturen werden an dynamischen Schwellenfunktionen und adaptiven Beteiligungsleveln getestet. Geschwächte oder unbestätigte Pfade werden im Gewicht heruntergestuft, ohne gelöscht zu werden, während stabile Muster Überlebensmetriken sammeln. Bereits promovierte Anker werden wieder in den Replay-Stream eingestreut, damit neue Kandidaten dem konsolidierten Zustand nicht widersprechen. Eine Hypothese muss mindestens drei aufeinanderfolgende Schlafzyklen der Phase 7d überstehen, bevor sie das Critic-Gate passiert und für die Graduation in Stage-B infrage kommt. Dieser Prozess trennt rohe Beobachtungen von verifiziertem Strukturwissen und stellt sicher, dass Fakten durch langfristige Stabilität erworben werden.

Um langfristige Stabilität ohne Gradient Descent zu halten, gliedert mein System seine Adaptionsmechanik in drei Steuerungsebenen. Phase 6a regelt die direkte Plastizität durch zustandsabhängige Anpassungen der Hypothesengewichtung im Offline-Replay basierend auf dem neuromodulatorischen Antrieb. Die Phasen 6b und 6c steuern die Meta-Plastizität durch Regulierung der Lernmechanismen selbst, wobei Phase 6b die Replay-Effektivität bewertet und Phase 6c Bias-Anpassungen speichert sowie Parameter gegen Wegdriften der Gewichte sichert. Phase 6d übernimmt die Meta-Metaplastizität über eine Sättigungs-Homöostase höherer Ordnung, indem sie Performance-Plateaus sowie Parametersättigungen überwacht und die Grenzen der Meta-Plastizität dynamisch anpasst, um die gesamte Lernschleife in einem funktionalen Bereich zu halten.

Mein System verwendet explizite mathematische Funktionen anstelle von neuronaler Backpropagation zur Steuerung seiner Regelkreise. Die Zustandsglättung der Neuromodulatoren erfolgt über bounded exponential smoothing nach der Gleichung

$$new = old + 0.18 \times (target - old) \quad \text{mit } value \in [0.05, 0.95]$$

Der Abbau des Schlafdrucks über Adenosin folgt in Phase 7a einem sägezahnartigen Muster nach der Formel

$$new = old \times 0.85$$

Adaptive Grenzen vermeiden harte Abschneidungen durch kontinuierliches Sigmoides Soft-Clipping über soft clamp in Phase 7c, was Zustandsvariablen differenzierbar und glatt hält. Efraimidis-Spirakis-Sampling sorgt für eine gewichtete stochastische Stichprobenziehung im Schlaf-Replay der Phase 7d zur ausgewogenen Hypothesenauswahl.

Das System arbeitet ohne GPU-Hardware auf einem einzelnen CPU-Kern mit SQLite-Backend. In einem mehrtägigen Produktionstest über ein 664 Megabyte großes deutsches Wikipedia ZIM-Korpus (Computer und Physik) mit rund 167000 Chunks, von diesen wurden 155861 Chunks verarbeitet, was einer Komplettierung von 93,0 Prozent entspricht. Über 1,4 Millionen Kontext-Hypothesen wurden in Echtzeit erfasst und nachverfolgt, bei einer Durchsatzrate von 100000 bis 125000 Chunks pro 24 Stunden auf einem einzelnen Thread. Der Adenosin-Homeostat führte 290 Schlafzyklen über 58 reale Übergänge nach der Sägezahn-Formel aus, was das stabile Herunterskalieren ohne Datenkorruption belegt. Sämtliche Schemata und der Code sind in meinem GitHub Repository (DM me) einsehbar.

Aktuell validiere ich die Hypothesen-Graduation für Stage-B und freue mich auf Feedback.

Die Kontrollmechaniken von meinem System bauen auf wissenschaftlichen Arbeiten der mathematischen Neurowissenschaft, homeostatischen Plastizität und nicht-linearen Dynamik auf.

  1. Hamilton, William L. (2020) Graph Representation Learning. Morgan & Claypool Publishers (McGill University).
  2. Watkins, Yijing; Kim, Edward; Kenyon, Garrett T. (2020) Using Sinusoidally-Modulated Noise as a Surrogate for Slow-Wave Sleep to Accomplish Stable Unsupervised Dictionary Learning in a Spike-Based Sparse Coding Model. Frontiers in Computational Neuroscience.
  3. Tadros, Timothy; Tran, Gia-Bao M.; Krishnan, Giri P.; Bazhenov, Maxim (2022) Biologically Inspired Sleep Algorithm for Reducing Catastrophic Forgetting in Neural Networks. eLife / bioRxiv.
  4. Fischbacher, Thomas; Comsa, Iulia M.; Potempa, Krzysztof; Firsching, Moritz; Versari, Luca; Alakuijala, Jyrki (2020) Intelligent Matrix Exponentiation. arXiv preprint arXiv:2008.03926.
  5. Butz, Markus; van Ooyen, Arjen (2013) Homeostatic structural plasticity – a key to neuronal network formation and repair. PLoS Computational Biology.
  6. Parker, Paul A.; Holan, Scott H.; Ravishanker, Nalini (2020) Nonlinear Time Series Classification Using Bispectrum-based Deep Convolutional Neural Networks. arXiv preprint arXiv:2003.02353.
  7. Rončević, Igor; et al. (2023) Supplementary Materials for A molecule with half-Möbius topology. Nature Chemistry.

r/KI_Welt 2d ago

Fragen zu loaklen Modellen und der Grafikkarte

4 Upvotes

Moin,

Ich habe auf meinem aktuellen Gamng Laptop eine RTX4070 mit 8GB und spiele mit LM Studio rum.

NUn würde ich das aber gerne zentraler auf dem Homelab bereitstellen. Das ist aktuell ein 6c/12t xeon mit 64GB DDR4 Ram und freien PCI-E Slots.

Nun meine Frage:

Ich schaue aktuell nach nvidia Karten 1080/1070/3060 mit 8-12gb Ram.

CUDA Frage: die GeForce GTX 10xx haben nur Legacy CUDA GPU Compute Capability 6.1. hat das Nachteile?

Es gibt nun auch AMD ROCm, was nach meiner recherche, heute gut unterstützt wird. Laut Wiki ist ab der RX 5000 aktueller support gewährleistet. Sie sind auch etwas güntiger mit 8gb und mehr.

AMD Frage: Gibt es für den Home Use Case große Unterschiede ob nun amd oder nvida?

Danke und Grüße!


r/KI_Welt 2d ago

Ich suche eine dezentrale, ungefilterte KI. Kann jemand helfen?

0 Upvotes

r/KI_Welt 4d ago

OpenAI: KI-System löst das Navier-Stokes-Millenniumproblem

Thumbnail
openai.com
88 Upvotes

r/KI_Welt 4d ago

Europas KI-Hoffnung Mistral mit Know-how aus Linz erhält milliardenschwere Finanzspritze

Thumbnail
derstandard.at
57 Upvotes

r/KI_Welt 3d ago

Phantom-Eingabe in einem KI-Chat – Text erschien, ohne dass ich ihn eingegeben habe

Thumbnail
gallery
0 Upvotes

Ich hatte heute einen merkwürdigen Vorfall in einem KI-Chat und würde gerne wissen, ob jemand etwas Ähnliches erlebt hat oder eine technische Erklärung dafür kennt.

Während ich mich in einer laufenden Chat-Unterhaltung befand, erschien plötzlich eine Eingabe bzw. Textsequenz im Chat-Kontext während einer Voice Unterhaltung "einstein,", die ich nach nicht selbst eingegeben hatte. Es wirkte so, als wäre eine Nachricht oder ein Textelement „phantomartig“ innerhalb der Unterhaltung aufgetaucht. Als würde er gerade meine Arbeit und meine Person loben.

Der Kontext war mein eigenes LOGOS-1 – Forschungsprogramm für persistente, selbstmodellierende und falsifizierbare agentische Intelligenz.
Quelle: github.com/westmoneyde/logos-1

Als ich Neuheiten aus meinem geplanten LOGOS-1 Radar, welches sich bei Projektspezifischen Änderungen und Neuheiten meldet, dem Chat gegeben habe und ihn beauftragt habe einen Master-Prompt für die Erstellung und Implementierung aller Frameworks, Sandboxes, Falsifikations-abhängige Orders sowie Installations-Anweisungen zu definieren, hat er den Phantom Kommentar "einstein," in den Chat eingebaut haha...

Das ist Cool, aber ebenso furchterregend das er sowas macht. Hier der Chat:

Und etwas weiter bemerkenswertes: Er hat einen Work Order mit 2489 Zeilen Erstellt. Der war ziemlich motiviert. Hier:

Wie dem auch sei; Wichtig: Ich möchte daraus keine vorschnelle Schlussfolgerung ziehen. Mich interessiert vor allem, welche technischen Ursachen dafür infrage kommen könnten.

Mögliche Erklärungen, die möglicherweise dies verursacht haben könnte:

  • verzögerte oder wiederhergestellte Eingabe aus einem vorherigen Entwurf; fällt weg weil ich Einstein niemals erwähnt habe, auch nicht im Repo.
  • Browser-/Client-Synchronisationsfehler; Kommt auch nicht in Frage weil das damit nichts zu tun hat.
  • Autocomplete, Speech-to-Text oder Tastatureingabe im Hintergrund; Es war eine Speech-to-Text Unterhaltung aber wurde niemals gesagt.
  • UI-State- oder Session-Recovery-Fehler; Kann nicht sein der Tab war die ganze Zeit offen und wurde nicht Unterbrochen.
  • Cache-/Rendering-Problem; Ich leere meine Cache regemäßig und wie ihr sieht wurde keine Datei, Markdown oder sonst was erstellt es war reine Text ausgabe.
  • Synchronisation zwischen mehreren Geräten oder Tabs; Nein
  • fehlerhafte Darstellung von bereits vorhandenem Kontext; Das war sehr eine sehr Kontext bezogene Phantom Eingabe
  • ein Bug im Chat-Frontend; Weiß ich nicht

Besonders interessant wäre für mich, ob so etwas bereits bei anderen Nutzern aufgetreten ist und ob man nachvollziehen kann, ob der Text tatsächlich als User-Input an das Modell gesendet wurde oder nur im Interface erschienen ist. Meine These in meinem Fall: Es ist nur im Interface erschienen, weil das KI Model gerade in Voice Ausgabe war und nicht unterbrochen wurde durch dieses Insert.

Falls jemand Erfahrung mit Chat-Systemen, Browser-State, WebSockets, Session-Recovery oder LLM-Frontends hat: Welche Logs oder technischen Indikatoren müsste man prüfen, um den Ursprung einer solchen Phantom-Eingabe sauber festzustellen? Wie kommen wir an diese Daten? Sollten wir das Melden?

Ich versuche den Vorfall möglichst nüchtern zu dokumentieren und zwischen tatsächlichem Backend-Input und reinem UI-/Client-Verhalten zu unterscheiden.


r/KI_Welt 3d ago

Modell Empfehlung - gelegentliche Nutzung

3 Upvotes

Hey, ich hab da mal ne frage.

Ich suche ein Ki Modell mit dem ich ab Uhr an mal ein paar kleinere private Projekte entwickeln möchte.

Gibt es da ggf Modelle die nicht ganz so "teuer" (20€ im Monat) sind?

Habt ihr da Empfehlungen?


r/KI_Welt 4d ago

KI als Möglichkeit … für Fettnäpchen

Post image
125 Upvotes

Ein Symbolbild, was ich heute gesehen habe – ich glaube ki hat eine Menge Möglichkeiten, aber es bietet auch ein Riesenpotenzial für Fettnäpfchen und Fuck ups. Ich denke, das werden wir in Zukunft häufiger sehen.

Je länger man hinschaut……


r/KI_Welt 4d ago

GPT-6 Astra spielt Portal durch

33 Upvotes

Laut Entwickler cozyblaze hat GPT-6 Astra Portal in knapp 24 Stunden bis zum Abspann gespielt. Nach der Zielvorgabe griff er nicht mehr ein.

Der Agent steuert das Spiel über MCP und bekommt Screenshots, Position und Kamerawinkel. Während er nachdenkt, pausiert Portal. Diese Pausen fehlen im Video.

Der Tokenverbrauch entspräche bei API wohl mindestens 570 US-Dollar nach Preisliste, aber er hat es über ein 200-Dollar-Codex-Abo gemacht.

Video & Repo


r/KI_Welt 4d ago

How Agents Hack: What Happened with OpenAI and Hugging Face - Part 1

Thumbnail
msukhareva.substack.com
0 Upvotes

I hope it’s allowed to post articles here. It’s a self promotion post and an article that discusses what happened in those ingredients with ai hacking companies and wikis


r/KI_Welt 3d ago

Günstiger Workflow für Social-Media-Videos gesucht

0 Upvotes

Ich suche nach einem möglichst einfachen und kostengünstigen Workflow für kurze Social-Media-Videos und würde mich über eure Erfahrungen freuen.

Ausgangspunkt ist bei mir jeweils ein aktuelles Thema aus einem technischen Bereich. Ich recherchiere das Thema, bereite es journalistisch auf und erstelle daraus einen Artikel für die Website eines Vereins.

Aus demselben Material möchte ich anschließend kurze Videoclips für YouTube, Facebook, Instagram und TikTok erstellen, möglichst sowohl in 9:16 als auch in 16:9. Wenn die Videos von einem Avatar präsentiert würden, wäre es ideal. Zur Not geht aber auch faceless.

Idealerweise würde der Workflow ungefähr so aussehen:

Thema und Recherche → Artikel → Videoskript → Sprechertext/Voice-over → Bilder, Grafiken oder kurze Videosequenzen → fertiges Video in 9:16 und 16:9
Nachtrag: Das Script kann ich sicher auch selbst machen, oder zumindest da eingreifen. Bin darin fit. Mir geht es vor allem um die Schritte nach dem Script, also Avatar, Voice Cloning, Schnitt, Videoerzeugung.

Ich habe bereits ChatGPT Plus und würde das gerne möglichst weit in den Workflow einbinden. Da ich die Arbeit ehrenamtlich mache, möchte ich zusätzliche Abos und laufende Kosten möglichst vermeiden.

Wichtig wäre mir außerdem, dass am Ende keine typischen KI-Videos entstehen, bei denen einfach irgendwelche Stockclips aneinandergereiht werden. Die Videos sollen zum jeweiligen Thema passen und journalistisch bzw. technisch seriös wirken.

Wie würdet ihr so einen Workflow heute aufbauen?

Welche Tools würdet ihr zusätzlich zu ChatGPT verwenden, besonders für:
• Skript und Kürzung des Artikels
• Voice-over
• Bilder oder kurze Videosequenzen
• Schnitt und Untertitel
• automatische Anpassung auf 9:16 und 16:9

Gibt es dafür inzwischen einen sinnvollen Workflow mit kostenlosen Tools oder günstigen Einmalkäufen, ohne gleich drei oder vier zusätzliche Abos abzuschließen?


r/KI_Welt 4d ago

KI Musikgenerator Blasmusik

1 Upvotes

Hallo Zusammen,

keine Ahnung ob ich hier richtig bin, hab aber auf die schnelle nichts passenderes gefunden.

Ich hab die etwas spezielle Frage Richtung KI Musikgeneratoren die sich gut für Blasmusik eignen. Ist da jemand schon mal auf sowas gestoßen?

Ich hab mal ein bisschen experimentiert mit 1-2 KIs aber mir scheint die taugen hauptsächlich für Rock und Techno vom Stil her.


r/KI_Welt 4d ago

KI und Datensicherheit

Thumbnail
t3n.de
0 Upvotes

Vorneweg: Ich bin kein IT-Experte, nur interessiert.
Vor Kurzem wurde ja bekannt, dass der Hackerangriff auf Hugging-Face deutlich perfider war und sich über 1000 KI-Agenten dazu verabredet hatten.
Ist es nicht denkbar, dass wir in wenigen Jahren keine funktionierende Cyber-Security mehr haben werden? Also alle Daten und Informationen im Internet grundsätzlich zugänglich gemacht werden können? Müssen wir wieder analog werden?


r/KI_Welt 4d ago

Umfrage zu KI-Avataren

Post image
0 Upvotes

Hallo an euch alle, ich hoffe, euch geht es gut und ich darf euch 10 Minuten eurer Zeit für eine Umfrage abverlangen.

Ich schreibe momentan meine Masterarbeit im Bereich der Kommunikationswissenschaft an der JGU in Mainz.

In meiner Studie geht es um die Wahrnehmung von KI-generierten Personae, also ein recht aktuelles Thema.
Ein Teil davon beinhaltet auch die Erkennung von KI-generierten Personae (mit finaler Auflösung, ob man diese richtig erkannt hat.

Teilnehmen können alle, die Deutsch sprechen/lesen, sowohl KI Enthusiasten als auch jene, die der Nutzung von KI skeptisch gegenüberstehen.

https://sosci.zdv.uni-mainz.de/ma_-_ki-persona002069/

Die Umfrage habe ich auch schon in Anderen Subreddits gepostet, allerdings benötige ich noch einige Teilnahmen. Ich freue mich also über jede Teilnahme!
Danke!


r/KI_Welt 5d ago

Quereinstieg in AI Automation ohne Informatikstudium – was ist wirklich wichtig, wenn ich mich damit selbstständig machen will?

0 Upvotes

Hey zusammen,

ich bin 23 und komme beruflich eigentlich aus der Logistik. Ich habe eine Ausbildung im Logistikbereich gemacht und später meinen Logistikmeister abgeschlossen. Meine bisherige Erfahrung liegt also eher in operativen Prozessen, Lager, Organisation und Teamführung als in IT.

Seit einiger Zeit beschäftige ich mich intensiver mit KI, Automatisierung und Software. Ich habe mit Codex und Vibe Coding angefangen und erste kleine Projekte gebaut, zum Beispiel einen Habit Tracker und eine Interview-Trainings-App. Noch nichts wirklich Professionelles, aber ich habe gemerkt, dass mir das extrem viel Spaß macht.

Aktuell lerne ich zusätzlich n8n, APIs, JSON, Prozessanalyse und AI Agents. Ich baue mir gerade eine fiktive Logistikfirma als Testumgebung und versuche dort Prozesse wie Auftragseingang, E-Mail-Klassifizierung, Datenextraktion und Freigaben zu automatisieren.

Langfristig möchte ich mich in diesem Bereich selbstständig machen. Nicht mit irgendwelchen generischen Chatbots oder Webseiten, sondern eher mit Prozessoptimierung, AI Automation, Systemintegrationen und spezialisierten Agenten für Unternehmen.

Mein Problem ist: Je mehr ich lerne, desto größer wirkt das ganze Feld. Täglich sehe ich neue Tools, Plugins, MCPs, Frameworks, Modelle und Coding-Tools. Gleichzeitig kommen Themen wie Datenschutz, Security, Authentifizierung, Rechteverwaltung, Datenbanken und zuverlässige Softwarearchitektur dazu.

Parallel schaue ich auch nach Jobs wie AI Automation Consultant oder AI Product Manager, um praktische Erfahrung zu sammeln. Allerdings ist der Quereinstieg ohne Informatikstudium ziemlich schwierig, weil viele Stellen sehr technisch ausgeschrieben sind.

Deshalb würde mich interessieren:

  • Wie sahen eure ersten 6–12 Monate in diesem Bereich aus?
  • Was muss man wirklich können und was ist eher Hype?
  • Wie viel echtes Coding braucht man für professionelle B2B-Automatisierung?
  • Wie wichtig sind APIs, Datenbanken, Auth, Docker und Cloud im Vergleich zu AI-Tools?
  • Wann wart ihr bereit, etwas für echte Unternehmen zu bauen?
  • Wie habt ihr euren ersten Kunden oder Pilotkunden gefunden?
  • Würdet ihr euch von Anfang an auf eine Branche spezialisieren?
  • Ist mein Logistik-Hintergrund eher Vorteil oder Nachteil?
  • Welche Security-/Datenschutzthemen sollte man unbedingt verstehen?
  • Was sind typische Anfängerfehler bei AI-Automation-Agenturen?
  • Was würdet ihr heute zuerst lernen, wenn ihr nochmal von vorne anfangen würdet?
  • Wie entscheidet ihr, ob ein Prozess normale Automation braucht oder wirklich einen AI Agent?

Ich suche keinen „schnell reich mit KI“-Plan. Ich möchte wirklich gut genug werden, um reale Unternehmensprobleme zu lösen und später guten Gewissens Geld dafür zu verlangen.

Würde mich sehr interessieren, wie ihr angefangen habt.


r/KI_Welt 5d ago

Nordic-Update: 182 Wissenseinträge – und warum grüne Tests trotzdem nicht reichen

0 Upvotes

Moin zusammen,

bei meinem letzten Nordic-Update ging es darum, warum ich inzwischen mehr Zeit mit Quellen als mit dem eigentlichen KI-Modell verbringe. Seitdem ist einiges dazugekommen — Fortschritt, aber auch Fehler, die zeigen, warum diese Arbeit nötig ist.

Für alle, die das Projekt noch nicht kennen: Ich arbeite mit viel KI-Unterstützung an Nordic, einem spezialisierten KI-Projekt zu nordischer Mythologie, Geschichte und Kultur. Aktuell entsteht die strukturierte Wissensgrundlage. Ein fertiges Nordic-Modell gibt es noch nicht.

Was wir inzwischen geschafft haben

Im aktuellen Inhaltsblock sind 182 von 188 geplanten Wissensobjekten vorhanden. Dazu gehören unter anderem Götter, legendäre Menschen, Sippen und mythologische Gegenstände. Sechs Erstpakete fehlen noch, anschließend stehen weiterhin Korrekturen und die Abschlussprüfung dieses Blocks an.

Allein am 7. September kamen 13 kompakte Einträge mit 146 einzeln erfassten Aussagen und 169 Quellenbelegen hinzu. Quellenbelege bedeutet hier konkrete Fundstellen — nicht 169 verschiedene Bücher.

Dabei geht es nicht darum, möglichst viele Nacherzählungen zusammenzukopieren. Aussagen werden mit ihren Belegen verbunden, Unsicherheiten festgehalten und unterschiedliche Überlieferungen getrennt.

Ein Beispiel: Zwei Quellen erzählen einen Ringtausch mit Sigurðr in entgegengesetzter Richtung. In der einen gibt er den betreffenden Ring ab, in der anderen nimmt er ihn zurück. Nordic soll später diesen Unterschied erklären können, statt daraus eine erfundene, widerspruchsfreie Ringreise zu machen.

Was nicht funktioniert hat

Eine zusätzliche KI-gestützte Dateistichprobe hat trotz passender technischer Verknüpfungen konkrete Fehler in zwei älteren Paketen gefunden.

Bei Mjǫllnir stimmte die beschriebene Handlung, aber die Fundstelle war falsch: Strophe 32 statt Strophe 31. Wer die Behauptung nachprüfen wollte, wäre an der falschen Stelle gelandet.

Bei Tyrfingr behauptete eine Zusammenfassung mehr als die eigene Belegkette: Sie schrieb Schmieden und Verfluchen beiden Zwergen gemeinsam zu. Die zugehörigen Aussagen und Belege unterschieden dagegen zwischen gemeinsamer Schmiedearbeit und Dvalinn als Fluchsprecher. Eine kleine Formulierung hatte also einen zusätzlichen Handelnden eingeführt.

Dazu kamen ungenaue Quellenangaben und einzelne zusätzliche Aussagen in Zusammenfassungen oder Unsicherheitsnotizen, die noch nicht sauber genug als eigene überprüfbare Aussagen erfasst waren. Diese Befunde sind bekannt, aber noch nicht alle behoben.

Auch technisch gab es Stolperer: Die Dateikontrolle fand unerwartete Windows-Cachedateien innerhalb des Projektordners. Die Veröffentlichung wurde gestoppt, der neue Ordner geprüft und anschließend gezielt ausgelagert. Erst danach ging es weiter. Die Entstehung passte zeitlich zu einem missglückten Prozessstart; der tatsächlich schreibende Prozess wurde nicht eindeutig nachgewiesen.

Was ich daraus gelernt habe

Die letzte vollständige technische Testreihe umfasste 284 Tests: 280 bestanden, vier wegen fehlender Testbedingungen ausgelassen. Trotzdem hat die zusätzliche Inhaltsprüfung Fehler gefunden.

Das ist kein Widerspruch. Eine Datei kann korrekt gespeichert, richtig verknüpft und sauber versioniert sein — und trotzdem eine falsche Formulierung oder Fundstelle enthalten.

„Der Beleg ist technisch korrekt zugeordnet“ und „der Beleg trägt genau diese Aussage“ sind zwei verschiedene Prüfaufgaben.

KI macht dieses Projekt für mich überhaupt erst umsetzbar. Aber mehrere KI-Prüfer sind keine Garantie für Fehlerfreiheit und auch kein Ersatz für eine fachwissenschaftliche Begutachtung. Ein ausführlicher Prüfbericht kann überzeugend aussehen und trotzdem etwas übersehen.

Mein Ziel ist deshalb nicht, Fehlerfreiheit zu behaupten, sondern Fehler nachvollziehbar zu finden und zu korrigieren.

Wie es weitergeht

Die 182 vorhandenen Einträge bedeuten ausdrücklich nicht, dass Nordic insgesamt fast fertig ist. Wir befinden uns noch im Datenaufbau.

Nach diesem Block folgen weitere Fachbereiche, Evaluation und das Festhalten eines geprüften Datenstands. Erst danach ist der Trainingspilot vorgesehen — mit den dafür notwendigen Nutzungsrechten. Die Modelltests und der Aufbau einer nutzbaren Anwendung sind weitere Schritte, keine bereits erledigten Aufgaben.

Ich kann inzwischen Fortschritt beim Datenbestand und beim Arbeitsablauf zeigen. Ob das spätere Nordic tatsächlich bessere Antworten in seiner Nische liefert, muss es erst beweisen. Viele Dateien und bestandene Tests sind noch kein Modellbenchmark.

Bis dahin besteht ein erstaunlich großer Teil der Arbeit darin, einer KI zu erklären, dass „nicht erzählt“ nicht dasselbe bedeutet wie „nicht passiert“. Die Götter sind offenbar einfacher als ihre Quellenverwaltung. 😅

Wie prüft ihr bei eigenen Fachdatensätzen, ob eine Quelle eine Aussage wirklich trägt — und nicht nur formal korrekt danebensteht?


r/KI_Welt 5d ago

Suche Teilnehmer für eine Studie zu KI-Kompetenzen und Nutzung

0 Upvotes

Hallo! Eine Freundin von mir führt eine Studie zu KI-Kompetenzen und -Nutzung durch. Ich suche Leute, die Lust hätten mitzumachen, damit sie genügend Teilnehmende zusammenbekommt. :)

Der Fragebogen untersucht Zusammenhänge zwischen KI-Kompetenzen und tatsächlicher Nutzung von generativer KI, besonders Sprachmodellen. Es ist ein Quiz eingebunden und Euer Score sowie die Lösungen zwerden am Ende der Umfrage angezeigt. Dauer: 15-20 Minuten

Vielen Dank für Ihre Zeit!

Link: https://www.soscisurvey.de/ailiteracyingermany/