In diesem Tutorial lernen Sie, wie Sie die NVIDIA Physical AI Agent-Tools und -Fähigkeiten zur Generierung von Fehlerbildern einrichten und verwenden, um synthetische Anomaliebilder für visuelle Inspektionspipelines zu erstellen. Die Fähigkeit zur Generierung von Fehlerbildern läuft in einem NVIDIA Brev Launchable, das Monate manueller Datensammlung und -beschriftung reduziert – Sie beschreiben den gewünschten Fehler in natürlicher Sprache, und der Agent generiert beschriftete Anomaliebilder, die bereit sind, Ihr Inspektionsmodell zu trainieren. Am Ende des Tutorials haben Sie die Fähigkeit zur Generierung von Fehlerbildern eingerichtet und können synthetische Fehlersätze für PCB, Glas, Metall und Ihre eigenen benutzerdefinierten Anwendungsfälle generieren.
Starten Sie mit der Fähigkeit zur Generierung von Fehlerbildern:
Kapitel:
00:00 Einführung — Navigieren zu brev.nvidia.com/physical-ai
00:15 Fähigkeit zur Generierung von Fehlerbildern — Architekturübersicht
00:35 Wählen und Konfigurieren des Launchable zur Generierung von Fehlerbildern
01:05 Einrichten der Anmeldeinformationen (NVIDIA API-Schlüssel + Hugging Face-Token)
01:35 Open OpenClaw und Setup-Prompt senden
02:00 Agent meldet blockierte Anmeldeinformationen — NGC- und HF-Schlüssel bereitstellen
02:20 Neue Sitzung — PCBA-Brückenfehler-Generierungs-Prompt senden
02:40 Agent übermittelt Workflow an OSMO und meldet den Pipeline-Status
03:00 Agent nach Statusaktualisierung fragen
03:10 Ausgabe anzeigen — Eingabebild, Maske und rekonstruierten Fehler
#NVIDIAAgentSkills #PhysicalAI #SyntheticData
NVIDIA Agent Skills, synthetische Datengenerierung, Fehlererkennung, visuelle Inspektion, Physical AI, NVIDIA Launchable
F: Was ist die NVIDIA Fähigkeit zur Generierung von Fehlerbildern?
A: Es handelt sich um einen launchable Workflow, der einen Agenten zur Generierung synthetischer Daten verwendet, um beschriftete Anomaliebilder für visuelle Inspektionsmodelle zu erstellen. Sie beschreiben den gewünschten Fehler in natürlicher Sprache, und der Agent führt automatisch die erforderlichen Skripte und Modelle aus, wodurch Monate der Datensammlung in nur wenigen Stunden Rechenzeit umgewandelt werden.
F: Welche Fehlertypen werden standardmäßig unterstützt?
A: Das Launchable enthält vortrainierte Modelle und Daten für PCB-, Glas- und Metallfehler. Sie können es auch auf benutzerdefinierte Fehlertypen für Ihr eigenes Inspektionsmodell erweitern.
F: Welchen API-Schlüssel benötige ich, um zu beginnen?
A: Sie können einen API-Schlüssel von build.nvidia.com, OpenAI oder Anthropic verwenden. Sie benötigen auch einen Hugging Face API-Schlüssel und einen NGC API-Schlüssel, damit der Agent die erforderlichen Modelle und Datensätze abrufen kann.
F: Wie lange dauert es, Fehlerbilder zu generieren?
A: Die Generierungszeit hängt von der Anzahl der Bilder und Ihrer GPU-Konfiguration ab. In diesem Durchgang wurde ein einzelnes Fehlerbild in etwa 10 Minuten generiert. Die großflächige Batch-Generierung wird ebenfalls unterstützt.
F: Was ist OSMO und warum erscheint es im Workflow?
A: OSMO ist das Backend-Orchestrierungstool, das der Agent verwendet, um Aufgaben zu verwalten und auszuführen. Es zeigt eine Historie aller Ihrer Generierungsanfragen, Echtzeit-Statusaktualisierungen und Protokolle, die nützlich für das Debugging sind – Sie können es jederzeit während eines Generierungslaufs überprüfen.