Carte SEHEN, LESEN, NACHDENKEN Richard Boozman

SEHEN, LESEN, NACHDENKEN

Entwicklung multimodaler KI-Anwendungen, die Bilder, Text und Audio gemeinsam verstehen

Limbă: germană
Legare: Carte broșată
Disponibilitate: În depozitul extern
Expediem în 14-21 zile
144.83 lei
SEHEN, LESEN, NACHDENKEN ist ein praxisorientierter Leitfaden für KI-Entwickler, Machine-Learning-In...

Informații despre carte

Limbă
germană
Legare
Carte - Carte broșată
Publicat
2026
Pagini
376
EAN
9798187788859
Enbook ID
53264628
Greutate
455
Dimensiuni
152 x 229 x 24

Descriere completă

SEHEN, LESEN, NACHDENKEN ist ein praxisorientierter Leitfaden für KI-Entwickler, Machine-Learning-Ingenieure und Softwarearchitekten, die multimodale KI-Anwendungen entwickeln möchten, welche Bilder, Text und Audio gemeinsam verarbeiten und verstehen.

Die nächste Generation künstlicher Intelligenz kombiniert verschiedene Datentypen, um Inhalte ganzheitlich zu analysieren und intelligent auf komplexe Eingaben zu reagieren. Multimodale Modelle ermöglichen Anwendungen, die Bilder interpretieren, Sprache verstehen, Audio analysieren und diese Informationen zu fundierten Entscheidungen zusammenführen.

Dieses Buch zeigt Schritt für Schritt, wie produktionsreife multimodale KI-Systeme mit Python und modernen KI-Frameworks entwickelt, integriert und skaliert werden.

Du lernst unter anderem:

  • Wie multimodale KI-Systeme für Bild-, Text- und Audioverarbeitung entwickelt werden
  • Wie verschiedene Datenmodalitäten in einer gemeinsamen Architektur kombiniert werden
  • Wie Vision-, Sprach- und Audiomodelle effizient integriert werden
  • Wie Embeddings und multimodale Repräsentationen genutzt werden
  • Wie Retrieval-, Such- und Analysefunktionen für multimodale Anwendungen umgesetzt werden
  • Wie Modelle bewertet, optimiert und für den produktiven Einsatz vorbereitet werden
  • Wie skalierbare KI-Pipelines für Unternehmensanwendungen aufgebaut werden
  • Wie Sicherheit, Performance und Zuverlässigkeit multimodaler Systeme verbessert werden

Praxisnahe Beispiele, moderne Architekturkonzepte und reale Anwendungsfälle zeigen, wie intelligente Anwendungen entwickelt werden, die Informationen aus mehreren Quellen gleichzeitig verstehen und verarbeiten können.

Ob intelligente Assistenten, Dokumentenanalyse, Medienverarbeitung, Robotik oder Enterprise-KI - dieses Buch vermittelt die Fähigkeiten, um moderne multimodale KI-Lösungen erfolgreich zu entwickeln.

SEHEN, LESEN, NACHDENKEN - Der umfassende Leitfaden für die Entwicklung multimodaler KI-Anwendungen mit Bild-, Text- und Audioverständnis.