LeafNachhaltiges Unternehmen CoinFaire Preise PackageSchneller und kostenloser Versand ab 14,90 € Bestellwert
Reinforcement Learning from Human Feedback: Reinforcement Learning from Human Feedback, Alignment, and Post-training Llms

Reinforcement Learning from Human Feedback: Reinforcement Learning from Human Feedback, Alignment, and Post-training Llms

inkl. MwSt. Versandinformationen

Lieferzeit 1-3 Werktage

55,91 €

Lieferzeit 1-3 Werktage

Kurzinformation
Sprache:
Englisch
ISBN:
9781633434301
Seitenzahl:
225
Auflage:
-
Erschienen:
2026-07-28
Mit diesem Kauf sparst Du 2,06 kg CO2

Mehr Informationen zum Zustand
Green Tree

Gebrauchte Bücher kaufen

Information
Das Buch befindet sich in einem sehr guten, unbenutzten Zustand.
  • Sauberer Zustand, Seiten und Bindung fast unversehrt
  • Frei von Knicken oder Markierungen
  • CDs und Zugangscodes verwendbar
Information
Das Buch befindet sich in einem sehr guten, gelesenen Zustand. Die Seiten und der Einband sind intakt. Buchrücken/Ecken/Kanten können leichte Gebrauchsspuren aufweisen.
Information
Das Buch befindet sich in einem guten, gelesenen Zustand. Die Seiten und der Einband sind intakt. Buchrücken/Ecken/Kanten können Knicke/Gebrauchsspuren aufweisen.
Information
Das Buch befindet sich in einem lesbaren Zustand. Die Seiten und der Einband sind intakt, jedoch weisen Buchrücken/Ecken/Kanten starke Knicke/Gebrauchsspuren auf. Zusatzmaterialien können fehlen.

Neues Buch oder eBook (pdf) kaufen

Information
Neuware - verlagsfrische aktuelle Buchausgabe.
Natural Handgeprüfte Gebrauchtware
Coins Schnelle Lieferung
Check Faire Preise

inkl. MwSt. Versandinformationen

Lieferzeit 1-3 Werktage

55,91 €

Lieferzeit 1-3 Werktage

Weitere Zahlungsmöglichkeiten  
Zahlungsarten

Beschreibung

Reinforcement Learning from Human Feedback: Reinforcement Learning from Human Feedback, Alignment, and Post-training Llms

AI models are powerful, but they do not always behave as expected. They can give unhelpful or incorrect answers. To improve them, we need to guide them toward responses that are useful and safe. This book shows how to do this using Reinforcement Learning from Human Feedback (RLHF). It explains the main method used to train today’s advanced AI models. Learn the complete process for training AI with feedback from people. Understand how to collect human opinions and use them to guide an AI. Build a model that teaches the AI what a good answer looks like. Discover new, simpler ways to train AI, like Direct Preference Optimisation (DPO). Find out how to test your AI to make sure it is becoming more helpful and safe. The RLHF Book is the first complete guide to training AI with human feedback. Written by a leading expert who helped create these methods, this book gives you a clear plan to follow. It covers everything from getting data to training and testing your AI. After reading this book, you will have the skills to build AI models that are more helpful, safe and act as expected. This book is for engineers, AI scientists and students who want to learn how to train modern AI.

Produktdetails

Einband:
paperback
Seitenzahl:
225
Erschienen:
2026-07-28
Sprache:
Englisch
EAN:
9781633434301
ISBN:
9781633434301
Gewicht:
472 g
Auflage:
-
Alle gebrauchten Bücher werden von uns handgeprüft.
So garantieren wir Dir zu jeder Zeit Premiumqualität.

Über den Autor


Entdecke mehr vom Verlag


Sehr gut
55,91 €
Entdecke mehr zum Thema