QT-Opt

Κλειστές βαρύτητες Google Brain,University of California (UC) Berkeley 1.2M παράμετροι June 2018

Καμία εκτίμηση

Δεν υπάρχουν απαιτήσεις υλικού για αυτό το μοντέλο

Δεν έχει δημοσιευτεί το βάρος για αυτό το μοντέλο, επομένως δεν μπορεί να κατέβει ή να τρέξει σε δικό σας υλικό σε οποιοδήποτε μέγεθος. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του, και καμία κάρτα γραφικών δεν το αλλάζει αυτό..

Σε καταγραφή

Πλήρης προδιαγραφή

Όλα τα καταγεγραμμένα για αυτό το μοντέλο. Τα περισσότερα από αυτά περιγράφουν το πώς εκπαιδεύτηκε παρά το πώς τρέχει — χρήσιμο πλαίσιο για την εκτίμηση του πόση εργασία έχει επενδυθεί σε αυτό, και πώς συγκρίνεται με μοντέλα που έχουν κατασκευαστεί σε διαφορετική κλίμακα..

Προέλευση

Ποιος κατασκεύασε αυτό το μοντέλο, πού και πότε δημοσιεύθηκε.

Οργάνωση
Google Brain,University of California (UC) Berkeley
Τύπος οργανισμού
Industry,Academia
Χώρα
United States of America
Δημοσιευμένο
27 June 2018
Συγγραφείς
Dmitry Kalashnikov, Alex Irpan, Peter Pastor, Julian Ibarz, Alexander Herzog, Eric Jang, Deirdre Quillen, Ethan Holly, Mrinal Kalakrishnan, Vincent Vanhoucke, Sergey Levine

Τι κάνει

Οι προβληματικές περιοχές για τις οποίες σχεδιάστηκε το μοντέλο. Ένα μοντέλο μπορεί να διαθέτει αρκετές από κάθε μία.

τομέας
Robotics, Vision
Εργασία
Robotic manipulation
Προσέγγιση
Reinforcement learning

Μέγεθος

Πόσο μεγάλο είναι το μοντέλο και πόσα δεδομένα έχει εκπαιδευτεί. Οι παράμετροι είναι ο αριθμός που αποφασίζει αν χωράει σε μια δεδομένη κάρτα γραφικών.

παράμετροι
1.2M

"The Q-function Qθ(s, a) is represented in our system by a large convolutional neural network with 1.2M parameters"

Δεδομένα εκπαίδευσης
11,600,000 tokens

Observations take up 4TB of disk space, and the input space is a 472x472 RGB image. Assuming 24 bit depth color (8 bits per channel), that suggests 472 * 472 * 3 * 8 bits = 668.352 kB per image (this could be off by a factor of 2 depending on actual bit depth) 4 TB / 668.352 kB = 5,984,870 images; around 10 per grasp attempt. 15M gradient steps with batchsize 32 implies: 15M steps * 32 images/step * 1/5984870 images ~= each image seen 80 times

Εποχές
80

Εκπαίδευση υπολογιστών

Η αριθμητική που πραγματοποιήθηκε για την εκπαίδευση του μοντέλου, μετρημένη σε πράξεις κινητής υποδιαστολής. Είναι ένα μέτρο του κόστους της προπόνησης, όχι της ταχύτητας με την οποία το ολοκληρωμένο μοντέλο σας απαντά.

Εκπαίδευση υπολογιστών
1.4 × 10¹⁹ FLOP

"We distribute training across 10 GPUs, using asynchronous SGD with momentum... This system allows us to train the Q-function at 40 steps per second with a batch size of 32 across 10 NVIDIA P100 GPUs." "We found empirically that a large number of gradient steps (up to 15M) were needed to train an effective Q-function..." 15M steps * 0.025 seconds/step * 9.30E+12 FLOP/sec/GPU * 0.4 utilization * 10 GPU = 1.395E+19

Πώς ιδρύθηκε
Hardware

Η εκπαίδευση run

Τι απαιτήθηκε φυσικά για την εκπαίδευση: ποιες κάρτες, πόσες, για πόσο καιρό, και τι αυτό απαιτούσε από το ρεύμα.

Υλικό εκπαίδευσης
NVIDIA P100
Χρόνος τοίχου
104 hours

"We distribute training across 10 GPUs, using asynchronous SGD with momentum... This system allows us to train the Q-function at 40 steps per second with a batch size of 32 across 10 NVIDIA P100 GPUs." "We found empirically that a large number of gradient steps (up to 15M) were needed to train an effective Q-function..." 15M steps * 0.025 seconds/step * 1/3600 hours/second = 104.2 hours

Κόστος υπολογισμού
$1,318

Διαθεσιμότητα

Εάν μπορείτε να αποκτήσετε το μοντέλο και να το τρέξετε στο δικό σας υλικό, το οποίο αποφασίζει αν οποιαδήποτε από τις αριθμούς της κάρτας γραφικών σε αυτή τη σελίδα ισχύει.

Βάρη
Closed — provider access only
Πρόσβαση μοντέλου
Unreleased

Πώς ταξινομείται

Ετικέτες το πηγαίο σύνολο δεδομένων εφαρμόζει όταν παρακολουθεί σημαντικά μοντέλα, και πόσο βέβαιο είναι στην είσοδο.

Εγγραφή εμπιστοσύνης
Likely
Παραπομπές
1,692

Πηγές

Από πού προήλθε αυτή η καταγραφή και πότε ελέγχθηκε τελευταία φορά.

Αναφορά
QT-Opt: Scalable Deep Reinforcement Learning for Vision-Based Robotic Manipulation
Τελευταία ενημέρωση
25 May 2026

Τι σημαίνουν οι αριθμοί

Σχετικά με αυτό το μοντέλο

QT-Opt δημοσιεύθηκε από Google Brain,University of California (UC) Berkeley, στην χώρα καταγεγραμμένη ως United States of America, κατά τη διάρκεια June 2018. Ο εκδοτικός οργανισμός κατηγοριοποιείται ως industry,Academia.

Λειτουργεί στον τομέα της Robotics, Vision, και καταγράφεται ότι εκτελεί την εργασία του robotic manipulation.

Αυτό είναι ένα κλειστό μοντέλο: οι εκπαιδευμένες τιμές παρέμειναν με όποιον τις παρήγαγε, και δεν υπάρχει τοπική έκδοση για να τρέξει.

Εκπαίδευση και προελεύσεις

Η εκπαιδευτική εκτέλεση καταναλώνει περίπου 1.4 × 10¹⁹ FLOP, σε υλικό καταγεγραμμένο ως NVIDIA P100. Αυτή η τιμή μετράει το κόστος παραγωγής του μοντέλου και δεν έχει σχέση με το πόσο γρήγορα απαντά.

Η εκπαίδευση κατανάλωσε ένα σύνολο περίπου 11,600,000 κωδικοί κειμένου

Απαντήσεις

QT-Opt — κοινές ερωτήσεις

01

QT-Opt— πόσες παραμέτρους έχει;

Έχει αριθμό παραμέτρων 1.2M. "The Q-function Qθ(s, a) is represented in our system by a large convolutional neural network with 1.2M parameters". Αυτή η φιγούρα είναι το σύνολο, και είναι αυτό που αποφασίζει πόση μνήμη χρειάζεται το μοντέλο - περίπου μισό γιγαμπάιτ ανά δισεκατομμύριο με τη συμπίεση που χρησιμοποιεί το πιο πολλοί άνθρωποι.

02

QT-Opt— ποιος το δημιούργησε;

Δημοσιεύθηκε από Google Brain,University of California (UC) Berkeley, βασισμένο σε United States of America, μία οργάνωση κατηγοριοποιημένη ως industry,Academia.

03

QT-Opt— πότε κυκλοφόρησε;

Δημοσιεύθηκε σε June 2018. Η ικανότητα ανά παράμετρο έχει βελτιωθεί σημαντικά από τότε, οπότε ένα νέο ΜΟΝΤΕΛ του ίδιου μεγέθους είναι συχνά η καλύτερη χρήση του ίδιου υλικού.

04

QT-Opt— για τί χρησιμοποιείται;

Λειτουργεί στον τομέα της Robotics, Vision, και καταγράφεται ως διαχείριση της εργασίας του robotic manipulation. Τα Μοντέλα συχνά φέρουν περισσότερα από ένα από το καθένα, και οι ετικέτες περιγράφουν τον σκοπό παρά τους περιορισμούς ικανότητας.

05

QT-Opt— πόσο υπολογιστική ισχύς χρησιμοποιήθηκε για την εκπαίδευσή του;

Η εκπαίδευση κατανάλωσε περίπου 1.4 × 10¹⁹ FLOP, σε υλικό καταγεγραμμένο ως NVIDIA P100. Αυτό μετράει το κόστος παραγωγής του μοντέλου και δεν λέει τίποτα για το πόσο γρήγορα απαντά μόλις εκπαιδευτεί — η ταχύτητα συμπερασμάτων προέρχεται από τον δίαυλο μνήμης, όχι από τον προϋπολογισμό εκπαίδευσης.

06

QT-Opt— ποια GPU χρειάζομαι για να το τρέξω;

Κανένα. Αυτό είναι ένα κλειστό μοντέλο - τα βάρη του δεν δημοσιεύθηκαν ποτέ, οπότε δεν μπορεί να κατέβει ή να εκτελεστεί σε δικό σας υλικό σε καμία τιμή. Είναι προσβάσιμο μόνο μέσω του προμηθευτή του.

07

QT-Opt— είναι ανοιχτού κώδικα;

Όχι. Τα βάρη του δεν έχουν δημοσιευθεί, οπότε υπάρχει μόνο ως υπηρεσία που ελέγχεται από τον ιδιοκτήτη του.

Πηγή

Αρχική δημοσίευση

Η καταγραφή ενημερώθηκε τελευταία φορά 25 May 2026

Η άλλη κατεύθυνση

Κοιτάζοντας το από την άλλη πλευρά;

Αυτή η σελίδα ξεκινά από το μοντέλο. Αν έχετε ήδη μια κάρτα και θέλετε να μάθετε τα πάντα για το τι θα τρέξει., ξεκινήστε από το υλικό αντ' αυτού.