OmniParser: Interactable Region Detection Model

Otevřít váhy Microsoft Research August 2024

Žádný odhad

Žádné hardwarové požadavky pro tento model

Hmotnosti tohoto modelu jsou otevřené, ale žádný počet parametrů pro něj nebyl zveřejněn. Každé číslo týkající se paměti a rychlosti vychází z této hodnoty, takže bychom raději nic neukázali, než fabrikaovaný odhad..

Na záznamu

Plná specifikace

Všechno o tomto modelu v záznamech. Většina z toho popisuje, jak byl trénován, spíše než jak funguje — užitečný kontext pro posouzení, kolik práce do něj bylo vynaloženo, a jak se srovnává s modely postavenými na jiné úrovni..

Původ

Kdo vytvořil tento model, kde a kdy byl publikován.

Organizace
Microsoft Research
Typ organizace
Industry
Země
United States of America
Publikováno
1 August 2024
Autoři
Yadong Lu, Jianwei Yang, Yelong Shen, Ahmed Awadallah

Co to dělá

Problémové oblasti, pro které byl model vytvořen. Model může obsahovat několik z každého.

Doména
Vision
Úkol
Object detection
Základní model
YOLOv8x

Velikost

Jak velký je model a kolik dat byl trénován. Parametry jsou číslo, které rozhoduje, zda se vejde na danou grafickou kartu.

Výcviková data
tokens

"We collect in total of 66990 samples where we split 95% (63641) for training, and 5% (3349) for validation. We train for 20 epochs with batch size of 256, learning rate of 1e−3, and the Adam optimizer on 4 GPUs."

Epochy
20

Tréninkový běh

Co fyzicky vyžadovalo trénování: které čipy, kolik, jak dlouho a co to vyžadovalo ze zásuvky.

Používané čipy
4

Dostupnost

Zda můžete získat model a spustit ho na svém vlastním hardwaru, což rozhoduje o tom, zda se některé z čísel grafických karet na této stránce vztahují.

Hmotnosti
Open — downloadable
Přístup k modelu
Open weights (unrestricted)

Jak je to klasifikováno

Štítky aplikačních datových sad, které se používají při sledování významných modelů, a jak jistý je ve záznamu.

Záznam důvěry
Confident

Žrovy

Odkud tento záznam pochází a kdy byl naposledy zkontrolován.

Reference
OmniParser for Pure Vision Based GUI Agent
Nap poslední aktualizace
28 November 2025

Co čísla znamenají

O tomto modelu

OmniParser: Interactable Region Detection Model byl zveřejněn Microsoft Research, v zemi zaznamenané jako United States of America, během August 2024. Kategorie, do které vydavatel spadá, je industry.

funguje v oblasti Vision, a je zaznamenán jako vykonávající úkol object detection.

Jeho výchozím bodem byl existující základní model, YOLOv8x. Většina modelů na této úrovni je přizpůsobena z existující základny namísto toho, aby byla vytvořena od nuly.

Váhy jsou zveřejněny, takže si je můžete stáhnout a spustit na své vlastní hardwaru neomezeně, offline, bez připojeného účtu.

Odpovědi

OmniParser: Interactable Region Detection Model — běžné otázky

01

OmniParser: Interactable Region Detection Model— kde si to mohu stáhnout?

Váhy jsou zveřejněny, i když nemáme odkaz na repozitář. Tato stránka vypočítává hardwarové požadavky spíše než aby hostila modelové soubory.

02

OmniParser: Interactable Region Detection Model— Jakou GPU potřebuji k jejímu spuštění?

Nemůžeme říct. Má otevřené váhy, ale žádný počet parametrů pro něj nebyl zveřejněn a každý výpočet paměti a rychlosti začíná od toho čísla. Raději bychom ukázali nic než vykonstruovaný odhad.

03

OmniParser: Interactable Region Detection Model— Je to OPEN SOURCE?

Jeho váhy jsou zveřejněny, takže si je lze stáhnout a spustit na vlastním hardwaru. Všimněte si, že open WEIGHTS není totéž co open SOURCE v plném smyslu — neříká nic o tréninkových datech, tréninkovém kódu nebo obchodních podmínkách připojených.

04

OmniParser: Interactable Region Detection Model— kolik má parametrů?

Pro něj nebyl zveřejněn žádný počet parametrů, a proto se na této stránce neobjevují žádné údaje o paměti nebo rychlosti.

05

OmniParser: Interactable Region Detection Model— Kdo to vytvořil?

Bylo to publikováno společností Microsoft Research, zakládající se na United States of America, organizace zařazená jako industry.

06

OmniParser: Interactable Region Detection Model— Kdy byl vydán?

Bylo to zveřejněno v August 2024. Schopnost na parametr se od té doby výrazně zlepšila, takže novější model stejné velikosti je často lepším využitím stejného hardwaru.

07

OmniParser: Interactable Region Detection Model— K čemu se to používá?

funguje v oblasti Vision, a je zaznamenáno jako zpracovávající úkol object detection. Model může nést několik z každého, takže to jsou oblasti, pro které byl navržen, spíše než omezení toho, co se pokusí.

Zdroj

Původní publikace

Nahrávka naposledy aktualizována 28 November 2025

Druhý směr

Díváte se na to z druhé strany?

Tato stránka začíná od modelu. Pokud již vlastníte kartu a chcete vědět všechno, co bude spuštěno, začněte raději od hardwaru.