Schematron V2 Small: kam tinka ir kiek kainuoja
Schematron V2 Small yra Inference.net sukurtas specializuotas modelis, kuris iš interneto puslapio HTML teksto išrenka reikalingus duomenis ir grąžina juos iš anksto nustatyta JSON struktūra. Jį galima naudoti produktų, kainų, įmonių, skelbimų ir kitų pasikartojančių duomenų surinkimui iš ilgų ar netvarkingų puslapių.
- Dideli kiekiai pigiai
- Analizė ir sudėtingi klausimai
Kas tai per modelis
Schematron V2 Small sukūrė Inference.net. Tai 3 mlrd. parametrų dydžio specializuotas modelis, skirtas ne laisvos formos pokalbiams, o duomenims iš interneto puslapių HTML teksto perkelti į tvarkingą, įmonės sistemoms tinkamą struktūrą.
V2 šeimoje yra du pagrindiniai variantai. Small skirtas sudėtingesnėms duomenų struktūroms ir ilgiems puslapiams, o Turbo – dideliems kiekiams, kai svarbiau greitis ir mažesnė kaina; Small taip pat yra ankstesnio Schematron 8B įpėdinis.
Modeliui pateikiamas puslapio HTML tekstas ir tiksli norimų laukų schema, pavyzdžiui, produkto pavadinimas, kaina, savybės ir kategorija. Nurodymai turi būti įrašyti į šią schemą, nes įprastų laisvos formos instrukcijų modelis nenaudoja. Vienu kartu jis gali perskaityti iki 128 000 žodžių dalių, o atsakymas gali siekti 4 096 žodžių dalis.
Įmonei tai reiškia galimybę automatizuoti rankinį informacijos kopijavimą iš svetainių į lenteles, katalogus, kainų stebėjimo ar klientų valdymo sistemas. Vis dėlto pradinei integracijai reikia techninio specialisto, kuris paruoštų duomenų schemą, perduotų HTML ir patikrintų rezultatus.
Kam Schematron V2 Small tinka
Stipriosios pusės
- Iš netvarkingo HTML išrenka konkrečius laukus į nustatytą JSON struktūrą.
- Skirtas sudėtingoms schemoms, įskaitant sąrašus ir kelis duomenų lygius.
- Gali vienu kartu apdoroti iki 128 000 žodžių dalių, todėl tinka ilgiems puslapiams.
- Grąžina griežtai pagal pateiktą schemą suformuotą rezultatą.
- Tinka automatiniam didelio interneto puslapių kiekio apdorojimui per Inference.net API.
Kam rinktis
Schematron V2 Small verta rinktis įmonėms, kurios reguliariai renka daug aiškiai apibrėžtų duomenų iš ilgų ar nevienodai sukurtų interneto puslapių. Jis ypač tinkamas, kai duomenų struktūra sudėtinga ir svarbiau išgavimo kokybė nei mažiausia įmanoma kaina.
Kada imti kitą
Schematron V2 Turbo gali būti tinkamesnis vienodiems puslapiams ir labai dideliems kiekiams, kai svarbiausia greitis bei mažesnė kaina. Pokalbiams, dokumentų kūrimui, nuotraukų analizei ar paveikslėlių generavimui reikėtų rinktis atitinkamos paskirties bendresnį modelį.
Panaudojimo pavyzdžiai versle
Produktų katalogo pildymas
Modelis iš tiekėjų ar pardavėjų puslapių išrenka produkto pavadinimą, kainą, savybes, kategoriją ir žymas. Rezultatus galima perduoti elektroninės parduotuvės katalogui ar vidinei duomenų bazei.
Konkurentų kainų stebėjimas
Modelis perskaito konkurentų produktų puslapių HTML ir grąžina kainą, valiutą, nuolaidą bei prekės prieinamumą. Surinktus duomenis įmonė gali naudoti kainų pokyčių ataskaitoms.
Įmonių sąrašų rengimas
Iš įmonių svetainių modelis gali išrinkti pavadinimą, veiklos aprašymą, adresą ir viešai pateiktus kontaktus, jei jie yra puslapyje. Duomenys grąžinami vienoda struktūra, tinkama importuoti į klientų valdymo sistemą.
Skelbimų duomenų rinkimas
Modelis gali iš skelbimų puslapių surinkti kainą, vietą, objekto tipą, savybes ir skelbimo nuorodą. Tai tinka nekilnojamojo turto, darbo pasiūlymų ar transporto skelbimų stebėjimui.
Svetainės turinio inventorizacija
Modelis iš daugelio organizacijos puslapių išrenka antraštes, kategorijas, datas ir kitus iš anksto pasirinktus laukus. Taip galima parengti turinio perkėlimo, atnaujinimo ar dublių tikrinimo sąrašą.
Kiek kainuoja Schematron V2 Small
Mokama už apdorotą tekstą: $0,050 už 1 mln. perskaitytų žodžių dalių ir $0,23 už 1 mln. parašytų. 1 mln. žodžių dalių – maždaug 1 900 puslapių teksto. Kad būtų aiškiau, trys apytiksliai pavyzdžiai:
| Darbas | Kas skaičiuojama | Kaina |
|---|---|---|
| 1 000 klientų pokalbių | trumpas klausimas su instrukcija ir atsakymas | apie $0,17 |
| 100 straipsnių po ~1 100 žodžių | trumpa užduotis ir ilgas tekstas | apie $0,037 |
| 300 puslapių dokumento santrauka | netelpa vienu kartu – reikia skaidyti dalimis | – |
Pagal tipinio pokalbio kainą jis pigesnis už 92 % kataloge esančių mokamų modelių.
Ką modelis priima ir grąžina
- Priima
- tekstą
- Grąžina
- tekstąpaveikslėlių nekuria
- Vienu kartu perskaito
- apie 240 puslapių128 000 žodžių dalių
- Ilgiausias atsakymas
- apie 8 puslapių4 096 žodžių dalių
- Mąstymo režimas
- nėra
- Darbas su jūsų sistemomis
- įrankių nenaudoja – tik atsako tekstu
- Išleistas
- 2026-09-12
Ribos ir kam netinka
- Priima ir grąžina tik tekstą – neanalizuoja nuotraukų, vaizdo ar garso ir nekuria paveikslėlių.
- Tai nėra bendros paskirties pokalbių ar tekstų rašymo modelis; jo paskirtis – HTML duomenų išgavimas.
- Reikia iš anksto parengti tikslią JSON schemą, todėl diegimui paprastai būtina programuotojo pagalba.
- Vienos užklausos riba yra 128 000 įvesties ir 4 096 išvesties žodžių dalių; didesnius puslapius ar rezultatus reikia skaidyti.
- Neaiškiai aprašyti arba puslapyje nepateikti laukai gali sukelti netinkamus rezultatus, todėl svarbi aiški schema ir rezultatų tikrinimas.
Schematron V2 Small šalia kitų modelių
Schematron V2 Small yra į duomenų išgavimo kokybę orientuotas Schematron šeimos variantas, o V2 Turbo skirtas didesniam greičiui ir mažesnėms sąnaudoms. Small pakeičia ankstesnį Schematron 8B, o senojo Schematron 3B užklausos nukreipiamos į V2 Turbo. Palyginti su bendros paskirties modeliais, Schematron yra siauresnis: jis nėra skirtas pokalbiams ar kūrybiniam darbui, tačiau specializuojasi HTML pavertime nustatytos struktūros duomenimis. Inference.net savo paskelbtame išgavimo bandyme jį lygino su DeepSeek V3.2 ir GPT-5.4 Nano, tačiau tai yra paties tiekėjo, o ne nepriklausomas vertinimas.
| Modelis | Skaitymas / rašymas, 1 mln. | 1 000 pokalbių | Perskaito vienu kartu | Priima |
|---|---|---|---|---|
| Schematron V2 SmallInference.net | $0,050 / $0,23 | apie $0,17 | ~240 psl. | tekstą |
| Schematron V2 TurboInference.net | $0,030 / $0,15 | apie $0,11 | ~240 psl. | tekstą |
| GPT-5.6 Luna ProOpenAI | $0,20 / $1,20 | apie $0,78 | ~1 970 psl. | failus (PDF), paveikslėlius, tekstą |
| DeepSeek V4.1 FlashDeepSeek | $0,30 / $1,20 | apie $0,93 | ~1 970 psl. | tekstą, paveikslėlius |
| Mistral Large 3 2512Mistral | $0,50 / $1,50 | apie $1,35 | ~490 psl. | tekstą, paveikslėlius, failus (PDF) |
Lentelėje – naujausi to paties tiekėjo modeliai ir artimiausi pagal kainą populiarūs kitų tiekėjų modeliai. Kaina nepasako kokybės: prieš renkantis verta išbandyti su savo tekstais.
Modelio ID ir kaip pradėti
Tikslus šio modelio ID yra inference-net/schematron-v2-small. Jį programuotojas įrašo į kodą arba įrankio nustatymus – nuo jo priklauso, kuri tiksliai versija atsakinės ir kiek tai kainuos.
- Nukopijuokite ID ir perduokite jį kūrėjui arba įrašykite į naudojamo įrankio (n8n, Make, savo sistemos) modelio lauką.
- Išbandykite su savo pavyzdžiais: 10–20 tikrų klausimų ar dokumentų parodo daugiau nei bet kuris reitingas.
- Palyginkite su pigesniu modeliu. Jei rezultatas panašus, rinkitės pigesnį – skirtumas per mėnesį būna keliolika kartų.
Dažni klausimai apie Schematron V2 Small
Ar Schematron V2 Small kuria paveikslėlius?
Ne. Modelis priima tekstą ir grąžina tekstą, todėl jis nekuria ir neanalizuoja paveikslėlių.
Kiek kainuoja jo naudojimas?
Pagal katalogo faktus, 1 mln. įvesties žodžių dalių kainuoja 0,05 JAV dolerio, o 1 mln. modelio grąžintų žodžių dalių – 0,23 JAV dolerio. Galutinė užklausos kaina priklauso nuo puslapių ilgio ir grąžinamų duomenų kiekio.
Ar jis tinka klientų aptarnavimui?
Ne kaip pokalbių robotas. Jis gali padėti surinkti klientų aptarnavimo sistemai reikalingus duomenis iš HTML puslapių, tačiau nėra skirtas laisvai bendrauti su klientais.
Kuo jis skiriasi nuo ankstesnės versijos?
Inference.net nurodo, kad V2 Small priartėja prie ankstesnio Schematron 8B išgavimo kokybės, išlaikydamas mažesniam 3B modeliui būdingą greitį. Ankstesnio Schematron 8B užklausos dabar automatiškai nukreipiamos į V2 Small.
Ar jam įdiegti reikia programuotojo?
Dažniausiai taip. Reikia parengti JSON schemą, gauti puslapio HTML, prijungti Inference.net API ir nustatyti rezultatų tikrinimą.
Šaltiniai
- Schematron V2 Small | AI Models | Inference.net
- Schematron – Inference.net Documentation
- Schematron V2: Frontier HTML-to-JSON extraction at a fraction of the cost
- Schematron 8B | AI Models | Inference.net
- Kainos ir dydžiai: OpenRouter modelių katalogas, atnaujinama kas 6 valandas
Aprašymas parengtas pagal tiekėjo skelbiamą informaciją ir nėra nepriklausomų testų rezultatas. Puslapių ir kainų pavyzdžiai – apytiksliai.
Pokalbių robotas, automatizacijos ir integracijos su jūsų sistemomis – pasiūlymas raštu.