Hugging Face a Cerebras spojily síly pro real-time hlasovou AI s Gemma 4
Nové otevřené pipeline pro převod řeči na řeč kombinuje rychlou inferenci Cerebras, Gemma 4 a modulární komponenty pro přirozené hlasové interakce s nízkou latencí.
Nalezeno 7 výsledků pro "inference"
Vymazat vyhledáváníNové otevřené pipeline pro převod řeči na řeč kombinuje rychlou inferenci Cerebras, Gemma 4 a modulární komponenty pro přirozené hlasové interakce s nízkou latencí.
Hugging Face přepracoval svůj projekt Kernels s novým typem repozitáře, vylepšenou bezpečností, přepracovanými CLI, širší podporou frameworků a základy pro vývoj agentních kernelů.
AI a softwareNVIDIA a Hugging Face spojují síly, aby přinesly distribuované trénování difuzních modelů pro jakýkoli model ve formátu Diffusers na Hubu, bez nutnosti konverze checkpointů a s plnou podporou LoRA a plného jemného ladění.
LeRobot v0.6.0 přináší politiky světových modelů, které si představují budoucnost, nové VLA, jednotné modely odměn, šest nových benchmarků a rychlejší načítání dat.
AI a softwareNavzdory novějším architekturám DharmaOCR překonalo Mistral OCR4 a Unlimited-OCR v brazilské portugalštině díky doménové specializaci a cílenému tréninku.
AI a softwareNová kolekce NVIDIA Nemotron 3 Embed, v čele s modelem o velikosti 8B, který se umístil na prvním místě žebříčku RTEB, přináší špičkovou kvalitu vyhledávání a možnosti nasazení připravené pro produkci pro RAG, agentní vyhledávání a vyhledávání v kódu.
AI a softwareModelovací backend vLLM pro Transformery nyní dosahuje nativní rychlosti inference pro mnoho architektur LLM, což autorům modelů umožňuje používat jejich stávající kód bez portování.
Maya Bennett · Jul 30, 2026