Ingestão
Um modelo aberto ou licenciado entra em ambiente versionado e com proveniência explícita.
NeuroForge reúne ingestão, especialização com dataset, SFT e RL, compressão e validação. A saída não é uma dependência de API. É um artefato controlado que o runtime NeuroGrid executa na infraestrutura que a organização controla.
Um modelo aberto ou licenciado entra em ambiente versionado e com proveniência explícita.
Dados de domínio ensinam a tarefa, a linguagem e as restrições operacionais relevantes.
Distilação e quantização reduzem o footprint preservando a qualidade da tarefa.
Artefatos full-precision e compactos enfrentam os mesmos gates de regressão e qualidade.
Pesos e metadados tornam-se um artefato para CPU, Metal ou CUDA.
O artefato roda no runtime NeuroGrid, um binário Go sem Python no caminho de serving.
As ferramentas de treino podem usar PyTorch. O serving de produção não. Essa separação mantém o experimento flexível e a implantação controlada.
Inferência de texto está operacional no runtime NeuroGrid. TTS ternário on-demand possui caminhos nativos em CPU e CUDA. Voz em tempo real e modalidades adicionais permanecem trabalho explicitamente faseado.
Cargas offline e controladas
Execução local em Apple silicon
Cargas de baixa latência e throughput
Topologias de campo e multinó