Hacktoberfest 2026: los issues que los mantenedores marcaron para octubre, abiertos y aptos para principiantes. Explorar issues de Hacktoberfest

Support for AI4Bharat IndicConformer Models

Abierto
#47 1 comentario 1 reacción 0 asignados Ver en GitHub

Nadie ha tomado este issue todavía.

Evaluación

Dificultad
4/5
Tiempo estimado
3-5 días
Aptitud para principiantes
55/100
Tipo de issue
Nueva funcionalidad
Claridad
Bastante claro
Estado de actividad
Tranquilo
Stack tecnológico
cpp

Línea de trabajo

Comienza en Subsampling::build_graph() e inspecciona la ruta depthwise existente de FastConformer; después, compárala con las operaciones ggml_conv_2d() que necesita el grafo de IndicConformer. Usa parakeet-cli transcribe con un modelo GGUF de AI4Bharat para verificar que la carga y la inferencia se completan mientras el comportamiento existente de FastConformer permanece sin cambios.

Escrito por el modelo de indexación a partir del texto del issue.

Descripción

Feature Description

Please add support for AI4Bharat IndicConformer models.

Currently loading the GGUF model crashes during the feature downsampling/subsampling block.

Error

GGML_ASSERT(a->ne[2] == 1) failed

Stack:
ggml_conv_2d_dw_direct()
Subsampling::build_graph()

Root Cause

The current implementation assumes FastConformer subsampling:

conv.2 depthwise
conv.3 pointwise
conv.5 depthwise
conv.6 pointwise

However AI4Bharat IndicConformer uses:

conv.0 Conv2d
ReLU
conv.2 Conv2d
ReLU

ONNX inspection:

conv.0.weight
[512,1,3,3]
group=1

conv.2.weight
[512,512,3,3]
group=1

GGUF:

encoder.pre_encode.conv.2.weight
[3,3,512,512]

This is a different computation graph, not only a tensor layout issue.

Proposed implementation
  1. Detect subsampling architecture during loading.

  2. Preserve existing FastConformer depthwise path.

  3. Add IndicConformer path:

Conv2d(conv.0)
→ ReLU
→ Conv2d(conv.2)
→ ReLU

using ggml_conv_2d().

  1. Reuse existing encoder blocks after subsampling.
Additional observation

The GGUF file itself is valid:

  • parakeet-cli info works correctly.
  • parakeet-cli quantize works correctly.

The failure only occurs during parakeet-cli transcribe, when the inference graph is constructed and the subsampling layer is executed.

Use Case

Standalone C++ Speech-to-Text inference for Indian languages.

Lenguaje dominante
C++
Estrellas
786
Forks
93
Merge medio
9 d 19 h
PR fusionados (30 d)
4

Preparar el entorno

Aún no hemos revisado los archivos de configuración de este proyecto. Empieza por su README y consulta nuestra guía para la primera contribución para los pasos generales.

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Más de mudler/parakeet.cpp

Todos los issues de mudler/parakeet.cpp

Issues similares

Más issues de C++

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.