Utilidad de búsqueda y recuperación aproximada de cadenas medida mediante el índice de similitud SIM [SImilarity Measure]. Permite crear una base de datos a partir de un archivo de texto. El funcionamiento del comando se aprecia mejor con un ejemplo. Crear un archivo de frutas a una por linea:
$ cat <<EOF > frutas.txt
manzana
plátano
albaricoque
mandarina
EOF
$ simstring -u -b -d frutas.db < frutas.txt
$ simstring -u -e -d frutas.db
mandarrina
mandarrina
mandarina
1 strings retrieved (9,7e-05 sec)
$ echo "albaricoqe" | simstring -u -e -d frutas.db
albaricoqe
albaricoque
1 strings retrieved (0,000232 sec)
$ echo "albaricuke" | simstring -t 0.5 -u -e -d frutas.db
$ echo "albaricuke" | simstring -s overlap -t 0.6 -u -e -d frutas.db (con coeficiente "overlad" [solapamiento] más permiso que el por defecto "cosine"
$ simstring -n 4 -u -b -d frutas2.db < frutas.txt