Las rondas anteriores de esta búsqueda produjeron palabras inventadas: bien puntuadas, libres y mudas. Esta invierte la prioridad. Cada uno de estos mil dominios .com está compuesto de morfemas reales con su significado declarado y su fuente a la vista, se dicta por teléfono sin preguntas, y estaba libre al momento de publicar.
El estudio anterior ordenó 45.313 dominios libres por ocho criterios de fonética experimental. Funcionó: el top salió limpio de decir, fácil de dictar y con la mezcla de sonidos de las marcas líderes. Y no significaba nada.
El dato que decide la estrategia salió del barrido de 100.000 dominios del 13 de agosto: las palabras con significado están tomadas y los compuestos no. De las palabras reales de cinco letras, cero por ciento libres sobre 3.270 probadas. De las de ocho, un 21%. De las compuestas de ocho, un 78,8%. Por eso estos mil nombres son casi todos compuestos de dos morfemas, al estilo de Salesforce, Mailchimp o Snowflake.
Nada de esto sale de la memoria de nadie. Se armó una tabla de morfemas —raíces grecolatinas, palabras españolas y portuguesas, inglés técnico— y cada entrada se comprobó contra Wiktionary por API en el momento de construir el archivo: el CSV guarda la definición que devolvió el servidor y la URL. 234 de 234 entradas quedaron verificadas, y las que no, no entraron.
Después hay un segundo filtro, y este se lleva por delante la mejor veta latina. El producto se vende hablando, así que el nombre no puede tener ninguna duda al dictarlo: nada de v/b, c/s/z, g/j, hache muda ni letras dobles. Eso mata nova, via, vox, nexo, clave, luz, centro, origen, forja e hilo: diez raíces impecables que caen por una letra. Están todas en el CSV con su motivo anotado, porque el choque entre la mejor raíz y el criterio de dictado es un resultado, no un descuido.
| Motivo de descarte | Morfemas | Cuáles |
|---|---|---|
| v: v/b son el mismo sonido | 7 | clave, nivel, nova, verbo, via, vox, wave |
| h: h muda en es; 'ch' suena /ʃ/ en pt-BR | 6 | antorcha, chispa, flecha, hilo, marcha, racha |
| z: z/s son el mismo sonido (seseo) | 3 | lazo, luz, raiz |
| k: k/c/qu compiten por el mismo sonido | 3 | link, spark, stack |
| ce/ci suena igual que se/si (seseo) | 3 | cauce, centro, cifra |
| ge/gi suena igual que je/ji | 3 | forge, giro, origen |
| letra doble: hay que aclarar 'con dos' | 3 | loop, terra, tierra |
| x: x se oye /ks/, /s/ o /x/ según la palabra | 2 | lux, nexo |
| j: j suena distinto en portugués | 2 | brujula, forja |
| marca ajena en el mercado objetivo: Claro (América Móvil): telco dominante en CL/CO/PE/BR, categoría adyacente | 1 | claro |
| w: w no es letra nativa del español | 1 | flow |
| y: y/i/ll se confunden al dictar | 1 | sync |
Es el error clásico del naming: pen island, therapist, experts exchange. La unión fabrica una lectura que ninguna de las dos mitades tenía. Cada par candidato pasa por cuatro comprobaciones sobre la palabra ya pegada, no sobre cada mitad.
| Comprobación | Pares muertos | Qué evita |
|---|---|---|
| Palabra fantasma en la palabra ya pegada | 382 | Que la unión fabrique un insulto que ninguna mitad tenía. Lista ampliada a portugués de Brasil e insultos raciales. |
| Contacto consonántico imposible | 497 | Grupos que el español no produce entre sílabas. |
| Consonante doble en la unión | 222 | En español una consonante doble cambia de fonema o no existe. |
| Fonotáctica española ilegal | 2.332 | Ataques y codas de sílaba que el español no admite. |
| Forma torpe: hiato o tres consonantes | 5.761 | «oa», «ea» y «eo» no son diptongos sino hiatos: se leen en dos sílabas. |
| Los dos morfemas no comparten idioma | 1.318 | Un compuesto que necesita dos hablantes distintos para entenderse no es transparente. |
| El compuesto ya es una palabra española | 4 | Entonces no es un compuesto nuevo: es un significado que nadie eligió. |
La letra repetida en la unión tiene una regla, no un caso: si la letra que se repite es vocal se fusiona, porque es lo que hace el español con sus compuestos reales —tela+araña = telaraña, agua+ardiente = aguardiente—; si es consonante, el par se descarta, porque en español una consonante doble no se pronuncia doble: cambia de fonema (rr, ll) o no existe.
Ocho vienen del estudio anterior, con los pesos revisados. Dos son nuevos y propios de esta ronda: la costura, que mide si se oye dónde termina un morfema y empieza el otro, y la congruencia, que no sale de la fonética sino del derecho de marcas.
Lo que hubo que recalibrar: perfil_marcas.py mide su molde sobre 58 marcas de una palabra, y un compuesto de once letras repite sonidos por construcción, así que ese molde lo castigaría por ser largo y no por ser malo. Se midió un perfil aparte sobre 40 marcas compuestas reales. Resultado: la mezcla de clases de sonido es casi idéntica (oclusivas 0,406 contra 0,416) pero la diversidad de consonantes baja de 0,936 a 0,901. Y el término de sílabas, que antes daba −18 a todo lo de cuatro sílabas o más, pasó a ser una campana centrada en las 2,90 ± 0,80 sílabas medidas en esas mismas marcas. Misma lección de siempre: blanco medido, no dirección.
La barra de cada nombre es su puntaje: cada segmento mide lo que aportó un criterio. Toca cualquiera para ver los dos morfemas, qué significan, de dónde sale cada definición y el desglose criterio por criterio.
Cada candidato se preguntó a los trece servidores autoritativos de .com de Verisign, y los que no estaban en la zona se confirmaron contra el RDAP oficial, porque un dominio registrado sin nameservers da el mismo NXDOMAIN que uno libre. Esta es la tabla del terreno.
| Tipo y largo | Probados | Libres |
|---|---|---|
| compuesto, 12 letras | 1.262 | 96.8% |
| compuesto, 11 letras | 3.608 | 95.1% |
| compuesto, 10 letras | 6.262 | 90.9% |
| compuesto, 9 letras | 5.679 | 87.4% |
| compuesto, 8 letras | 2.584 | 75.1% |
| compuesto, 7 letras | 736 | 45.5% |
| real, 9 letras | 832 | 6.2% |
| real, 8 letras | 1.289 | 4.6% |
| real, 7 letras | 1.524 | 4.1% |