-
Notifications
You must be signed in to change notification settings - Fork 0
Home
parece que no README onde temos term_lib seria tlib.
Usando o sh make.sh para a base DL03. Temos as seguintes definições padronizadas de namespaces:
| nscount | nsid | label | description | lang | is_base | fk_partof | kx_regconf | jinfo | created |
|---|---|---|---|---|---|---|---|---|---|
| 1 | 1 | vianameprefix | Prefixo de nome de via (tipo de logradouro) | pt | t | portuguese | 2020-09-30 | ||
| 2 | 2 | vianame | Nome de via sem prefixo e por extenso | pt | t | portuguese | 2020-09-30 | ||
| 3 | 4 | vianameprefix-abv | Abreviação de prefixo de nome de via | pt | f | portuguese | 2020-09-30 |
CREATE or replace FUNCTION optim.vianame_insert(
-- falta inser-array para lotes
p_name text, -- nome completo da via
p_is_current boolean DEFAULT true
) RETURNS int AS $f$
WITH afixes AS (
SELECT aa[2] as prefix_id, CASE WHEN aa[2] is not null THEN
tstore.upsert( array_to_string(p[aa[1]+1:],' '), 2 )
ELSE NULL END as sufix_id
FROM (
SELECT p, CASE
-- not elegant code but supposing compiler optimization (otherwise better is pgPLSQL)
WHEN tlib.n2c_check(array_to_string(p[1:3],' '),1) is not null THEN array[3, tlib.n2c_check(array_to_string(p[1:3],' '),1) ]
WHEN tlib.n2c_check(p[1]||' '||p[2],1) is not null THEN array[2, tlib.n2c_check(p[1]||' '||p[2],1)]
WHEN tlib.n2c_check(p[1],1) is not null THEN array[1, tlib.n2c_check(p[1],1)]
WHEN tlib.n2c_check(p[1],3) is not null THEN array[1, tlib.n2c_check(p[1],3)]
ELSE null
END AS aa
FROM (SELECT regexp_split_to_array(tlib.normalizeterm(p_name),'\s+')) t1(p) -- or lower(unaccent(trim(p_name)))
) t2
) -- ,ins1 AS (
INSERT INTO optim.vianame (tprefix_id, tname_id, is_current)
SELECT prefix_id, sufix_id, p_is_current
FROM afixes
WHERE prefix_id IS NOT NULL AND sufix_id IS NOT NULL
ON CONFLICT DO NOTHING
RETURNING tprefix_id
$f$ language SQL;
-- ex. select optim.vianame_insert(x) FROM (SELECT DISTINCT jtags->>'name' AS x from osm_road where jtags?'name') t;CREATE TABLE optim.vianame(
id serial NOT NULL PRIMARY KEY,
tprefix_id int NOT NULL REFERENCES optim.term(id), -- rua, avenida, etc.
tname_id int NOT NULL REFERENCES optim.term(id), -- nome mesmo
is_current boolean NOT NULL DEFAULT true
,UNIQUE(tprefix_id,tname_id)
);
CREATE VIEW optim.vw01_vianame AS
select v.*, t1.term||' '||t2.term as via_name
from optim.vianame v
INNER JOIN tstore.term t1 ON v.tprefix_id=t1.id
INNER JOIN tstore.term t2 ON v.tname_id=t2.id
;
---
CREATE or replace FUNCTION optim.vianame_insert(
-- falta insert-array para conjuntos
p_name text, -- nome completo da via
p_is_current boolean DEFAULT true
) RETURNS int AS $f$
WITH afixes AS (
SELECT aa[2] as prefix_id, CASE WHEN aa[2] is not null THEN
COALESCE( tstore.upsert( array_to_string(p[aa[1]+1:],' '), 2 ), tlib.n2c_check(array_to_string(p[aa[1]+1:],' '),2) )
ELSE NULL END as sufix_id
FROM (
SELECT p, CASE
-- not elegant code but supposing compiler optimization (otherwise better is pgPLSQL)
WHEN tlib.n2c_check(array_to_string(p[1:3],' '),1) is not null THEN array[3, tlib.n2c_check(array_to_string(p[1:3],' '),1) ]
WHEN tlib.n2c_check(p[1]||' '||p[2],1) is not null THEN array[2, tlib.n2c_check(p[1]||' '||p[2],1)]
WHEN tlib.n2c_check(p[1],1) is not null THEN array[1, tlib.n2c_check(p[1],1)]
WHEN tlib.n2c_check(p[1],4) is not null THEN array[1, tlib.n2c_check(p[1],4)]
ELSE null
END AS aa
FROM (SELECT regexp_split_to_array(tlib.normalizeterm(p_name),'\s+')) t1(p) -- or lower(unaccent(trim(p_name)))
) t2
) -- ,ins1 AS (
INSERT INTO optim.vianame (tprefix_id, tname_id, is_current)
SELECT prefix_id, sufix_id, p_is_current
FROM afixes
WHERE prefix_id IS NOT NULL AND sufix_id IS NOT NULL
ON CONFLICT DO NOTHING
RETURNING tprefix_id
$f$ language SQL;
-- ex. select optim.vianame_insert(x) FROM (SELECT DISTINCT jtags->>'name' AS x from osm_road where jtags?'name') t;
-- ex. select optim.vianame_insert(x) FROM (select distinct logradouro as x from lix order by 1) t;| osm_id | parent_abbrev | name | jurisd_local_id |
|---|---|---|---|
| 242397 | RS | Porto Alegre | 4314902 |
| 297599 | PR | Pato Branco | 4118501 |
| 298426 | SP | Cabreúva | 3508405 |
CREATE VIEW br_pr_patobranco.v_endereco AS -- mais importante
SELECT n_lt.gid,
n_lt.geom,
n_lt.quadra,
n_lt.lote,
e.logradouro,
e.num_pred
FROM br_pr_patobranco.v_num_lote n_lt
JOIN br_pr_patobranco.endereco e ON n_lt.chave = ((e.num_quadra::text || '_'::text) || e.num_lote::text)
;
CREATE VIEW br_pr_patobranco.v_num_lote
SELECT n_lt.gid,
n_lt.geom,
n_lt.text AS lote,
v_qd.quadra,
((v_qd.quadra::text || '_'::text) || 0) || n_lt.text::text AS chave
FROM br_pr_patobranco.num_lote n_lt
JOIN br_pr_patobranco.v_quadra v_qd ON st_intersects(n_lt.geom, v_qd.geom)
;
CREATE VIEW br_pr_patobranco.v_quadra AS
SELECT qd.gid,
qd.geom,
n_qd.quadra
FROM br_pr_patobranco.quadras qd
JOIN br_pr_patobranco.v_num_quadra n_qd ON qd.gid = n_qd.qd_gid
;
---------------------
-- lix contem br_pr_patobranco.v_endereco
select optim.vianame_insert(x) FROM (select distinct logradouro as x from lix order by 1) t; -- ok
-- SELECT DISTINCT jtags->>'name' AS x FROM osm_road WHERE jurisdiction_osm_id=297599 AND jtags?'name';
-- SELECT tstore.upsert_normalize('Perimetral',1,null,true,null,false,true,1) as is_ok;
select optim.vianame_insert(x) FROM (SELECT DISTINCT jtags->>'name' AS x FROM osm_road WHERE jurisdiction_osm_id=297599 AND jtags?'name') t;A canonização pode ocorrer posteriormente ao registro da rua, e pode ser de dois tipos:
-
canonização terminológica: por exemplo formas acentuada e sem acento.
neste caso a resolução é feita na base terminológica, e o ID precisa ser modificado no registro de via. -
canonização específica: por exemplo nomes abreviados "João M. Silva" pode ser "João Maria Silva" numa cidade e "João Merlin Silva" na outra.
Neste caso a entrada do sinônimo é dada emoptim.vianame_synonyme o dado original deoptim.vianamemodificado.
O correto é canonizar sinônimos depois de registrada a via, ou seja, é o algoritmo mais complexo... Por hora avaliemos apenas a canonização terminológica a priori:
create view tstore.vw_ns2term_pair_accent AS
select t1.id id1, t1.fk_canonic canonic1, t1.term term1, t2.term term2, t2.id id2, t2.fk_canonic canonic2
from tstore.term t1, tstore.term t2
where t1.fk_ns=2 AND t2.fk_ns=2
AND t1.id>t2.id
AND unaccent(t1.term)=unaccent(t2.term) AND t1.term!=t2.term AND t1.fk_canonic is null and t2.fk_canonic is null
order by t1.term, t2.term
;
-- copy (select * from tstore.vw_ns2term_pair_accent) to '/tmp/nomesAcent.csv' CSV HEADER;