Hallo,
wenn ich eine CSV ins Telefonbuch importiere bekomme ich folgenden Fehler:
|2020-09-24 09:02:57|simplesql: 22021; 7; ERROR: invalid byte sequence for encoding "UTF8": 0xc3: INSERT INTO "028phonebook" ("028pho_bez","028pho_phone","028pho_firstname","028pho_lastname","028pho_organisation","028pho_email","028pho_mobile","028pho_homephone","028pho_fax","028pho_homephone_res","028pho_mobile_res","028pho_fax_res","028pho_phone_res","011acc_id","028pho_tmstmp") VALUES (?,?,?,?,?,?,?,?,?,?,?,?,?,?,?)|
|2020-09-24 09:02:57|import.io_phonebook: 22021; 7; ERROR: invalid byte sequence for encoding "UTF8": 0xc3|
iconf, recode und isutf8 finden keinen UTF8 Fehler.
Ich wüsste gerne welcher Datensatz der knapp 7.000 das ist. Wie könnte ich das herausfinden?
TIA
Matthias
DBS
March 5, 2024, 10:39am
2
Ich grabe den Thread mal aus
Wir stoßen gerade auf den gleichen Fehler im JobLog. Der Fehler scheint bei 3 Datensätzen aufzutreten, ich wüsste nur gerne bei welchen. Ich bekomme es nicht eingegrenzt.
In einem anderne Thread war es die Länge des FIrmennamens, das habe ich mal testweise angepasst in meiner Datei, daran scheint es nicht zu liegen.
Wie kann ich herausfinden welcher Datensatz den Fehler auslöst? Unsere CSV hat rund 24.000 Einträge…
Danke für eure Zeit!
Richard
Dann grabe ich gut zwei Jahre später hier mal weiter.
Ich hatte das gleiche Problem mit den Feldlängen für ‘Anzeigename‘ und ‘Organisation‘.
Die folgenden Tabellen führen die maximalen Zeichenlängen für alle Felder auf, die in Connector-Importvorlagen (Benutzerimport, Telefonbuch-/Kontaktimport, Kurzwahlimport) verwendet werden können. | Übersicht der maximalen Zeichenlängen für...
Ich würde mal alle Längen der CSV Dateien überprüfen, oder im Connector die Variablen mit ‘substr‘ kürzen.
EDIT: Hier noch der Link zu dem Thread mit dem Firmennamen.
Wir benutzen die Version 7.17.10.R
Beim Import einer CSV-Datei (Connector) wird dabei die Variable “organisation” aus einer Tabelle mit der Überschrift “organisation” gemappt: organisation | return $row[‘organisation’]
Anscheinend gibt es dabei nur um die 70 Byte Platz. Ob das gut oder schlecht ist, sei dahin gestellt. Es führt aber in jedem Fall zu einem Problem, wenn der Puffer UTF-8 Zeichen enthält und gerade eines an der Grenze steht. Dann wird es sozusagen geteilt - 0xc3 bleibt drin, der …