Implementacja (s) nie działają dla znaków spoza ASCII,
(defn hexify [s]
(apply str
(map #(format "%02x" (int %)) s)))
(defn unhexify [hex]
(apply str
(map
(fn [[x y]] (char (Integer/parseInt (str x y) 16)))
(partition 2 hex))))
(= "\u2195" (unhexify(hexify "\u2195")))
false ; should be true
Aby temu zaradzić trzeba serializować bajtów ciąg znaków za pomocą wymaganego kodowania znaków, który może być wielobajtowy na znak.
Jest kilka "problemów" z tym.
- Pamiętaj, że wszystkie typy liczbowe są podpisane w JVM.
- Brak bajtu bez znaku.
W idiomatycznej java używałbyś niskiego bajtu liczby całkowitej i zamaskowałbyś go tak, gdziekolwiek go używałeś.
int intValue = 0x80;
byte byteValue = (byte)(intValue & 0xff); -- use only low byte
System.out.println("int:\t" + intValue);
System.out.println("byte:\t" + byteValue);
-- output:
-- int: 128
-- byte: -128
clojure ma (unchecked-byte)
, aby skutecznie zrobić to samo.
Na przykład za pomocą UTF-8 można to zrobić:
(defn hexify [s]
(apply str (map #(format "%02x" %) (.getBytes s "UTF-8"))))
(defn unhexify [s]
(let [bytes (into-array Byte/TYPE
(map (fn [[x y]]
(unchecked-byte (Integer/parseInt (str x y) 16)))
(partition 2 s)))]
(String. bytes "UTF-8")))
; with the above implementation:
;=> (hexify "\u2195")
"e28695"
;=> (unhexify "e28695")
"↕"
;=> (= "\u2195" (unhexify (hexify "\u2195")))
true
użyć biblioteki Java? – Marcin
Już to zrobiłeś – Ankur
@Ankur: Najwyraźniej nie tak, jak pokazuje odpowiedź sw1nn - dlatego potrzebuję istniejącej funkcji, jeśli to możliwe. –