핵심 요약
- 단어의 긍·부정, 중요도, 확신도 등 문맥을 분석해 글자 색상, 굵기, 기울임꼴을 자동으로 지정하는 라이브러리 'semfont'가 공개되었습니다.
- 단순 단어 매칭을 넘어 '고쳤다(fixed)'와 결합한 '버그'는 긍정으로 인식하는 등 문맥상의 반어법과 뉘앙스까지 포착합니다.
- 대량의 답변을 쏟아내는 AI 스트리밍 챗봇 등에 붙여 긴 텍스트를 한눈에 읽기 쉽게 만드는 용도로 고안되었습니다.
요약 개발자 로한 아드완카(Rohan Adwankar)가 작성된 문장의 의미와 뉘앙스를 스스로 분석해 글꼴 스타일을 실시간으로 바꿔주는 자바스크립트 라이브러리 'semfont'를 공개했습니다. 이 도구는 텍스트를 읽고 단어의 성격에 맞춰 색상, 굵기, 기울임꼴(이탤릭), 형광펜 하이라이트 등의 타이포그래피를 자동으로 적용해 독자의 가독성을 높이는 것을 목표로 합니다.
semfont는 각 단어마다 4가지 점수를 매겨 시각적 스타일로 변환합니다. 첫째는 단어의 긍·부정을 나타내는 '감정가(Valence)'로 텍스트 색상에 대응하며, 앞선 부정어나 강조어에 따라 점수가 조절됩니다. 둘째는 단어의 중요도와 주목도를 뜻하는 '돌출도(Salience)'로 글자 굵기(Weight)로 표현되며, 단어의 희귀도와 본문 내 반복 횟수가 결합해 점수가 올라갑니다. 셋째는 문장의 반전이나 의외성을 나타내는 '놀람(Surprise)'으로 형광펜 하이라이트로 나타납니다. 넷째는 필자의 어조가 얼마나 확신에 차 있는지 보여주는 '확신도(Certainty)'로, 추측성 단어가 나오면 문장 전체가 살짝 기울어지며 이탤릭체로 표현됩니다.
초기 알고리즘은 앞뒤 몇 단어만 살피는 윈도우 방식이라 "I would not go so far as to call the new editor great(새 에디터가 훌륭하다고까지는 말 못 하겠다)"처럼 부정어가 멀리 떨어진 경우나, "We fixed the crash(크래시를 고쳤다)"처럼 부정적 단어(crash)가 긍정적 동사(fixed)로 해결된 맥락을 놓치는 한계가 있었습니다. 이를 해결하기 위해 문장 절 전체를 읽는 2차 분석 패스를 추가해 반어법이나 부정 문맥을 자연스럽게 반영하도록 개선했습니다.
개발자는 특히 LLM 같은 생성형 AI가 대량의 텍스트를 쏟아낼 때 독자가 이를 한눈에 파악하기 어렵다는 점에 주목했습니다. 이에 따라 스트리밍 챗봇 컴포넌트 등에 간단히 삽입해 AI 답변의 핵심과 뉘앙스를 직관적으로 읽을 수 있도록 지원하며, 테마 커스텀이나 개발자 고유 어휘 사전 등록도 가능합니다.
Sponsored · 광고