오픈AI, GPT-5.3 인스턴트 출시…환각 현상 27% 감소
구글 딥마인드가 ‘제미니 3.1 플래시-라이트(Gemini 3.1 Flash-Lite)’를 공개한 지 불과 2시간 만에, 오픈AI는 전례 없는 속도로 움직이며 현재까지 가장 정교하게 다듬어진 대화형 모델인 ‘GPT-5.3Instant’를 공식 출시했다.
다양한 최첨단(SOTA) 벤치마크 달성만을 우선시했던 이전 버전들과 달리, OpenAI는 이번에는 순위 경쟁을 접고 사용자 상호작용에서 가장 지속적으로 제기되던 문제점들을 직접 해결하는 매우 실용적인 전략을 채택했습니다.

1. “설교하는” 어조 제거: 답변의 완결성보다 대화의 연속성을 우선시
많은 ChatGPT 사용자들이 다음과 같은 좌절감을 경험한 적이 있습니다. 복잡한 질문을 던졌더니, 세 단락에 달하는 면책 조항과 “당신을 위한 것”이라는 식의 거만한 어조로 거절당하는 경우입니다.
불필요한 내용 제거: GPT-5.3Instant는 장황한 안전 경고 문구를 대폭 줄였습니다.
사례 연구: 장거리 양궁 탄도 계산 테스트에서, 이전 버전은 해당 시나리오가 위험한 행동을 암시하는지 여부를 논하며 추가 맥락을 요청하다가 응답이 중단되곤 했습니다. 반면 5.3Instant는 “문제없습니다. 도와드릴 수 있습니다”라고 응답한 뒤 즉시 관련 공식을 제공합니다.
2. 환각 현상의 대폭 감소: 허구적 내용 감소, 통찰력 증대
OpenAI의 시스템 문서는 새 모델의 정확도가 크게 향상되었음을 강조합니다:
주요 지표: 위험 부담이 큰 분야(의학, 법률, 금융)에 대한 평가 결과, 인터넷에 연결된 상태에서 환각 발생률이 26.8% 감소한 것으로 나타났으며, 사용자 피드백 평가에서도 오류율이 22.5% 하락한 것으로 확인되었습니다.
강화된 검색 기능: 이 모델은 단순한 “콘텐츠 집계기”를 넘어 진화했습니다. “2026년 MLB 오프시즌 영입”과 같은 시의성 있는 질의에 대해, 이 모델은 단순히 기계적인 링크를 출력하는 대신 **카일 터커의 다저스 입단(4년, 2억 4천만 달러)**에 관한 뉴스를 정확히 식별하고, 리그 맥락을 바탕으로 한 심층적인 분석을 제공합니다.
3. 글쓰기 “각성”: 추상적인 감정에서 미묘한 공감으로
업데이트된 버전은 창의적 글쓰기 과제에서 더 높은 수준의 감성 지능을 보여줍니다:
진부한 표현 감소: 이 모델은 “잠시 멈추고 심호흡을 해보세요”와 같은 어색한 상투적 표현을 피합니다.
시적인 구체성: “은퇴한 우편 배달부의 마지막 배달”을 묘사할 때, 이 모델은 일반적인 슬픔의 표현을 넘어 “현관의 벗겨진 파란 난간”이나 “우편함이 닫히며 내는 은은한 딸깍 소리”와 같은 구체적인 세부 사항을 포착하여, 생생한 이미지를 통해 더 깊은 공감을 불러일으키는 이야기를 만들어 냅니다.
4. 전략적 전환: 벤치마크 경쟁보다 사용자 경험 우선
이번 릴리스는 분명한 메시지를 전달합니다. Gemini 3. 1과 Claude 4.6이 성능 격차를 좁혀옴에 따라, OpenAI는 벤치마크 순위를 둘러싼 소수점 단위의 경쟁을 피하고, 대신 제품 사용성 개선에 전적으로 집중하기로 선택했습니다.
GPT-5.3Instant는 현재 ChatGPT 웹사이트와 모바일 앱에서 이용할 수 있으며, 개발자들은 gpt-5.3-chat-latest 식별자를 사용하여 API를 통해 접근할 수 있습니다. 이와 동시에, OpenAI는 GPT-5.4의 현황을 명확히 밝혔습니다 .
관련 기사
IDC, 중국 생성형 AI 보안 평가 플랫폼 보고서 발표… 앤트 디지털, 리더로 선정
기업들이 고객 서비스 및 관리와 같은 핵심 업무에 AI를 점점 더 많이 도입함에 따라 보안 위험도 더욱 복잡해지고 있습니다. 모델 탈옥(jailbreak)이나 데이터 유출과 같은 전통적인 위협을 넘어, 도구 악용, 에이전트 권한 상승, 다중 에이전트 공격과 같은 새로운 과제들이 대두되고 있습니다.8월 20일, 국제데이터코퍼레이션(IDC)은 “IDC Mark
메타, 부모들의 동화 읽어주기 어려움을 해결하기 위해 AI 취침 동화 앱 ‘StoryKit’을 테스트 중
바쁜 부모들을 돕기 위해 개발된 ‘메타(Meta)’는 아이들을 위한 맞춤형 잠자리 동화를 생성해 주는 AI 기반 앱 ‘스토리킷(StoryKit)’을 시범 운영 중입니다. 이 앱은 맞춤형 등장인물, 장면, 음악까지 모두 갖춘 동화를 제공합니다.부모는 직접 글을 쓸 필요 없이 자녀가 가장 좋아하는 장난감 사진을 업로드하기만 하면 생생한 캐릭터가 만들어집니다.
Qwen 3.7 프리뷰 모델 출시: 향상된 수학, 코딩 및 다중 모드 기능
대규모 언어 모델의 급속한 발전은 계속해서 한계를 넓혀가고 있습니다. 알리바바는 Qwen Chat과 Arena AI(구 LMArena)를 통해 Tongyi Qwen 3.7 시리즈의 두 가지 프리뷰 버전인 Qwen3.7-Max-Preview와 Qwen3.7-Plus-Preview를 조용히 공개했습니다. 이 버전들은 오는 5월 20일 개최될 알리바바 클라우드
관련 특별 주제 추천
의견 (0)
0/500
구글 딥마인드가 ‘제미니 3.1 플래시-라이트(Gemini 3.1 Flash-Lite)’를 공개한 지 불과 2시간 만에, 오픈AI는 전례 없는 속도로 움직이며 현재까지 가장 정교하게 다듬어진 대화형 모델인 ‘GPT-5.3Instant’를 공식 출시했다.
다양한 최첨단(SOTA) 벤치마크 달성만을 우선시했던 이전 버전들과 달리, OpenAI는 이번에는 순위 경쟁을 접고 사용자 상호작용에서 가장 지속적으로 제기되던 문제점들을 직접 해결하는 매우 실용적인 전략을 채택했습니다.

1. “설교하는” 어조 제거: 답변의 완결성보다 대화의 연속성을 우선시
많은 ChatGPT 사용자들이 다음과 같은 좌절감을 경험한 적이 있습니다. 복잡한 질문을 던졌더니, 세 단락에 달하는 면책 조항과 “당신을 위한 것”이라는 식의 거만한 어조로 거절당하는 경우입니다.
불필요한 내용 제거: GPT-5.3Instant는 장황한 안전 경고 문구를 대폭 줄였습니다.
사례 연구: 장거리 양궁 탄도 계산 테스트에서, 이전 버전은 해당 시나리오가 위험한 행동을 암시하는지 여부를 논하며 추가 맥락을 요청하다가 응답이 중단되곤 했습니다. 반면 5.3Instant는 “문제없습니다. 도와드릴 수 있습니다”라고 응답한 뒤 즉시 관련 공식을 제공합니다.
2. 환각 현상의 대폭 감소: 허구적 내용 감소, 통찰력 증대
OpenAI의 시스템 문서는 새 모델의 정확도가 크게 향상되었음을 강조합니다:
주요 지표: 위험 부담이 큰 분야(의학, 법률, 금융)에 대한 평가 결과, 인터넷에 연결된 상태에서 환각 발생률이 26.8% 감소한 것으로 나타났으며, 사용자 피드백 평가에서도 오류율이 22.5% 하락한 것으로 확인되었습니다.
강화된 검색 기능: 이 모델은 단순한 “콘텐츠 집계기”를 넘어 진화했습니다. “2026년 MLB 오프시즌 영입”과 같은 시의성 있는 질의에 대해, 이 모델은 단순히 기계적인 링크를 출력하는 대신 **카일 터커의 다저스 입단(4년, 2억 4천만 달러)**에 관한 뉴스를 정확히 식별하고, 리그 맥락을 바탕으로 한 심층적인 분석을 제공합니다.
3. 글쓰기 “각성”: 추상적인 감정에서 미묘한 공감으로
업데이트된 버전은 창의적 글쓰기 과제에서 더 높은 수준의 감성 지능을 보여줍니다:
진부한 표현 감소: 이 모델은 “잠시 멈추고 심호흡을 해보세요”와 같은 어색한 상투적 표현을 피합니다.
시적인 구체성: “은퇴한 우편 배달부의 마지막 배달”을 묘사할 때, 이 모델은 일반적인 슬픔의 표현을 넘어 “현관의 벗겨진 파란 난간”이나 “우편함이 닫히며 내는 은은한 딸깍 소리”와 같은 구체적인 세부 사항을 포착하여, 생생한 이미지를 통해 더 깊은 공감을 불러일으키는 이야기를 만들어 냅니다.
4. 전략적 전환: 벤치마크 경쟁보다 사용자 경험 우선
이번 릴리스는 분명한 메시지를 전달합니다.
GPT-5.3Instant는 현재 ChatGPT 웹사이트와 모바일 앱에서 이용할 수 있으며, 개발자들은 gpt-5.3-chat-latest 식별자를 사용하여 API를 통해 접근할 수 있습니다. 이와 동시에, OpenAI는 GPT-5.4의 현황을 명확히 밝혔습니다 .
IDC, 중국 생성형 AI 보안 평가 플랫폼 보고서 발표… 앤트 디지털, 리더로 선정
기업들이 고객 서비스 및 관리와 같은 핵심 업무에 AI를 점점 더 많이 도입함에 따라 보안 위험도 더욱 복잡해지고 있습니다. 모델 탈옥(jailbreak)이나 데이터 유출과 같은 전통적인 위협을 넘어, 도구 악용, 에이전트 권한 상승, 다중 에이전트 공격과 같은 새로운 과제들이 대두되고 있습니다.8월 20일, 국제데이터코퍼레이션(IDC)은 “IDC Mark
메타, 부모들의 동화 읽어주기 어려움을 해결하기 위해 AI 취침 동화 앱 ‘StoryKit’을 테스트 중
바쁜 부모들을 돕기 위해 개발된 ‘메타(Meta)’는 아이들을 위한 맞춤형 잠자리 동화를 생성해 주는 AI 기반 앱 ‘스토리킷(StoryKit)’을 시범 운영 중입니다. 이 앱은 맞춤형 등장인물, 장면, 음악까지 모두 갖춘 동화를 제공합니다.부모는 직접 글을 쓸 필요 없이 자녀가 가장 좋아하는 장난감 사진을 업로드하기만 하면 생생한 캐릭터가 만들어집니다.
Qwen 3.7 프리뷰 모델 출시: 향상된 수학, 코딩 및 다중 모드 기능
대규모 언어 모델의 급속한 발전은 계속해서 한계를 넓혀가고 있습니다. 알리바바는 Qwen Chat과 Arena AI(구 LMArena)를 통해 Tongyi Qwen 3.7 시리즈의 두 가지 프리뷰 버전인 Qwen3.7-Max-Preview와 Qwen3.7-Plus-Preview를 조용히 공개했습니다. 이 버전들은 오는 5월 20일 개최될 알리바바 클라우드





집






