Stream1 OpenAI vs Claude Stream 스트리밍이란?일반적인 LLM 호출은 모델이 답변을 모두 생성한 뒤 한 번에 반환한다.사용자 질문 ↓모델 생성 ↓전체 답변 반환반면 스트리밍을 사용하면 생성 중인 텍스트를 조각(chunk) 단위로 전달받는다.사용자 질문 ↓모델 생성 ↓"안녕""하세요""오늘은""..."사용자는 답변이 실시간으로 작성되는 것처럼 느끼게 된다.OpenAI 스트리밍 (stream = true)stream=True 를 사용OpenAI Chat Completions 호출에서 완성된 답변을 한 번에 기다리지 않고, 생성되는 텍스트 조각을 순서대로 받음반환 값은 완성 응답 객체가 아니라 반복가능한 스트림이 됨면접 코치 CLI에서 사용자는 피드백을 기다리는 동안 프로그램이 멈춘 것처럼 느낄 수 있음. .. 2026. 6. 5. 이전 1 다음