VIBECODING 365 / DICTIONARY
OpenAI Responses API
OpenAI Responses API
DEFINITION
Responses API는 OpenAI가 Chat Completions를 이은 새 기본 표면이다. 마이그레이션 가이드는 Chat Completions도 계속 지원하지만, 새 프로젝트에는 Responses를 권한다고 적는다. 한 요청 안에서 웹 검색, 파일 검색, 컴퓨터 사용, 코드 인터프리터, 이미지 생성, 원격 MCP, 직접 만든 함수를 돌리는 에이전트 루프를 목표로 한다. 엔드포인트는 응답 객체를 새로 만들고, 객체에 고유 id가 붙는다. 주어는 OpenAI다.
messages가 아니라 Items
Chat Completions는 입출력이 messages 배열이다. Responses는 input과 output에 타입이 다른 Item을 둔다. 메시지뿐 아니라 reasoning, function_call, 그 결과 같은 단위가 따로 있다. 가이드는 여러 관심사를 한 메시지에 붙이던 방식보다, 모델이 한 일의 기본 단위를 더 잘 나타낸다고 한다. n으로 여러 생성을 나란히 받던 파라미터는 없고 한 번만 생성한다. 문자열 하나나 메시지 목록을 input으로 넣을 수 있고, 시스템급 안내는 맨 위 instructions에 둔다.
이전 응답 id로 잇기
대화를 직접 쌓아 보내지 않고 previous_response_id에 직전 응답 id를 넣으면 서버가 앞 맥락을 이어 준다. 다음 턴에는 새 사용자 입력만 보내면 된다. 다만 직전 응답의 맨 위 instructions는 따라오지 않으므로, 고정 안내는 매 요청에 다시 넣으라고 가이드가 적는다. 체인해도 앞 입력 토큰은 입력으로 다시 과금된다. Conversations API는 더 오래 가는 대화 객체가 필요할 때 쓰는 다른 길이다. 대화 객체에 붙은 항목은 30일 만료를 따르지 않는다고 상태 문서가 적는다. 상태를 직접 관리하려면 이전 output Item을 다음 input에 붙이면 된다. 제작사는 내부 평가로 추론 모델에서 Chat Completions보다 SWE-bench가 3퍼센트 올랐고, 캐시 이용이 40에서 80퍼센트 나아졌다고 적는다. 숫자는 벤더 주장이다.
store 기본이 켜져 있다
Responses는 기본적으로 저장된다. Chat Completions는 새 계정에서 기본 저장이다. 끄려면 store를 false로 둔다. 대화 상태 문서는 응답 객체를 기본 30일 보관하고 대시보드나 조회로 볼 수 있다고 한다. 제로 데이터 리텐션 조직은 store가 강제로 꺼진다. 암호화된 추론 Item을 되돌려 상태를 끄고도 추론을 이어 가는 길도 안내한다. 백그라운드 모드는 background를 true로 두고 폴링한다. OpenAI 취소 레퍼런스는 background로 만든 응답만 취소할 수 있다고 한다. 동기 요청을 멈추려면 연결을 끊으라고 백그라운드 가이드가 적는다.
호스터가 다시 맞추는 표면
추론 클라우드가 같은 SDK 경로를 열어 주더라도, 서버 쪽 빌트인 툴·보관 기간·조회 API·백그라운드는 OpenAI와 다를 수 있다. Neuralwatt 문서는 요청을 내부적으로 채팅 완료 파이프라인으로 내린 뒤 출력 형태만 Responses로 맞춘다고 적는다. 그곳의 24시간 핫 스토어와 인플라이트 취소, 조회 엔드포인트 없음은 호스터 정책이다. OpenAI 보관·툴·취소 규칙과 한 문장에 섞지 말고, 견적과 라우팅만 호스터 문서로 확인한다.
ENGLISH
OpenAI Responses API
EXAMPLE
responses.create에 input을 보내고, 돌아온 id를 다음 요청의 previous_response_id에 넣어 대화를 잇는다. 고정 안내는 매 턴 instructions에 다시 넣는다.
관련
이어서 볼 문서
RELATED TERMS
연관 용어
Anthropic Messages API
Anthropic SDK·Claude Code용 Messages 형식. Neuralwatt /v1/messages는 문서상 전 계정 GA.
ai DeepSeek V4 FlashDeepSeek-V4-Flash
DeepSeek가 2026년 4월에 연 V4 Preview의 빠른 축이다. 가중치는 총 284B·활성 13B·1M 컨텍스트다. 지금 공식 API에서 같은 문자열은 V4.1-Flash로 임시 넘어간다.
ai Flex 티어Flex Tier
Neuralwatt가 같은 모델에 붙이는 할인 티어다. 여유 용량이 있으면 바로 시작하고, 바쁠 때는 스트림을 유지한 채 잠시 홀드한다. 스트리밍이 아니면 표준 요금으로 조용히 폴백한다.