바이브코딩
Neuralwatt You asked, we shipped | Flash 상한·Max·포털 Performance
설문 반영 업데이트: 에너지 청구 천장, Pro 위 Max, Performance 관측, DeepSeek Flash GA
Neuralwatt는 2026년 9월 17일(이메일 발송일 기준) 제품 업데이트 메일 「You asked, we shipped」를 보냈다. 몇 주 전 설문으로 받은 요청을 반영해 Flash 모델 에너지 청구 상한, Pro 위 구독 Neuralwatt Max, 포털 전면 개편과 Performance 페이지, DeepSeek Flash 계열 GA 일정, 설문 직결 운영 기능을 한꺼번에 알렸다.
조사 기준일은 2026년 9월 17일(Asia/Seoul)이다. 이메일 문장은 원문 보관본을 따른다. 구독 금액, 포함 kWh, 초과 단가는 같은 날 portal.neuralwatt.com/pricing HTML과 플랜 JSON과 교차했다. DeepSeek V4 Flash, V4.1 Flash, V4 Pro의 모델 원 제작사는 DeepSeek이고, GLM-5.3 Flash의 원 계열은 Zhipu GLM 쪽이다. Neuralwatt는 호스팅과 에너지 계측, 청구 계층이다.
바이브 코딩으로 API와 에이전트를 돌리는 독자가 메일 한 통을 과금, 동시성, 관측 UI 단위로 읽도록 정리한다. 포털에 아직 안 보이거나 경로가 공개되지 않은 항목은 이메일 전용으로 표시한다.
핵심 포인트: Flash 상한은 에너지 청구가 토큰 환산을 넘지 않게 막는 보호 장치다. Max의 28.57 kWh, 월 $200, 연 $2000은 포털과 이메일이 맞다. 동시 15요청은 이메일만의 숫자다.

뉴스레터 원문 (영문)
아래는 Neuralwatt가 보낸 업데이트 메일 전문이다. 맞춤법과 반복 구문도 원문 그대로 둔다.
Hi Neuralwatters,
Transparency is a word we use a lot at Neuralwatt, usually about energy. But it applies just as much to how we build, in the open, and in conversation with you. A few weeks ago we asked you what we should build next. You told us, in detail, and so this update covers the changes we've made based on your requests.
Flash model price ceilings
On Flash models, token prices run so low that the two billing methods converge, and sometimes cross. So as of today, there's a ceiling, where no energy-billed request on GLM-5.3 Flash, DeepSeek V4 Flash, or DeepSeek V4.1 Flash will exceed the equivalent token price. If energy comes out higher, you will pay the token price instead. Our goal is still to get energy per request below token pricing on these models, and until we achieve this, you will not have to pay extra.
Introducing Neuralwatt Max
Some of you also have also been asking about a subscription tier above Pro, noting that you needed more room to grow. For $200 a month, Neuralwatt Max offers 28.57 kWh, roughly double the Pro allowance, with overage billed at the same rate. It carries the highest concurrency we offer, 15 requests at once. If you'd rather commit for the year, an annual subscription is $2000 and brings down the monthly rate. Neuralwatt Max is now live on the pricing page, and existing subscribers can upgrade any time.
Have you checked out the Portal?
The portal has been redesigned end to end, and it's looking pretty good if we do say so ourselves. It's been rebuilt for phone-width screens, with a proper dark mode, and has a new look and feel.
You'll also see that the new Performance page offers two new views side by side: live Energy status, featuring the average energy per request updated hourly, and Model performance, showing first-token time, throughput, and cache hit rates per model, measured from the last seven days of real traffic. Also, every model now has an even deeper detail page behind it.
Have a click around, and let us know what you think.
Model updates
Many of you have been putting the DeepSeek Flash previews through their paces, and they're now ready. V4 Flash moves to general availability today, with V4.1 Flash right behind it later this week. Both arrive with extended cache tiers and are Flex enabled, so your cache rates should feel the difference. The speed tier you've been testing on V4 Flash graduates too, and we have a V4.1 version is in the works. As for DeepSeek V4 Pro, it's staying in preview a little longer while DeepSeek's Pro roadmap takes shape.
Straight from the survey
A few more fixes that came directly from your feedback. The model list can now be sorted by energy per request, so if you bill by energy you can compare models in the unit you pay. Per-model energy pricing is available as a JSON endpoint you can call directly. And you can now set a daily energy cap on any API key, so a runaway agent loop gets throttled instead of becoming a surprise on your bill.
Thank you for the feedback that shaped all of this, and check out the Discord for the deep dive community video.
Chad, Scott, and the Neuralwatt team.뉴스레터 한국어 번역
Neuralwatters 여러분께,
투명성은 Neuralwatt가 에너지 이야기에서 자주 쓰는 말이다. 다만 그 말은 우리가 여러분과 대화하며 공개적으로 제품을 만드는 방식에도 그대로 적용된다. 몇 주 전 우리는 다음에 무엇을 만들지 물었다. 여러분은 자세히 답했고, 그래서 이번 업데이트는 그 요청을 바탕으로 바꾼 내용을 다룬다.
Flash 모델 가격 상한 Flash 모델에서는 토큰 가격이 너무 낮아 두 청구 방식이 수렴하고, 때로는 서로 교차한다. 그래서 오늘부터 상한이 있다. GLM-5.3 Flash, DeepSeek V4 Flash, DeepSeek V4.1 Flash에 대해 에너지로 청구되는 요청이 동등한 토큰 가격을 넘지 않는다. 에너지 쪽이 더 높게 나오면 토큰 가격을 낸다. 목표는 여전히 이 모델들에서 요청당 에너지를 토큰 가격보다 낮추는 것이고, 그 목표에 도달할 때까지 여러분은 추가로 내지 않아도 된다.
Neuralwatt Max 소개 Pro 위에 구독 티어가 필요하다는 요청도 있었다. 성장할 여지가 더 필요하다는 이야기다. 월 $200에 Neuralwatt Max는 28.57 kWh를 제공한다. Pro 허용량의 대략 두 배이며, 초과분은 같은 요율로 청구된다. 우리가 제공하는 최고 동시성인 한 번에 15요청을 지원한다. 연간으로 묶고 싶다면 연 구독은 $2000이며 월 환산 부담을 낮춘다. Neuralwatt Max는 지금 가격 페이지에서 열려 있고, 기존 구독자는 언제든 업그레이드할 수 있다.
포털을 살펴보셨나요? 포털은 처음부터 끝까지 다시 설계됐고, 자체 평가로는 꽤 좋아 보인다. 폰 폭 화면에 맞게 다시 만들었고, 제대로 된 다크 모드와 새 룩앤필을 넣었다. 새 Performance 페이지는 두 화면을 나란히 보여 준다. 시간마다 갱신되는 요청당 평균 에너지의 라이브 Energy status, 그리고 최근 7일 실제 트래픽으로 잰 모델별 첫 토큰 시간, 처리량, 캐시 적중률의 Model performance다. 또한 모든 모델 뒤에 더 깊은 상세 페이지가 생겼다. 한번 눌러 보시고, 의견을 알려 달라.
모델 업데이트 많은 분들이 DeepSeek Flash 프리뷰를 시험해 왔고, 이제 준비가 됐다. V4 Flash는 오늘 일반 제공(GA)으로 옮기고, V4.1 Flash는 이번 주 후반에 이어진다. 둘 다 확장된 캐시 티어와 함께 오며 Flex가 켜져 있어 캐시 비율 체감이 달라질 것이다. V4 Flash에서 시험하던 속도 티어도 함께 승격되고, V4.1용 속도 티어도 준비 중이다. DeepSeek V4 Pro는 DeepSeek의 Pro 로드맵이 잡히는 동안 프리뷰에 조금 더 머문다.
설문에서 바로 온 항목 피드백에서 바로 나온 수정이 몇 가지 더 있다. 모델 목록을 요청당 에너지로 정렬할 수 있어, 에너지로 청구하는 경우 지불 단위로 모델을 비교할 수 있다. 모델별 에너지 가격은 직접 호출할 수 있는 JSON 엔드포인트로도 열린다. 그리고 API 키마다 일일 에너지 상한을 둘 수 있어, 폭주한 에이전트 루프가 청구서 깜짝 비용이 되기 전에 제한된다.
이 모든 것을 만든 피드백에 감사드린다. 심층 커뮤니티 영상은 Discord에서 확인할 수 있다. Chad, Scott, and the Neuralwatt team.
Flash 가격 상한과 에너지·토큰 청구
이메일이 말하는 상한은 Flash 계열에서 에너지 청구와 토큰 청구가 맞닿을 때 에너지 쪽이 더 비싸지지 않게 막는 장치다. 대상은 메일 문장 기준 GLM-5.3 Flash, DeepSeek V4 Flash, DeepSeek V4.1 Flash 세 줄이다. 에너지로 잰 금액이 같은 요청의 토큰 환산보다 크면 토큰 쪽을 내고, Neuralwatt는 그 사이 구간에서 요청당 에너지를 토큰보다 낮추는 목표를 계속 둔다고 적었다.
2026년 9월 17일 포털 가격 페이지와 추정기 쪽 문구에는 요청 단위로 에너지 청구를 토큰 가격에 맞춰 상한한다는 설명이 보인다. 세 모델 이름을 한 문장에 묶어 나열한 표현은 이메일이 더 구체적이다. V4.1 Flash는 같은 날 공개 카탈로그 스크랩에서 아직 보이지 않았고, 메일 일정(이번 주 후반)과 맞춰 이메일 전용으로 둔다.
바이브 코딩 관점에서 상한의 실익은 저가 Flash를 에너지 모드로 돌리다가 캐시 미스, 긴 컨텍스트, 재시도가 겹칠 때 토큰 환산보다 비싸지는 구간을 잘라 주는 데 있다. 토큰 단가가 이미 매우 낮은 Flash에서는 두 방식이 자주 교차하므로, 상한이 없으면 에이전트 루프 한 번이 예상과 다른 청구로 이어질 수 있다. 반대로 상한이 있어도 측정 에너지, 캐시 적중, Flex 배수는 요청마다 달라지므로, 포털 Energy status와 키별 사용량을 같이 보는 편이 안전하다.
| 구분 | 이메일 | 2026-09-17 포털 교차 |
|---|---|---|
| 상한 규칙 | 에너지 청구 ≤ 동등 토큰 가격 | 요청 단위 토큰 대비 상한 설명 확인 |
| 대상 모델 | GLM-5.3 Flash, DeepSeek V4 Flash, V4.1 Flash | glm-5.3-flash, deepseek-v4-flash 카탈로그 확인. V4.1 Flash는 미등재 |
| 목표 문장 | 요청당 에너지를 토큰보다 낮추기 | 추정기·에너지 보드와 같은 방향의 서술 |
Neuralwatt Max와 Pro 비교
메일은 Max를 Pro 위 티어로 소개한다. 월 $200, 포함 28.57 kWh, Pro 허용량의 대략 두 배, 초과는 같은 요율, 동시 15요청, 연 구독 $2000이다. 같은 날 포털 플랜 JSON은 Max monthly_fee 200, included_kwh 약 28.571, plan_rate_per_kwh 7.0, annual_upfront 2000으로 메일과 맞는다.
Pro 숫자는 메일에 없다. 포털 기준으로 Pro는 월 $100, 포함 약 13.333 kWh, 초과 $7.50/kWh, 연 선납 $1000이다. 28.57÷13.33은 약 2.14배로, 메일의 roughly double과 모순되지 않는다. Max 초과 $7.00/kWh는 Pro 초과 $7.50과 다르며, 메일 same rate는 Max 자신의 플랜 요율을 가리키는 읽기가 포털과 맞다.
동시 15요청은 공개 가격 카드 문구에서 확인되지 않았다. 이메일 전용 숫자로 남긴다. 포털 Max 카드에는 부하 때 마지막에 느려지는 shed-last(또는 shed-last priority) 표현이 있다. Highest priority로 적힌 Pro 카드와 결이 다르다.

| 항목 | Pro (포털) | Max |
|---|---|---|
| 월 요금 | $100 | $200 (이메일·포털) |
| 포함 에너지 | 13.33 kWh | 28.57 kWh (이메일·포털) |
| 초과 단가 | $7.50/kWh | $7.00/kWh (포털) |
| 연간 선납 | $1,000 | $2,000 (이메일·포털) |
| 동시성 | 카드에 숫자 없음 | 이메일: 15요청 |
| 부하 시 표현 | Highest priority | Shed-last (포털) |
에이전트와 병렬 도구 호출이 많은 워크로드에서는 포함 kWh보다 동시성과 초과 단가가 먼저 병목이 된다. Max는 포함량이 Pro의 두 배 근처이고 초과 단가도 포털상 더 낮다. 다만 연 $2000 선납은 현금 흐름이 다른 선택이다. 미사용 포함분의 이월 여부는 이 메일에 없고, 기존 빌링 FAQ 규칙을 별도로 봐야 한다.
포털 개편과 Performance 페이지
메일은 포털을 전면 재설계했다고 적는다. 폰 폭, 다크 모드, 새 룩앤필이 한 묶음이다. 로그인 없는 공개 HTML만으로는 UI 스크린샷을 대신할 수 없어, 이 문단의 시각 주장은 이메일 전용으로 둔다.
Performance 페이지는 두 뷰를 나란히 둔다고 한다. 첫째는 시간마다 갱신되는 요청당 평균 에너지의 live Energy status다. 둘째는 최근 7일 실트래픽 기준 모델별 첫 토큰 시간, 처리량, 캐시 적중률이다. 모델마다 더 깊은 상세 페이지도 추가됐다고 한다. 같은 날 energy-pricing 쪽 공개 페이지에서는 Energy status, Performance, 캐시 관련 표현이 보였다. 첫 토큰 시간이라는 라벨 문자열 자체는 HTML 스크랩에서 단정하지 못했고, 메일이 더 구체적이다.
관측 UI가 바뀌면 바이브 코딩 팀의 어제보다 느린가 토론이 포털 숫자로 옮겨진다. 시간 단위 에너지 평균과 7일 모델 성능은 스케일이 다르므로, 장애 대응에는 짧은 창, 모델 선택에는 긴 창을 쓰는 식으로 역할을 나누는 편이 메일 설계와 맞다.
DeepSeek Flash GA와 모델 일정
모델 원 제작은 DeepSeek다. 메일에 따르면 DeepSeek V4 Flash는 오늘 GA, V4.1 Flash는 이번 주 후반, 둘 다 확장 캐시 티어와 Flex 활성, V4 Flash 속도 티어 승격, V4.1 속도 티어 준비 중, DeepSeek V4 Pro는 DeepSeek Pro 로드맵이 정리되는 동안 프리뷰 유지다.
2026년 9월 17일 포털 카탈로그 스크랩에서는 deepseek-v4-flash가 보였다. V4.1 Flash 표기는 같은 스크랩에 없었고, GA 오늘과 이번 주 후반을 구분한 메일 일정을 그대로 인용한다. Flex는 Neuralwatt 문서의 flex-tier 가이드와 이름상 맞물리며, 배율 숫자는 이 메일 본문에 없다. 이전 공개 문서에서 보던 배수를 이번 메일 사실로 재인용하지는 않는다.

| 항목 | 이메일 | 포털·문서 교차 |
|---|---|---|
| DeepSeek V4 Flash | 오늘 GA | deepseek-v4-flash 카탈로그 확인 |
| DeepSeek V4.1 Flash | 이번 주 후반 | 미등재, 이메일 일정 |
| 확장 캐시와 Flex | 둘 다 적용 | Flex 문서 존재. 배수와 캐시 티어 상세는 메일 밖 |
| 속도 티어 | V4 승격, V4.1 준비 | 공개 카드에서 별도 미확인 |
| DeepSeek V4 Pro | 프리뷰 유지 | 메일과 기존 프리뷰 서술과 방향 동일 |
프리뷰와 GA를 섞어 쓰면 에이전트 기본 모델 문자열이 갑자기 바뀌거나, 속도 티어 별칭이 사라질 수 있다. 메일이 승격을 알리는 날에는 코드의 모델 id, Flex 별칭, 캐시 전제부터 점검하는 편이 사고 비용이 적다.
설문에서 나온 운영 기능
메일 마지막 묶음은 설문에서 바로 온 세 가지다. 모델 목록을 요청당 에너지로 정렬하기, 모델별 에너지 가격 JSON 엔드포인트, API 키 단위 일일 에너지 상한이다. 세 항목 모두 공개 문서에서 경로와 스크린샷으로 완전히 교차되지 않아 이메일 전용으로 적는다.
문서의 allowances 가이드는 키와 세션 단위 USD 한도와 비용 헤더를 다룬다. 메일의 일일 에너지 캡은 단위가 kWh 쪽으로 읽히며, USD allowance와 같은지 다른지는 공개 문장만으로 단정하지 않는다. 에이전트 루프 폭주를 막으려는 목적은 두 장치가 같다.
에너지로 청구하는 팀에게 정렬, JSON, 일일 캡은 같은 방향이다. 비교 단위를 달러가 아니라 Wh나 kWh로 맞추고, 키마다 하루 상한을 걸어 두면 밤새 돈 루프가 청구서로 커지기 전에 끊긴다. JSON 경로가 메일에는 없어, 구현 전에 포털과 docs의 최신 엔드포인트 표를 다시 여는 수밖에 없다.
마무리
앞에서 다룬 Neuralwatt 2026년 9월 17일 메일의 핵심만 짧게 정리한다.
- Flash 상한: 에너지 청구가 토큰 환산을 넘지 않게 막는 보호. 대상 세 모델은 이메일 문장.
- Max: 월 $200, 28.57 kWh, 연 $2000은 포털과 일치. 동시 15는 이메일 전용.
- Pro 대비: 포털 Pro 13.33 kWh 기준 약 2.14배. 초과 단가 Max $7.00, Pro $7.50.
- 포털 Performance: 시간 단위 에너지와 7일 모델 지표를 나란히. UI 디테일은 이메일 중심.
- DeepSeek Flash: V4 GA는 카탈로그와 맞음. V4.1은 메일 일정. 원 제작사는 DeepSeek.
- 설문 기능: 에너지 정렬, JSON, 일일 에너지 캡은 이메일 전용. USD allowance 문서와는 단위를 구분해 읽는다.
「메일은 약속이고, 포털 숫자는 청구서다.」 Flash 상한과 Max, 키 캡을 쓰더라도 모델 id와 Flex, 캐시 전제는 코드와 포털을 같은 날 기준으로 맞춰 두는 편이 사고 비용이 적다.
출처와 링크
- Neuralwatt 이메일 「You asked, we shipped」(2026-09-17, info@neuralwatt.com) - 본문 원문과 번역 절
- Neuralwatt Pricing - Max, Pro, PAYG, 플랜 JSON (조사일 2026-09-17)
- Energy pricing / status - Energy status와 Performance 관련 공개 UI
- Neuralwatt Docs - 문서 인덱스
- Flex tier - Flex 안내
- Energy methodology - 에너지 측정
- Allowances - 키와 세션 USD 한도(일일 에너지 캡과 구분)
- Preview models - 프리뷰 의미
- DeepSeek - DeepSeek V4 Flash / V4.1 Flash / V4 Pro 원 제작사
- 조사 월: 2026년 9월 (Asia/Seoul)
FAQ
자주 묻는 질문
Flash 가격 상한은 어떤 모델에 적용되나?
2026년 9월 17일 이메일 기준으로 GLM-5.3 Flash, DeepSeek V4 Flash, DeepSeek V4.1 Flash다. 에너지로 청구되는 요청이 같은 요청의 토큰 환산을 넘지 않게 막는다고 적혀 있다. V4.1 Flash는 같은 날 포털 카탈로그 스크랩에서 아직 보이지 않아, 일정은 이메일 전용으로 읽는다.
Neuralwatt Max 포함량은 Pro의 정확히 두 배인가?
메일은 roughly double이라고만 적었다. 포털 기준 Pro 포함은 약 13.33 kWh, Max는 28.57 kWh로 약 2.14배다. 월 요금은 Pro $100, Max $200이다. 동시 15요청은 공개 가격 카드에서 확인되지 않아 이메일 전용이다.
Max 초과 요금의 same rate는 Pro와 같은 단가인가?
포털상 Max 초과는 $7.00/kWh, Pro 초과는 $7.50/kWh로 다르다. 메일 문장의 same rate는 Max 플랜 자신의 요율로 읽는 편이 포털 숫자와 맞다. 연 구독 Max는 선납 $2000이다.
DeepSeek V4 Flash GA와 V4.1 일정은?
메일은 V4 Flash를 오늘 GA, V4.1 Flash를 이번 주 후반이라고 적었다. 2026년 9월 17일 포털 카탈로그에는 deepseek-v4-flash가 보였고 V4.1 Flash는 보이지 않았다. 모델 원 제작사는 DeepSeek이고 Neuralwatt는 호스팅과 청구 계층이다.
포털 Performance 페이지에서 무엇을 보나?
메일은 라이브 Energy status(요청당 평균 에너지, 시간 갱신)와 Model performance(첫 토큰 시간, 처리량, 캐시 적중률, 최근 7일 실트래픽)를 나란히 둔다고 한다. 폰 폭과 다크 모드 개편은 로그인 UI 주장이라 이메일 전용으로 둔다.
설문에서 추가된 일일 에너지 캡은 문서의 allowance와 같나?
메일은 API 키마다 일일 에너지 상한을 둔다고 적었다. 공개 allowances 문서는 키와 세션 단위 USD 한도를 다룬다. 단위가 kWh인지 USD인지 공개 문장만으로 같다고 단정하지 않는다. 에이전트 루프 폭주를 막으려는 목적은 같다.
에너지 정렬과 JSON 엔드포인트는 어디에 있나?
메일은 모델 목록을 요청당 에너지로 정렬할 수 있고, 모델별 에너지 가격 JSON을 직접 호출할 수 있다고 적었다. 구체 경로나 UI 위치는 메일과 공개 문서 교차에서 확인되지 않아 이메일 전용이다. 구현 전에 포털과 docs의 최신 표를 다시 봐야 한다.
DeepSeek V4 Pro는 왜 프리뷰에 남나?
메일은 DeepSeek의 Pro 로드맵이 잡히는 동안 프리뷰에 더 둔다고 적었다. Flash 계열 GA와 Pro 프리뷰를 같은 날 코드 기본값에 섞지 않는 편이 안전하다. 원 제작 로드맵의 주어는 DeepSeek다.
용어
관련 용어
관련 글
관련 글
Recommended
Neuralwatt Speed lane | DeepSeek V4.1 Flash 프리뷰·주말 무료 에…
Neuralwatt Cloud는 요청마다 에너지를 공개하는 OpenAI 호환 추론 클라우드다. 같은 모델 가중치를 두고 Standard, Flex, Speed처럼 서비스 등급만 바꿔 속도와 가격을 고른다. API 기본 주소는 https://api.neuralwatt.com/v1이며, 포털 모델 카드에 공개된 에너지 단가는 $10.00/kWh다.
2026년 9월 넷째 주 Neuralwatt 뉴스레터는 네 가지를 한꺼번에 알렸다. DeepSeek V4.1-Flash용 Speed lane 프리뷰, 2026년 9월 26일 00:00 UTC부터 9월 28일 00:00 UTC까지 Flash 계열 주말 무료 에너지, Hosted tools가 V4.1-Flash와 flex까지 확장되어 아홉 모델에 네 도구가 붙는다는 소식,…
Neuralwatt Cloud 업데이트 | GLM-5.3 GA·호스티드 툴·팀 플랜
Neuralwatt Cloud는 2026년 9월 뉴스레터와 공식 문서에서 Cloud 제품 갱신을 한꺼번에 알렸다. 모델 쪽에서는 GLM-5.3 계열과 DeepSeek V4 Flash, Qwen 3.8 27B를 GA로 옮긴다고 했고, 카탈로그 모델에 -flex 별칭을 붙인다고 했다. DeepSeek V4 Pro는 프리뷰로 남는다고 적었다.
같은 묶음에 Anthropic Messages API(/v1/messages)와 [OpenAI Responses API](/vibe-dictionary/openai-respon…