AI 반도체 수요에 힘입어 한국 ICT 수출이 7월 기준 역대 최대치를 기록했다는 보도다.
AI 붐은 소프트웨어 매출뿐 아니라 메모리·장비·전력 등 공급망 전반의 투자와 수출을 움직인다. 국내 AI 사업은 이 공급망 사이클과 분리해 보기 어렵다.
매일 아침 뉴스레터를 한국어로 정리한 포치 브리핑
AI 반도체 수요에 힘입어 한국 ICT 수출이 7월 기준 역대 최대치를 기록했다는 보도다.
AI 붐은 소프트웨어 매출뿐 아니라 메모리·장비·전력 등 공급망 전반의 투자와 수출을 움직인다. 국내 AI 사업은 이 공급망 사이클과 분리해 보기 어렵다.
삼성전자가 NAND 시장 선두를 유지하는 가운데 AI 워크로드가 학습에서 추론으로 이동하며 기업용 SSD 수요가 커지고 있다.
추론 중심 전환은 저장장치와 데이터센터 구성의 수요를 바꾼다. AI 인프라 투자 판단에서 GPU뿐 아니라 스토리지 병목과 TCO를 함께 봐야 한다.
국내 AI 반도체 기업 딥엑스가 양산 1년 만에 77건, 약 1,300만 달러 규모의 수주를 확보했다는 소식이다.
국산 AI 칩의 경쟁력은 벤치마크보다 실제 고객 배치와 반복 수주로 검증된다. 엣지 추론 시장에서 초기 레퍼런스가 확대되는지 지켜볼 필요가 있다.
OpenAI가 GPT-5.6 기반 에이전트를 구축하는 방법과 모델 선택, Responses API 활용법을 소개했다. 스타트업이 비용과 속도를 함께 최적화하는 실무 패턴에 초점을 둔다.
모델 성능 경쟁이 API 조합과 라우팅 설계 경쟁으로 이동하고 있다. 제품팀은 단일 모델 고정보다 작업별 모델 선택과 비용 관리를 아키텍처에 포함해야 한다.
Anthropic이 여러 Claude 에이전트를 병렬로 활용해 C 컴파일러를 구축한 과정을 공개했다. 작업을 분할하고 결과를 통합하는 에이전트 협업 패턴을 보여준다.
복잡한 개발 작업에서 에이전트의 핵심 생산성은 단일 모델의 코딩 속도보다 작업 분해·검증·통합 루프에 달려 있다.
NVIDIA가 GB300 NVL72 환경에서 2.4T 파라미터 Qwen 모델을 구성 가능한 추론 방식으로 서빙하는 방법을 제시했다.
초대형 모델의 실용성은 모델 크기보다 메모리·네트워크·추론 설정을 함께 최적화할 수 있느냐에 달려 있다. 인프라 선택이 모델 제품 전략의 일부가 된다.
NeMo Switchyard는 하나의 에이전트 작업을 여러 모델과 엔드포인트로 분배해 성능·비용을 조절하는 인프라 접근을 제안한다.
에이전트가 늘수록 모델 라우팅과 관측 가능성이 운영 병목이 된다. 작업별 라우팅 정책을 일찍 설계하면 비용 폭증과 단일 공급자 종속을 줄일 수 있다.
Anthropic이 Claude의 수학적 추론 능력을 분석한 연구를 공개했다. 모델이 정답을 내는지만 보는 것이 아니라 어떤 유형의 문제에서 강점과 한계를 보이는지 살핀다.
수학 추론은 에이전트의 계획·검증 능력과 직결된다. 벤치마크 점수보다 실패 패턴을 확인해야 실제 제품 설계의 검증 루프를 정할 수 있다.
Hugging Face가 ICML 논문 2,200편을 재현한 경험을 정리했다. 논문 아이디어와 실제 재현 가능성 사이의 간극, 구현·데이터·평가 과정에서 발생하는 비용을 짚는다.
연구를 제품으로 옮길 때 가장 큰 리스크는 새 아이디어 자체보다 재현성과 운영 가능성이다. 실험 자동화와 공개 검증이 연구 생산성의 핵심 인프라가 된다.