yozm.tech
피드로 돌아가기
news.hada.ioHOTAI 재작성

AMD, '모델 내장 칩' 스타트업 탈라스 인수

AMD가 AI 칩 스타트업 탈라스(Taalas)를 인수하며 엔비디아(Nvidia)가 주도하는 고성능 추론 시장 공략을 강화합니다. 탈라스는 모델 가중치를 실리콘에 직접 새겨 기존 GPU보다 최대 48배 빠른 추론 속도를 제공하며, AI 에이전트 서비스 등 빠른 응답이 필요한 분야에 혁신을 가져올 것으로 기대됩니다. 이번 인수로 AMD는 풀스택 AI 플랫폼 구축에 박차를 가할 전망입니다.

4시간 전·2026.08.07·읽기 2·neo https://news.hada.io/user/neo

AMD가 AI 칩 스타트업 탈라스(Taalas)를 인수하며 인공지능(AI) 하드웨어 시장에서 엔비디아(Nvidia)와의 경쟁에 새로운 전략을 도입했습니다. 탈라스는 모델 가중치를 실리콘에 직접 새기는 독특한 기술을 보유하고 있으며, 이를 통해 기존 GPU 대비 압도적으로 빠른 추론(inference) 속도를 구현합니다. 이번 인수는 AMD가 고성능 추론 시장에서 입지를 강화하고, AI 에이전트와 같은 실시간 응답이 중요한 서비스의 비용 효율성을 높이는 데 기여할 것으로 보입니다.

탈라스의 핵심 기술은 모델 전용 집적회로(MSIC)에 있습니다. 이 칩은 모델 가중치를 마스크 롬(mask-ROM) 리콜 패브릭에 직접 새기고, KV 캐시(KV cache)와 미세조정(fine-tuning) 어댑터는 SRAM 리콜 패브릭에 저장합니다. 2026년 2월 공개된 첫 시험 칩 HC1은 TSMC 6nm 공정으로 제작되었으며, 메타(Meta)의 라마 3.1(Llama 3.1) 8B 모델을 초당 16,960토큰으로 처리해 발표 당시 엔비디아 GPU보다 48배, 세레브라스(Cerebras) 가속기보다 8.5배 빠른 성능을 보였습니다. 2세대 HC2는 칩당 200억 파라미터(parameter)를 목표로 하며, 50개의 가속기로 1조 파라미터 모델을 지원할 수 있어 대규모 모델 확장성도 갖췄습니다. AMD는 이 기술을 자사의 인스팅트(Instinct) 기반 헬리오스(Helios) 랙과 결합해 GPU는 연산량이 많은 프롬프트 처리를, 탈라스 기반 가속기는 토큰 생성을 담당하는 분리형 아키텍처를 구상 중입니다.

이 기술은 모델이 실리콘에 고정된다는 제약이 있지만, 토큰당 비용을 획기적으로 낮추고 출력 속도를 10~20배 높일 수 있다는 점에서 큰 의미를 가집니다. 이는 모델 개발사들이 추론 시간을 더 길게 확장하는 '테스트 시간 스케일링(test-time scaling)'을 활용할 수 있게 하여, 더 정교하고 복잡한 AI 작업을 저렴하고 빠르게 수행할 수 있도록 돕습니다. 예를 들어, 고객 피드백 분류나 코드 도우미와 같은 AI 에이전트 서비스에서 빠른 응답 속도와 비용 효율성은 사용자 경험과 서비스 운영에 결정적인 영향을 미칩니다. AMD는 이번 인수를 통해 AI 작업별로 최적화된 연산 수단을 제공하는 풀스택 AI 플랫폼을 구축하고, 엔비디아가 장악한 AI 하드웨어 시장에서 강력한 경쟁자로 부상할 것으로 기대됩니다.

1인 창업자를 위한 기회 분석
AI 분석 · 참고용이며 검증이 필요합니다
3/10
약한 신호
3점인가

기술의 난이도와 필요한 자본 규모가 1인 창업자가 접근하기에는 매우 높고, 모델 고정이라는 제약이 있어 시장의 불확실성이 큽니다.

문제 / 미충족 수요

AI 모델 추론 비용과 속도 문제는 여전히 존재하며, 특히 실시간 응답이 중요한 서비스에서 효율적인 하드웨어 솔루션에 대한 수요가 높습니다.

한국 시장
국내 미진출 — 기회한국에서는 아직 모델 가중치를 실리콘에 직접 새기는 방식의 AI 칩 스타트업은 알려진 바 없으나, AI 반도체 연구는 활발합니다.
수익 모델

B2B SaaS 구독, API 종량제, 온프레미스 하드웨어 판매 · 돈 내는 주체: AI 모델 개발사, 클라우드 인프라 제공업체, 고성능 추론 서비스 사업자

1인 실현 가능성
1/5

실리콘 설계 및 제조는 막대한 자본과 전문 인력이 필요한 영역으로 1인 창업자가 직접 뛰어들기에는 현실적으로 불가능합니다.

진입 지점 (Wedge)

특정 산업 도메인에 특화된 경량 AI 모델을 실리콘에 내장하여 초고속 추론을 제공하는 맞춤형 엣지 AI 솔루션 개발

이번 주 첫 실험

특정 산업(예: 제조업 검사, 의료 영상 분석)의 경량 모델을 선정하고, 해당 모델의 추론 속도 및 비용 개선 필요성을 검증하기 위한 시장 조사 및 잠재 고객 인터뷰를 진행합니다.

Original source
이 글은 news.hada.io의 기사를 yozm.tech가 한국어로 재작성한 버전입니다.
원문 보기