Apple Silicon 위의 MLX: Apple의 모델이 아니라 내 모델이 필요할 때
Foundation Models는 Apple이 봉인해 둔 온디바이스 LLM을 제공합니다. MLX는 내가 고른 모델을 돌립니다. 양자화된 오픈 웨이트 모델과 LoRA 파인튜닝을 Apple Silicon 위에서 실행하세요.
AI & Technology디자인, 개발, AI 인프라, 제품 구축에 대한 생각.
Foundation Models는 Apple이 봉인해 둔 온디바이스 LLM을 제공합니다. MLX는 내가 고른 모델을 돌립니다. 양자화된 오픈 웨이트 모델과 LoRA 파인튜닝을 Apple Silicon 위에서 실행하세요.
AI & Technology조경현은 모델이 스스로 제어 구조를 학습하게 했습니다 -- GRU의 게이트 메모리, 어텐션의 부드러운 정렬 -- 그리고 이를 정직하고 재현 가능한 과학과 결합했습니다.
Engineering & CraftRaj Reddy는 말로 대화할 수 있는 기계를 개척했습니다. 음성 인식, 블랙보드 모델을 만든 뒤, 가장 앞선 AI를 세상에서 가장 부유한 사람이 아니라 가장 가난한 사람을 향해 겨눴습니다.
Engineering & Craft마거릿 해밀턴은 '소프트웨어 엔지니어링'이라는 말을 만들었고, 1202 경보를 견뎌낸 아폴로 비행 코드를 작성했습니다. 방어적 설계, 오류 복구, 그리고 두 번째 기회는 없다는 원칙.
Engineering & Craft페이페이 리는 ImageNet을 구축해 AI에게 눈을 선사했습니다. 더 영리한 모델이 아니라 대규모 데이터야말로 빠져 있던 재료라는 데, 그리고 AI는 인간 중심이어야 한다는 데 승부를 걸었습니다.
Engineering & Craft마크 셔틀워스는 단 하나의 생각 위에 Ubuntu를 세웠습니다 -- 인간을 위한 Linux, 모두를 위한 자유 소프트웨어 -- 그리고 그 뿌리에는 우분투(ubuntu), 즉 타인을 향한 인간애가 있었고, 정해진 시계에 맞춰 출시되었습니다.
Engineering & CraftAmazon의 CTO 베르너 보겔스는 하나의 전제 위에 클라우드를 세웠습니다. 모든 것은 항상 실패한다는 것. 장애를 전제로 설계하고, 폭발 반경을 최소화하며, 그 속에서도 가용성을 지킵니다.
Engineering & CraftSalvatore Sanfilippo는 단 하나의 원칙을 중심으로 Redis를 만들었습니다 — 더 적게 하라. 머릿속에 통째로 담아둘 수 있는, 작고 단일 스레드로 동작하는 인메모리 저장소를, 사람이 읽으라고 C로 작성한 것입니다.
Engineering & CraftApple Translation 프레임워크 정리. translationPresentation과 TranslationSession으로 구현하는 무료 온디바이스 번역, 그리고 데모가 건너뛰는 오프라인 다운로드의 함정까지.
AI & TechnologyApple의 Foundation Models 프레임워크 정리 — LanguageModelSession, @Generable 가이드 생성, 도구 호출, 가용성 확인, 그리고 온디바이스 모델을 벗어나야 할 시점.
AI & Technology얀 르쿤은 합성곱 위에 딥 비전을 세웠고, 진짜 지능은 더 큰 LLM이 아니라 세상을 비지도 방식으로 학습하고 그 결과를 공개하는 데서 나온다는 데 걸었습니다.
Engineering & Craft이와타 사토루는 닌텐도 사장이 되고 나서도 게이머이기를 멈추지 않은 프로그래머였습니다. 기술적 숙련은 언제나 플레이어의 즐거움을 위한 것이었습니다.
Engineering & Craft기술 글쓰기: Introl
대규모 언어 모델을 로컬에서 실행하기 위한 종합 하드웨어 권장 사항 및 비용 분석.
다양한 AI 워크로드를 위한 NVIDIA 최신 데이터센터 가속기 비교 GPU 선택 가이드.
Google의 TPU v1부터 TPU v5까지의 Tensor Processing Unit 발전에 대한 심층 기술 분석.
컨테이너화된 환경에서 GPU 클러스터의 리소스 공유 전략.
Ray 프레임워크를 사용한 분산 AI 컴퓨팅 구축 및 관리 가이드.
오픈소스 LLM 경제학 및 DeepSeek의 경쟁 포지셔닝 분석.
미래 데이터센터 전력 요구 사항 및 NVIDIA의 차세대 GPU 로드맵.
차세대 AI 인프라에 전력을 공급하는 소형 모듈식 원자로 솔루션.
DeepSeek의 Multi-Head Compression 아키텍처 혁신에 대한 기술 분석.