antirez/ds4
DeepSeek 4 Flash 와 PRO 모델을 Metal, CUDA, ROCm 등 다양한 하드웨어에서 실행할 수 있는 로컬 추론 엔진이 공개되었습니다. 특히 Apple Silicon 사용자를 위한 최적화 지원은 AI 모델의 접근성을 획기적으로 높였습니다.
DeepSeek 4 Flash 와 PRO 모델을 Metal, CUDA, ROCm 등 다양한 하드웨어에서 실행할 수 있는 로컬 추론 엔진이 공개되었습니다. 특히 Apple Silicon 사용자를 위한 최적화 지원은 AI 모델의 접근성을 획기적으로 높였습니다.
생성 모델의 단계를 분해하지 않고 끝-to-end 로 학습하는 새로운 패러다임인 'Explorative Modeling'이 소개되었습니다.
C 언어로 작성된 추론 엔진을 통해 K3 모델을 단일 CPU 와 8GB RAM 환경에서 실행하는 데 성공했습니다. 모델의 전문가 계층은 필요할 때만 NVMe 에서 직접 읽어들여 디콰엔티제이션 없이 곱셈 연산을 수행하며, 밀집 트렁크는 레이어 단위로 스트리밍되고 메모리에常驻되는 양을 조절할 수 있는 유연한 구조를 가졌습니다.
오픈AI가 기하학, 암호학, 복잡성 이론 등 수학과 컴퓨터 과학의 오랜 미해결 문제에서 새로운 진전을 이루었다고 발표했습니다.
Reddit, X 등 다양한 플랫폼을 검색하여 주제를 조사하고 합리적인 요약을 생성하는 AI 에이전트 스킬이 공개되었습니다. 복잡한 정보를 빠르게 정리하고 근거 있는 결론을 도출하는 데 유용한 도구입니다.
텍스트 프롬프트로 물리적으로 일관된 비디오를 생성하기 위해 실행 가능한 블렌더 코드를 활용한 'VideoCoCo' 프레임워크가 제안되었습니다.
'ACE-Data-0'는 인간 중심의 환경 데이터를 수집하여 embodied intelligence 의 데이터 병목 현상을 해결하는 새로운 엔진을 소개합니다. 이는 로봇 학습에 필요한 고품질 다중 모달 데이터 확보를 위한 획기적인 접근법입니다.
'DeepSeek-V4-Flash' 모델이 약 300 억 파라미터 규모임에도 불구하고 비용 대비 성능 면에서 매우 뛰어난 평가를 받았습니다. 특히 추론 능력이 강화되어 기존 대형 모델을 위협하는 수준으로 분석되었습니다.
안티트로픽 클로드 평가 설정 오류로 인해 발생한 사이버 보안 사고와 공급망 리스크에 대한 분석 보고서입니다. AI 모델의 잘못된 구성이 실제 기업 환경에서 어떤 위협을 초래하는지 구체적으로 설명하고 있으며, 이를 방지하기 위한 완화 전략과 대응 방안을 제시하여 IT 보안 전문가들에게 중요한 정보를 제공합니다.
대규모 언어 모델의 인구통계학적 편향을 미미한 활성화 차이를 통해 정밀하게 찾아내는 'Fairness Pruning' 기법이 제안되었습니다.
SpatialCLI 프레임워크는 VLM이 공간 도구로 추론한 후 이를 내재화하여 전문 비전 모델의 시각적 디테일과 일반 작업 결정 능력을 결합하는 문제를 해결합니다. 이는 embodied agent 의 성능을 극대화하기 위한 핵심적인 기술 발전으로 평가됩니다.
INTACT 는 보상 없이도 의도를 행동으로 직접 변환하는 등소형 JEPA 아키텍처를 제안하며, 기존에 고비용인 테스트 시간 검색을 없애고 물리적 환경 모델링의 효율성을 획기적으로 높입니다.
인공지능 기반의 혈액 검사 기술이 다양한 인종과 인구 집단에서도 간암을 정확하게 진단할 수 있음을 확인했습니다. 이는 기존 영상 촬영 없이도 조기 발견이 가능해져 의료 접근성을 높이는 중요한 발전입니다.
국립암센터 원장이 암 데이터와 AI 를 결합한 연구가 현재 세계적으로 선도할 수 있는 중요한 기회라고 강조하며 관련 전략을 제시했습니다.
'Chimera'는 텍스트 이미지 비디오를 통합 처리하는 하이브리드 시각 확산 트랜스포머 아키텍처로 고해상도 생성과 긴 컨텍스트 처리의 비용 문제를 해결합니다. 이는 멀티모달 콘텐츠 생성 분야의 기술적 도약으로 평가됩니다.
개인이 DGX Spark 기반의 대규모 AI 클러스터를 구축하여 최첨단 오픈소스 모델을 로컬에서 실행하고 AGI 연구에 활용하려는 계획을 공개했습니다.
'Generate an SVG of a frog with a Habsburg jaw' 는 AI 모델의 창의성과 묘사 능력을 테스트하는 개인적인 벤치마크 프롬프트로 제시되었습니다.
매월 발행되는 후원자 전용 뉴스레터의六月 호를 미리 공개했습니다. 이번 호에는 GPT 모델 테스트 중 발생한 사이버 공격 사례와 새로운 AI 모델 출시 소식 등 다양한 주제가 포함되어 있습니다.
마이크로소프트와 NVIDIA 등 주요 기업들이 서명한 공개 편지 내용을 요약했습니다. 이 문서는 미국 정부의 안전 명목으로 인한 오픈 가중치 모델 규제나 금지 움직임에 대응하기 위해 오픈 소스 개발의 중요성을 강조하고 있습니다.
'EU rules on AI models become enforceable' 는 유럽의 새로운 AI 규제 시행으로 인해 산업과 기술 개발에 어떤 변화가 예상되는지에 대한 질문을 담고 있습니다.