Google will now allow users to remove visible watermark from its AI generations

구글이 이제 AI 생성 콘텐츠에서 보이는 워터마크를 사용자가 제거할 수 있도록 허용한다고 발표했습니다. 이 변경은 이미지, 비디오, 노래를 포함한 구글의 AI 생성물에 적용됩니다.

다만, 이 기능은 보이지 않는 SynthID 워터마크나 C2PA 표준 관련 메타데이터에는 영향을 미치지 않습니다. 구글은 이 변화가 창작의 통제권과 안전성 사이의 균형을 맞추기 위한 접근 방식이라고 설명했습니다.

이는 눈에 보이는 워터마크가 전문적이고 창의적인 작업에 방해가 될 수 있다는 점을 반영한 것입니다. 구글은 여전히 AI 생성 콘텐츠를 식별하기 위해 보이지 않는 SynthID 워터마크와 C2PA 메타데이터를 사용하고 있으며, 사용자는 Gemini나 검색을 통해 이미지가 AI 생성되었는지 확인할 수 있습니다.

이 기능은 Nano Banana, Omni, Lyria 모델에 대해 출시될 예정이며, Gemini와 비디오 편집기 Flow에서 사용할 수 있게 됩니다. 또한 구글은 개발자들이 앱에 로컬 검증 메커니즘을 삽입할 수 있도록 Credentio 라이브러리를 공개했습니다.

RustDesk now supports true unattended remote access on Wayland

RustDesk가 Wayland 환경에서 진정한 무인 원격 접속을 지원하며 멀티 모니터 설정까지 가능해졌습니다. 이는 리눅스 원격 데스크톱 환경에서 Wayland 지원이 어려웠던 문제를 해결하여, 원격 기기 사용자가 세션마다 승인할 필요 없이 접속할 수 있게 되었다는 점에서 큰 의미를 가집니다.

이번 업데이트를 통해 사용자는 초기 설정 후에도 원격 기기 사용자가 로그인 화면이나 재부팅 후에도 접속할 수 있으며, 멀티 모니터 환경에서도 원활하게 접속할 수 있습니다. 현재 이 기능은 x86_64 Debian/Ubuntu 기반 시스템을 위한 별도의 프리뷰 빌드로 제공되고 있으며, 실제 환경에서의 테스트를 위해 사용자들의 피드백을 요청하고 있습니다.

다른 주요 원격 데스크톱 제품들은 여전히 Wayland 지원에 있어 제한적이거나 실험적인 상태입니다. RustDesk 개발팀은 안정적인 구현을 위해 더 많은 실제 테스트를 진행한 후 이 기능을 기본으로 채택할 계획입니다. 향후에는 Fedora나 Arch Linux와 같은 다른 리눅스 배포판으로 확장하고, 최종적으로는 RustDesk의 표준 릴리스에 이 기능을 포함할 예정입니다.

Ars Live recap: How can we stop publishers from killing their own games?

게임 개발사들이 게임을 소유하고 있는 것을 없애는 것을 막으려는 움직임인 'Stop Killing Games' 운동은 여전히 어려운 싸움을 하고 있습니다. 이번 주 Ars는 Ross Scott와 라이브 토론을 진행하며 게임이 원본 퍼블리셔에 의해 운영되는 온라인 서버가 종료된 후에도 플레이 가능하도록 보장하려는 노력에 대해 논의했습니다.

Scott는 장기적인 게임 접근성에 관한 상황이 이미 10년 반 전에 "참을 수 없을 정도"였다고 언급하며, 그 이후로 더 경험 있고 지식이 많은 사람이 이 운동을 시작하기를 바랐지만 아무것도 일어나지 않았다고 느꼈다고 밝혔습니다. 그는 이러한 관행에 반대하는 운동을 조직하는 것이 마치 "가장 불리한 상황을 선택하는 것"과 같다고 평가했습니다.

이 대화에서 Scott는 어떠한 이유로든 최소한의 통보만으로 게임 접근을 중단하는 관행이 다른 삶의 영역에서는 터무니없어 보인다는 점을 지적했습니다. 이는 게임 접근권 보장이라는 목표가 현실에서 얼마나 큰 장애물에 직면해 있는지를 보여줍니다.

France blocks social media ban because it would require adults to prove age

프랑스 최고 법원은 성인들이 연령을 증명하도록 요구하는 사회 미디어 금지 조치는 표현의 자유를 제한한다고 판결했습니다. 이 판결은 특정 플랫폼에 대한 규제가 표현의 자유에 미치는 영향을 다루며, 정부의 규제 권한과 개인의 기본권 사이의 균형에 대한 중요한 선례를 제시합니다.

이번 판결은 사회 미디어 금지 조치가 법적으로 정당한지 여부에 대한 논쟁을 심화시킵니다. 법원은 성인 연령 증명 요구가 표현의 자유를 제약할 수 있다는 점을 강조하며, 플랫폼 규제가 개인의 기본권을 침해하지 않도록 신중해야 함을 시사했습니다.

이는 유럽 내에서 온라인 플랫폼 규제와 표현의 자유에 대한 법적 해석에 영향을 미칠 수 있습니다. 개발자와 플랫폼 운영자들은 이러한 법적 기준이 향후 유럽 지역의 디지털 서비스 규제 환경에 어떤 영향을 미칠지 주목해야 합니다.

RayforceDB – a pure C analytics database with a Lisp-like syntax

Rayforce는 컬럼 분석, 그래프 탐색, 재귀 쿼리를 하나의 임베드 가능한 실행 파이프라인으로 통합한 순수 C 기반 분석 데이터베이스입니다. 이는 마이크로초 단위의 지연 시간을 측정하는 팀을 위해 설계되었으며, 데이터 이동 없이 관계형 연산자와 그래프 탐색을 동일한 실행 계획 내에서 처리하는 단일 실행 모델을 제공합니다.

이 엔진은 컬럼 분석, CSR 그래프 엔진, 재귀 Datalog 기능을 결합하여 데이터와 연결된 답변을 얻는 데 필요한 모든 것을 하나의 시스템으로 제공합니다. 데이터는 CSV, 메모리 맵, IPC 등을 통해 저장되며, Lazy DAG 최적화, 다중 패스 실행, 중간 결과 제거 등의 파이프라인을 통해 전체 워크로드를 효율적으로 처리합니다.

Rayforce는 Rayfall 언어와 C API를 통해 접근 가능하며, 오픈 소스이며 외부 종속성이 전혀 없어 임베딩에 최적화되어 있습니다. 이미 트레이딩 기술, 투자 분석 등 다양한 생산 시스템에서 사용되고 있으며, Lynx, Fortitudo와 같은 프로젝트와 PeachQ와 같은 q 구현체에서도 활용되고 있습니다.

현재 Rayforce는 오픈 소스로 공개되어 있으며, 향후 팀들이 로컬 프로토타입에서 실제 워크로드로 전환할 수 있도록 Rayforce 클라우드 서비스를 준비 중입니다.

AI by Hand

전문가 톰 예(Tom Yeh) 교수의 AI 관련 강연 자료는 모델을 실제 작업에 적용하는 방법과 그 기반이 되는 수학적, 알고리즘적 이해에 중점을 두고 있습니다. 특히 사전 학습된 모델을 특정 작업에 맞게 조정하는 파인튜닝(Fine-tuning)의 중요성과 이를 성공적으로 수행하기 위한 방법론이 다루어집니다.

또한, 최신 AI 모델의 핵심인 활성화 함수(Activation Function)와 어텐션 메커니즘(Attention)에 대한 심도 있는 분석이 제공됩니다. SwiGLU와 같은 새로운 활성화 함수부터 셀프 어텐션(Self-Attention)과 크로스 어텐션(Cross Attention)의 차이점까지 다루며, 이는 모델 내부의 작동 방식을 이해하는 데 필수적인 내용입니다.

알고리즘 측면에서는 PPO, DPO, GRPO와 같은 정책 최적화 알고리즘이 어떻게 작동하는지에 대한 내용이 포함되어 있으며, 이는 최첨단 AI 시스템을 구축하는 데 필요한 이론적 배경을 제공합니다. 더불어 행렬 곱셈(Matmul)과 선형 레이어(Linear Layer) 같은 기초 수학 개념을 활용하여 딥러닝의 수학적 흐름을 시각화하는 인터랙티브 워크북 자료도 공개되어 있습니다.

이러한 자료들은 개발자들이 단순히 모델을 사용하는 것을 넘어, AI의 근본적인 원리와 수학적 구조를 이해하고 직접 구현할 수 있는 실질적인 지식을 제공합니다. 이는 복잡한 AI 시스템을 설계하고 개선하는 데 필요한 깊이 있는 통찰력을 얻고자 하는 개발자들에게 큰 도움이 될 것입니다.

Show HN: Online SNMP MIB database - upload/view your own MIBs

SNMP MIB를 검색하고 탐색할 수 있는 온라인 도구인 MIB Viewer가 공개되었습니다. 이 도구는 11,000개 이상의 SNMP MIB 데이터베이스를 제공하며, 사용자가 MIB 파일(.mib, .txt, .my)을 업로드하여 탐색할 수 있게 해줍니다.

MIB는 SNMP를 통해 장치가 노출하는 데이터, 예를 들어 인터페이스 카운터나 시스템 가동 시간 같은 정보를 정의하는 구조화된 문서입니다. SNMP는 네트워크 장치가 상태와 통계를 모니터링 도구에 보고하는 프로토콜이며, MIB는 이 통신에서 사용되는 용어입니다. 데이터의 실제 주소는 MIB 내의 객체 식별자(OID)로 표현되며, 이는 1.3.6.1.2.1.1.1과 같은 점(dotted) 형식의 숫자 주소입니다.

MIB Viewer는 사용자가 이름, OID 또는 번호를 통해 MIB 객체를 검색하고, 해당 객체의 구문, 접근 수준, 설명을 확인하며, MIB 트리 내에서의 위치를 추적할 수 있도록 돕습니다. 특히 사용자는 자신의 MIB 파일을 직접 업로드하여 파싱하고 탐색할 수 있어 특정 장비나 환경에 맞는 정보를 쉽게 분석할 수 있습니다.

이 도구는 SNMP 관련 데이터 구조와 OID 체계를 이해하고 실제 네트워크 장치의 상태 정보를 효율적으로 관리하려는 개발자나 시스템 관리자에게 유용한 자료를 제공합니다.

"Solving a largely imaginary user goal"

사용자 목표를 해결하는 것에 대한 논의를 통해 다크 모드 토글의 복잡성에 대해 새로운 관점을 제시합니다. 웹사이트의 다크 모드 토글은 기본적으로 어두운 모드와 밝은 모드 두 가지 옵션만 보여주어야 하며, 시스템 설정에 따라 자동으로 따라가는 상태(시스템이 결정하는 대로)를 스마트하게 처리해야 한다는 주장입니다. 이는 단순히 세 가지 상태(어두움, 밝음, 시스템 기본값)를 모두 보여주는 트라이스테이트 토글보다 사용자 경험 측면에서 더 효율적이라는 것입니다.

이러한 스마트한 이중 상태 토글은 사용자가 시스템 설정에 관계없이 원하는 테마를 유지하게 하면서도, 복잡한 시스템 상태에 대한 정보를 시각적인 UI 요소 사이에 숨겨 놓는 방식으로 구현됩니다. 이는 사용자가 시스템의 복잡성을 직접적으로 인지하지 않도록 하여 인지 부하를 줄이는 데 중점을 둡니다.

핵심은 인터페이스를 근본적인 데이터 모델에 맞춰 설계하기보다 사용자의 목표에 맞춰 설계해야 한다는 점입니다. 시스템 기본값과 같은 옵션은 반복적이고 불분명하며 추가적인 인지적 부담을 야기하므로, 이러한 세부 사항을 UI에서 숨기고 추상화하는 것이 더 나은 사용자 경험을 제공합니다.

결국 복잡한 인터페이스는 작은 타협과 결정들이 누적되어 발생하는 문제이며, 이는 더 큰 도전 과제를 해결하는 데 필요한 사고방식을 제공합니다. 이는 개발자와 디자이너가 시스템의 복잡성을 다룰 때 사용자 목표를 최우선으로 고려해야 함을 시사합니다.

Judge gives Google one week to fix "anticompetitive" app store download in Google Play

구글이 플레이 스토어에서 제3자 앱 스토어 다운로드를 제공하기 시작한 지 일주일 만에, 미국 지방 판사 제임스 도나토는 구글이 불필요한 '반경쟁적 마찰'을 추가했다고 판결했습니다. 이 판결에 따라 구글은 경쟁 앱 스토어 설치를 더 쉽게 만들도록 문제를 시정하라는 명령을 받았습니다.

이러한 결정은 구글과 에픽 간의 반독점 소송 맥락에서 나왔으며, 구글은 제3자 앱 스토어를 배제하기 위해 에픽과 합의를 시도했으나 법원의 요구를 충족시키지 못했습니다. 구글이 최근 앱 스토어(Aptoide)를 인정했을 때, 판사는 구글의 구현 방식이 충분하지 않다고 판단했습니다.

결국 구글은 사용자들이 비구글 소스에서 앱을 쉽게 다운로드할 수 있도록 하여 대체 안드로이드 앱 스토어 접근성을 높여야 하는 의무를 지게 되었습니다. 이는 개발자와 사용자에게 구글 플레이 스토어 외의 대안적인 앱 소스에 접근하는 것이 더 쉬워질 수 있음을 의미합니다.

Does Mark Zuckerberg really believe AI is ‘for everyone’?

메타가 이번 주에 오픈 웨이트 AI 모델인 글리머(Glimmer)를 출시했습니다. 이 모델은 누구나 다운로드하여 자신의 하드웨어에서 직접 실행할 수 있도록 공개되어 있으며, 이는 메타의 더 강력한 모델인 뮤즈 스파크(Muse Spark)가 API를 통해 제한되는 것과는 대조적입니다.

이러한 공개는 AI 접근성에 대한 철학적 논의와 함께 이루어졌습니다. 마크 저커버그는 AI가 소수의 연구소에 의해 통제되기보다는 "모두를 위한 것"이 되어야 한다고 주장하는 서한을 발표했습니다. 이는 AI 기술의 접근성과 개방성에 대한 중요한 논쟁을 촉발하고 있습니다.

개발자들에게 이는 모델 접근 방식에 있어 중요한 선택지를 제공합니다. 글리머와 같은 오픈 웨이트 모델은 사용자가 모델을 직접 제어하고 커스터마이징할 수 있는 반면, 뮤즈 스파크와 같은 모델은 API를 통해서만 접근이 가능합니다. 따라서 개발자들은 모델의 투명성, 제어권, 그리고 개인화된 배포 환경 사이에서 어떤 균형을 선택할지 고려해야 합니다.

Show HN: Graft – Claude Code hooks that cut grep tokens by 42%

Graft는 Claude Code, Cursor, Codex, Gemini 등 모든 코딩 에이전트를 코드베이스에 특화된 문맥적 이해를 통해 더 빠르고 저렴하게 만드는 도구입니다. 이 도구는 코드베이스의 문맥을 그래프 형태로 구축하여 AI 에이전트가 작업할 때 필요한 관련 노드를 프롬프트에 통합하고 백그라운드에서 그래프를 재구성함으로써 작업 효율을 극대화합니다.

Graft를 사용하면 토큰 절감 효과가 기준 대비 42%이며 시간 절약 효과는 60%에 달합니다. 이는 AI 에이전트가 코드베이스 전체를 이해하고 작업하는 데 필요한 비용과 시간을 획기적으로 줄여주며, 정확성 손실 없이 성능을 향상시킵니다.

Graft는 `graft init`과 `graft build` 명령어를 통해 코드베이스를 그래프로 구축하고 이를 Claude Code와 같은 에이전트와 연결하는 워크플로우를 제공합니다. 개발자는 이를 통해 파일 간의 합성, 보안 발견, 테스트 검증 등 복잡한 코드 분석 작업을 자동화하고 에이전트가 작업할 때 필요한 문맥적 정보를 제공할 수 있습니다.

이 시스템은 별도의 데몬이나 재인덱싱 없이 파일 자체를 그래프로 취급하여 캐시 형태로 저장하므로, 개발자는 코드를 커밋할 필요 없이 팀원들이 각자의 그래프를 생성하여 공유할 수 있습니다.

R-rated director's cut of X-Files film restores Chris Carter's original horror vision

크리스 카터 감독이 2008년 단독 스핀오프 영화인 <X-파일: 믿고 싶다>의 리뉴얼된 R 등급 감독판을 공개하며 팬들 사이에서 큰 화제가 되고 있습니다. 이 감독판은 기존 작품과 구별되는 제목인 <X-파일: 믿고 싶다–브라흐 프랭켄슈타인>으로 출시되었으며, 이는 크리스 카터 감독이 원래 구상했던 공포적인 비전을 복원했다는 평가를 받고 있습니다.

이 영화는 개봉 당시 흥행 성적은 기대에 미치지 못했지만, 예산 3천만 달러 대비 6천8백만 달러의 수익을 기록했습니다. 하지만 이 작품은 이후 2015년에 <X-파일>이 한정 시리즈 TV 시리즈로 돌아오는 계기가 되었으며, 2016년에는 시즌 10이 방영되었습니다.

이후 시리즈는 멀더와 스컬리가 실종된 아들 윌리엄을 찾는 여정을 중심으로 진행되었으며, 이는 시리즈의 핵심적인 서사를 이어갔습니다. 현재 루루 코글러가 주연을 맡은 헐리우드 릴루(Hulu) 리부트 제작이 진행 중인 상황에서, 이 감독판은 원작의 공포적인 분위기와 맥락을 재조명하며 팬들의 관심이 집중되고 있습니다.

Introducing Toast 1

새로운 검색 에이전트인 Toast 1이 출시되어 프론티어급 검색 품질을 훨씬 저렴하고 빠르게 제공합니다. Toast 1은 Claude Opus 5나 GPT-5.6 Sol과 동등하거나 능가하는 성능을 제공하면서도 비용은 10배, 속도는 12배 빨라지게 합니다. 이는 복잡한 문서 컬렉션에서 추론하고 분석하며 정보를 찾는 실제 지식 작업을 수행할 수 있게 합니다.

Toast 1은 초기 질의를 하위 질의로 분해하고 증거를 수집하며 출처를 검사하고 관련 컨텍스트를 선별하는 검색 루프 전체를 처리합니다. 이를 통해 에이전트는 추론과 최종 답변 생성과 같은 일반화된 프론티어 수준의 작업에 컴퓨팅 자원을 집중할 수 있게 됩니다. 실제 평가에서 Toast 1은 에이전트 작업 전반에 걸쳐 비용 대비 속도 측면에서 새로운 파레토 프론티어를 설정했습니다.

특히 OfficeQA Pro V2 평가에서 GPT-5.6 Sol이 Toast 1의 하위 에이전트로 작동했을 때 약 $1.15/작업당 70%의 답변 정확도를 달성하며 이전 최고 성능 기록을 뛰어넘었습니다. 법률 지식 벤치마크에서도 Toast 1을 추가함으로써 토큰 사용량을 51% 절감하면서도 성능을 유지할 수 있었습니다.

Toast 1은 Mixedbread 검색의 기본 원리와 공동 설계되었기 때문에 기존 검색 인덱스를 그대로 사용할 수 있는 백엔드 독립적인 구조를 가지고 있습니다. 사용자는 Toast 1을 기존 에이전트 워크플로우에 검색 도구로 추가하여 즉시 활용할 수 있으며, Mixedbread API를 통해 제공되는 가격으로 접근할 수 있습니다.

Unsloth Qwen3.8-27B GGUF files

unsloth에서 제공하는 Qwen3.8-27B 모델의 GGUF 파일이 공개되었습니다. 이 모델은 270억 개의 파라미터를 가지며, Unsloth 프레임워크를 통해 최적화된 양자화(Quantization) 형태로 제공되어 로컬 환경에서 효율적으로 추론할 수 있습니다.

해당 모델은 llama.cpp와 같은 라이브러리와 연동하여 사용하기 위한 다양한 설치 및 추론 방법을 상세히 안내하고 있습니다. 사용자는 llama.cpp를 이용한 직접 추론, Ollama, LM Studio, Docker, Lemonade, Hermes Agent, OpenClaw 등 다양한 로컬 추론 환경에서 이 모델을 구동할 수 있습니다.

특히 Unsloth Dynamic 2.0 Quants 컬렉션은 기존 양자화 방식보다 우수한 정확도와 SOTA 양자화 성능을 제공하며, Qwen3.8-27B 모델을 포함한 여러 양자화 옵션을 제공합니다. 이는 개발자들이 고성능 모델을 효율적으로 배포하고 활용하는 데 중요한 기준을 제시합니다.

모델의 기술적 사양으로는 최대 262,144 토큰의 컨텍스트 길이를 지원하며, 긴 길이의 텍스트 처리를 위해 YaRN과 같은 RoPE 스케일링 기법을 사용할 것을 권장합니다. 또한, 비디오 이해를 위한 최적화된 설정도 제공되어 다양한 멀티모달 작업에 활용할 수 있습니다.

Seven books I keep close because I love them

저자는 자신이 소중히 여기는 일곱 권의 책에 대해 이야기하며, 특히 '로젯의 동의어 사전(Roget's Thesaurus)'를 통해 개념을 분류하고 이해하는 방법에 대해 탐구합니다. 이 책은 단순히 동의어를 나열하는 것이 아니라, 시간과 같은 추상적인 개념을 계층적으로 분류하여 독자가 자신의 생각을 정제하도록 돕는 도구로 사용됩니다.

로젯의 아이디어는 세상의 모든 것을 위계로 분류하는 데서 출발하며, '추상 개념', '시간', 그리고 그 하위 분류인 '우선순위', '후속성', '동시성' 등을 통해 시간의 흐름에 대한 이해를 심화시킵니다. 저자는 이러한 분류 체계를 활용하여 어떤 사건들이 '즉각성'이나 '동시성'과 같은 단어를 통해 표현될 때, 단순히 동의어를 찾는 것이 아니라 자신이 의도하는 의미를 명확히 다듬을 수 있다고 설명합니다.

이러한 분류 방식은 시간의 개념을 다룰 때 '즉각성'이라는 단어가 순간성, 연속성, 서두름, 정확성 등 어떤 의미를 내포하는지 구별하게 해줍니다. 결과적으로 이 책은 독자가 자신이 표현하고자 하는 바를 더 명확하게 이해하고 정제하는 데 도움을 줍니다.

결론적으로 이 글은 책을 통해 얻은 지식을 개인적인 경험과 연결하고, 복잡한 개념을 체계적으로 정리하는 사고 과정을 보여줍니다. 이는 독자들이 지식과 아이디어를 구조화하는 방식에 대해 생각해 볼 기회를 제공합니다.

Taylor Farms' connections to Trump admin spurs probe into Cyclospora response

미국에서 최근 발생한 사이클로스포라(Cyclospora) 식중독 발병에 대한 연방 정부의 대응에 대해 의혹이 제기되고 있습니다. 이 질병은 여름 동안 24,000명 이상에게 영향을 미쳤으며 두 명의 사망자를 발생시켰고, 사람들은 채소를 최소 158°F 이상으로 조리해야 감염을 막을 수 있었습니다.

엘리자베스 워렌 상원의원은 보건부 장관 로버트 F. 케니(Robert F. Kenney Jr.)에게 보낸 서한에서 연방 정부의 대응이 "엉망이었으며 잘못된 조치들로 얼룩졌다"고 비판했습니다. 그녀는 이 서한에서 트럼프 행정부 내의 부패와 무능함, 그리고 이 행정부가 사이클로스포라 발병과 연관된 주요 농산물 유통업체인 테일러 파머스(Taylor Farms)와의 명확한 연관성이 연방 정부의 실패에 어떤 역할을 했는지에 대해 질문했습니다.

워렌 상원의원은 테일러 파머스가 발병과 연관된 멕시코산 서리 양상추를 판매한 대규모 농산물 유통업체라는 점을 지적하며, 이러한 영향력 남용이 연방 식품 안전 감독을 느슨하게 하고 발병에 대한 연방 정부의 대응을 방해하는 데 어떻게 작용했는지에 대한 심각한 의문을 제기했습니다. 이는 식품 안전 문제와 정치적 책임 간의 연관성에 대한 논란을 부각시키고 있습니다.

Self-hosted web push Cloudflare Worker, works on iOS

클라우드플레어 워커를 사용하여 iOS 기기로 웹 푸시 알림을 보낼 수 있는 자체 호스팅 웹 푸시 워커인 Kukuroo가 공개되었습니다. 이 서비스는 사용자가 소유한 푸시 엔드포인트를 기반으로 알림을 전송하며, 텔레그램이나 이메일 대신 잠금 화면에 직접 알림을 표시하는 방법을 제공합니다.

Kukuroo는 별도의 앱 설치 없이도 작업 완료나 이벤트에 대한 푸시 알림을 보낼 수 있게 하며, 이는 기존의 백엔드 시스템이나 CI/CD 파이프라인에서 실행되는 스크론(cron)이나 기타 HTTP 호출 기능을 활용하여 구현됩니다. 개발자는 `npx kukuroo init` 명령어를 통해 워커와 키를 설정하고 배포하는 과정을 단 몇 분 만에 완료할 수 있습니다.

이 시스템은 Cloudflare Workers를 실행 환경으로 사용하며, iOS 18.4 이상에서 Safari를 통해 홈 화면에 바로가기를 설정하여 알림을 수신하는 방식으로 작동합니다. 애플의 규칙에 따라 기기당 한 번의 알림만 허용되며, 이는 앱 스토어 없이도 사용자 경험을 개선하는 새로운 접근 방식입니다.

서비스는 무료 플랜과 유료 플랜을 제공하며, 무료 플랜은 50회 전송 및 일일 10만 건의 요청을 지원하고, 유료 플랜은 월 5달러로 10,000회 전송 및 일일 1,000만 건의 요청을 지원합니다. 이 기술은 Cloudflare Workers와 푸시 기능을 결합하여 서버 관리 없이도 사용자에게 직접적인 알림을 전달하는 방법을 제시합니다.

Qwen3.8-27B

알리바바 Qwen 팀이 Qwen3.8-27B 모델의 오픈 웨이트를 공개하며 개발자 커뮤니티에 공개했습니다. 이 모델은 270억 개의 파라미터를 가지면서도 네이티브 멀티모달 밀집 모델로 설계되어 실질적인 코딩 및 사무 작업 워크플로우에서 뛰어난 성능을 보입니다.

Qwen3.8-27B는 Qwen3.7-Plus를 전반적으로 능가하며, 262K의 네이티브 컨텍스트를 제공하고 YaRN을 통해 1M 토큰까지 확장할 수 있어 긴 컨텍스트 처리가 용이합니다. 또한 이 모델은 Apache 2.0 라이선스를 따르며, 효율성과 품질을 모두 갖춘 빌더를 위한 모델로 제작되었습니다.

최고 수준의 모델인 Qwen3.8-2.4T-A95B의 오픈 웨이트도 최근에 공개되어, 개발자들은 Qwen3.8-27B나 Qwen3.8-2.4T-A95B를 활용하여 경량 애플리케이션을 배포하거나 에이전트를 구축할 수 있습니다.

이 모델들은 Hugging Face와 ModelScope를 통해 접근 가능하며, Unsloth AI를 통해 Dynamic GGUF 형태로 제공되어 로컬 환경에서 실행 및 미세 조정이 가능합니다.

Tech Visionary Says the Big AI Labs Don’t Get What People Want

기술 선구자인 팀 오라일리(Tim O’Reilly)는 인공지능이 거대 AI 연구소들이 대중이 원하는 것을 얻지 못하게 만들고 있다고 지적합니다. 그는 AI에 대해 열렬한 지지를 표하지만, 이는 오픈 소스 형태로 제공될 때에 한해서만 가능하다고 강조합니다.

이는 AI 기술의 발전과 상업화 과정에서 대규모 연구 기관들이 사용자 중심의 요구를 충족시키는 데 어려움을 겪고 있음을 시사합니다. 특히 오픈 소스 생태계는 이러한 거대 기업들의 접근 방식에 대한 대안으로 작용하며, 개발자들이 원하는 방식으로 AI를 접근하고 활용할 수 있는 환경을 제공합니다.

따라서 AI 개발자들은 거대 기업의 독점적인 접근 방식보다는 오픈 소스 기반의 개방적인 모델에 주목해야 합니다. 이는 AI 기술이 특정 소수에게 집중되는 것이 아니라, 더 넓은 커뮤니티와 사용자 요구에 따라 발전할 수 있는 가능성을 열어줍니다.

Qwen 3.8 27B is out: open weights, best local dense model yet

Qwen/Qwen3.8-27B-FP8 모델이 오픈 웨이트로 공개되었으며, 현존하는 로컬 밀집 모델 중 최고 성능을 제공합니다. 이 모델은 FP8 양자화 방식을 사용하여 280억 개의 파라미터를 가지며, Hugging Face Transformers 형식으로 제공되어 다양한 환경에서 쉽게 접근하고 사용할 수 있습니다.

해당 모델은 Hugging Face Transformers뿐만 아니라 vLLM, SGLang, TokenSpeed 등 주요 추론 프레임워크와의 호환성을 보장합니다. 개발자들은 이 모델을 사용하여 파이프라인 추론이나 vLLM, SGLang 서버를 통해 효율적인 추론을 구현할 수 있습니다.

모델의 성능을 극대화하기 위해 긴 컨텍스트 처리에 대한 최적화 방법이 제시되었습니다. SGLang이나 TokenSpeed를 사용할 경우, 컨텍스트 길이를 확장하기 위해 rope_parameters 설정이나 factor 값을 조정할 것을 권장합니다. 또한, 비디오 이해와 같은 작업의 추론 효율을 높이기 위해 비디오 전처리 설정에서 longest_edge 매개변수를 조정하는 방법도 안내하고 있습니다.

Qwen 클라우드는 Qwen3.8-27B 모델을 100만 토큰 길이의 컨텍스트와 같은 더 많은 생산성 기능을 제공하는 호스팅 버전을 곧 출시할 예정입니다. 이는 인프라 관리 없이 관리형 추론 서비스를 이용하고자 하는 사용자들에게 대안을 제공할 것입니다.