이 연구는 대화형 데이터 수집, 구조화된 데이터 처리, 행동 예측을 통합하는 세 에이전트 워크플로우를 제안하며 여행 행동 연구에 새로운 접근 방식을 제시합니다. 연구진은 챗봇을 통해 이미지로 보강된 선호도 설문조사를 실시하여 454명의 학생 통근자로부터 다섯 가지 기상 시나리오에 따른 이동 수단 선택 데이터를 수집했습니다.
수집된 기상 관련 연관성은 다항 로짓 모델로 분석되었으며, 로지스틱 회귀와 랜덤 포레스트가 머신러닝 벤치마크로 사용되었습니다. 또한 20억에서 350억 매개변수를 가진 아홉 개의 LLM을 평가했으며, 프롬프트 및 컨텍스트 조건, 페르소나, 퓨샷, 비전 기반 구성 등 다양한 방식으로 확장하여 평가했습니다.
결과적으로 랜덤 포레스트는 5개 클래스 정확도 69.6%를 달성했으며, 텍스트만 사용한 제로샷 LLM은 특정 작업 맞춤 학습 없이도 69.9%에 도달했습니다. 특히, 응답자에게 동일한 기상 이미지를 보여준 비전 기반 구성은 71.5%의 정확도를 기록했는데, 이는 시각적 맥락이 선택된 모델에 추가적인 예측 정보를 제공할 수 있음을 시사합니다.
연구는 습관적인 여행 정보가 가장 일관된 성능 향상을 제공했으며, 페르소나 정보는 습관 정보가 없을 때 가장 유용했습니다. 또한 퓨샷 프롬프팅은 여러 모델의 예측 성능을 개선했으며, 몇 개의 예시 이후에는 성능 향상이 안정화되는 경향을 보였습니다. 이 연구는 대화형 설문조사, 구조화된 데이터 처리, 머신러닝, 멀티모달 LLM 예측을 감사 가능한 멀티 에이전트 워크플로우 내에서 조정할 수 있음을 보여줍니다.
arXiv AI/ML
arXiv API
논문
발행 2026-08-20
Narges Ahmadi, Yubo Jiao, Jônatas Augusto Manzolli, Jiangbo Yu, Luis Miranda-Moreno
수집 2026-08-21 02:33
일상적인 작업 방식에 대한 기호적이고 감사 가능하며 재사용 가능한 모델을 도출하기 위해 컴퓨터 사용 흔적을 활용하는 연구가 발표되었습니다. 이러한 모델은 컴퓨터 사용 에이전트가 실제 업무에 참여할 때 작업이 실제로 어떻게 수행되는지를 학습하고 조직이 지식을 감사하고 재사용할 수 있도록 하는 데 중요합니다.
그러나 활동은 저수준 이벤트로만 관찰되며 실제 작업은 목표가 혼합된 멀티스레드로 진행되기 때문에 이러한 작업 모델을 유도하는 것은 어렵습니다. 기존 방법들은 주어진 작업이나 단일 워크플로우를 가정하며 구조화된 작업 모델 대신 단계별 요약만을 생성합니다.
본 논문은 작업 모델 유도(Task Model Induction, TMI)를 제안하는데, 이는 먼저 제약 없는 흔적에서 잠재된 작업을 발견하여 동시 활동을 분리하고, 각 잠재된 작업에 대해 재귀적 목표 분해의 계층적 목표 모델과 실행을 조직한 제어 흐름의 절차 모델을 결합한 작업 모델을 유도합니다.
실험 결과, TMI는 제어된 인간 및 에이전트 궤적에서 중첩된 작업을 실제 정답 그룹과 0.974의 일치도로 복구하며 관찰된 실행 단계의 74.9%를 재구성하여 기존의 가장 강력한 워크플로우 유도 기준보다 훨씬 뛰어난 성능을 보였습니다. 또한 TMI의 작업 모델에서 파생된 기술은 홀드아웃 작업 정확도를 가장 강력한 기준 대비 30.0% 향상시킵니다.
arXiv AI/ML
arXiv API
논문
발행 2026-08-20
Yucheng Jiang, Zora Zhiruo Wang, Ruishi Chen, Diyi Yang
수집 2026-08-21 02:33
재귀적 자기 개선(RSI)은 AI 시스템이 AI 시스템을 생성하는 과정을 개선하여 다음 시스템이 그 개선을 물려받을 수 있는지에 대한 질문입니다. 이 과정은 훈련 알고리즘이며, 더 나은 목표나 업데이트 규칙은 다음 에이전트를 생성하는 훈련을 포함하여 모든 후속 실행의 컴퓨팅 능력 교환율을 개선합니다. 따라서 RSI의 실현 가능성은 에이전트가 훈련 알고리즘을 설계할 수 있는지에 달려 있습니다.
기존 벤치마크는 이러한 능력을 분리하여 측정하지 못하며, 데이터 수집이나 하이퍼파라미터 튜닝에 의존하고 있습니다. 이에 본 연구는 10가지 훈련 알고리즘 패밀리를 포괄하는 10개의 고정된 연구 저장소로 구성된 AI4AI-Bench를 제시합니다. 이 벤치마크에서 에이전트는 B300에서 훈련 알고리즘을 재작성하고, 이를 다시 12시간 동안 실행한 후 에이전트에게 숨겨진 고정 평가자에 의해 점수가 매겨집니다.
각 작업은 0이 정보가 없는 모델, 0.1이 저장소에서 제공하는 알고리즘, 1.0이 최적의 목표를 나타내는 척도로 매핑됩니다. 29가지 구성에 걸친 평균 점수는 0.166이며, 가장 강력한 시스템은 0.250에 도달하여 이미 존재하는 알고리즘과 최적값 사이의 거리의 5분의 1을 좁혔습니다.
제출된 결과는 대부분 모델 학습 방식을 변경하지 않았으며, 소수만이 다른 결과를 보였습니다. 추론 노력을 더 기울인 결과, 이 소수 집단은 제출물의 8%에서 64%로 증가했으며 평균 점수는 0.094에서 0.196으로 상승했습니다. 연구팀은 측정의 반복 가능성을 위해 작업 세트, 평가자, 모든 점수화된 제출물을 공개합니다.
arXiv AI/ML
arXiv API
논문
발행 2026-08-20
Yizhe Chi, Wenyi Li, Deyao Hong, Xiaoqiu Wang, Mingju Gao, Kaisen Yang, Bingxiang He, Youjie Zheng, Calvin Xiao, Qinhuai Na
수집 2026-08-21 02:33
소련의 중앙 계획 경제는 자원 배분을 위해 극심한 데이터 복잡성과 비효율성을 겪었습니다. 수많은 상품과 공급망의 의존성 때문에 중앙 관리자들은 현실적으로 불가능한 수준의 단순화와 차원 축소를 적용해야 했으며, 이는 자원 배분의 실패로 이어졌습니다.
관리자들은 1200만 종류의 상품과 수많은 제약 조건으로 인해 최적화 문제를 해결하는 데 수천 년이 걸릴 수 있는 거대한 선형 계획 문제를 다루었으며, 이는 데이터의 차원 축소와 집계라는 비현실적인 가정에 기반했습니다. 이러한 단순화 과정에서 특정 상품의 과잉 생산과 다른 상품의 심각한 부족 현상이 발생하여 공장들이 유휴 상태에 놓이는 결과를 초래했습니다.
또한 중앙 계획 경제의 또 다른 심각한 문제는 데이터 품질이었습니다. 중앙 계획자들은 개별 공장의 실제 생산 능력과 투입 요구 사항에 대해 정확한 정보를 알지 못했기 때문에, 데이터의 불확실성이 자원 배분을 더욱 악화시키는 핵심 원인이 되었습니다.
이러한 역사적 사례는 현대 데이터 과학과 운영 연구에서 데이터의 차원 축소, 희소성(sparsity), 그리고 데이터 품질이 최적화 문제 해결에 얼마나 결정적인 영향을 미치는지 보여줍니다. 미래에는 사물 인터넷과 같은 기술을 통해 공급망 데이터를 측정하고 개선할 수 있지만, 객관적인 목표 함수 설정과 혁신 장려라는 더 큰 사회적 과제를 해결하는 것이 여전히 남아 있습니다.
Hacker News
논문
피드 등록 2026-08-20
cassepipe
수집 2026-08-20 18:27
이 연구는 여러 모델이나 아키텍처로 구성된 이질적인 AI 시스템에서 쿼리를 가장 효과적이고 비용 효율적인 전문가에게 라우팅함으로써 품질과 효율성을 개선하는 방법을 다룹니다. 이러한 라우팅을 위해서는 각 전문가의 예상 수익을 추정해야 하는데, 이 가치 추정 과정 자체가 비용을 발생시킵니다.
연구진은 이러한 비용과 정확도의 상충 관계를 '판도라의 상자(Pandora's Box)' 문제로 공식화하며, 이는 비용이 수반되는 최적 탐색 문제로 정의됩니다. 가우시안 신호 모델 하에서 도출된 정책은 각 전문가와 입력에 대해 가치 정보의 표현식을 제공하며, 이를 통해 추정값을 개선하는 것이 비용을 상쇄할 가치가 있는지 판단할 수 있게 합니다.
이러한 개념을 중앙 집중식 정책인 '판도라의 라우터(Pandora's Router)'와 분산식 설정인 '판도라의 입찰자(Pandora's Bidder)'로 확장하여 적용했습니다. 실험 결과, 판도라의 라우터는 포괄적인 추정의 라우팅 품질을 유지하면서도 비싼 추정값을 훨씬 적게 질의하는 것을 보여줍니다.
분산 설정에서 가치 정보 추론은 경쟁 추정값이 정확할 때 할당 효율성을 개선하지만, 추정값이 노이즈가 있을 경우 전략적인 전문가의 효용을 다른 전문가의 희생으로 증가시킬 수 있다는 점을 확인했습니다.
arXiv AI/ML
arXiv API
논문
발행 2026-08-20
Adam Fisch, Shubhendu Trivedi, Fantine Huot, William W. Cohen, Michael Kaisers, Mirella Lapata, Kate Larson, Jacob Eisenstein
수집 2026-08-21 02:33
의료 분야에서 구조화된 전자의무기록(EHR) 기반 예측 모델은 중요하지만, 입력된 의료 사건에 대한 정량적인 실험실 정보와 해석 가능성을 동시에 강조한 연구는 부족했습니다. 본 논문은 이러한 방법론적 격차를 해소하기 위해 BERT-LER라는 BERT 스타일 모델을 제시합니다.
BERT-LER는 7500만 명의 환자로부터 익명화된 EHR 데이터셋을 사용하여 사전 학습 및 미세 조정되었으며, 실험실 검사 결과를 분위수 기반 구간화(percentile-based binning)를 통해 보존하면서 이산 토큰으로 인코딩합니다. 여기에 입력된 EHR 시퀀스에 근거한 토큰 수준의 기여도를 제공하는 통합 기울기(Integrated Gradients)를 결합하여 해석 가능성을 확보했습니다.
연구진은 이 접근 방식을 EHRShot 벤치마크와 실제 데이터 기반 천식 중증도 진행 연구에서 평가했습니다. 그 결과, BERT-LER는 공개된 벤치마크 모델과 경쟁할 뿐만 아니라 실험실 관련 작업에서는 더 뛰어난 예측 성능을 달성했으며, 임상적으로 알려진 위험 요인과 일치하는 기여도를 제공했습니다.
이러한 아키텍처와 해석 가능성 접근 방식은 구조화된 EHR을 기반으로 훈련된 언어 모델을 사용하여 다양한 치료 영역과 예측 작업에 적용될 수 있습니다. 이는 EHR 기반 모델링에서 예측 성능과 설명 가능성을 단일 프레임워크로 통합하는 데 기여합니다.
arXiv AI/ML
arXiv API
논문
발행 2026-08-20
Jun Ni Du, Lukas Adamek, Maxim Kryukov, Flavio Dormont, Ziv Bar-Joseph, Sven Jager, Brandon Rufino
수집 2026-08-21 02:33
생명과학은 종종 골지체나 크렙스 회로 같은 이름의 나열로 제시되어 깊은 경이로움을 제공하지 못합니다. 저자는 세포가 DNA, RNA, 단백질을 통해 스스로를 재조직하는 프로그램과 같다는 관점을 제시하며, 생명 현상의 놀라움은 이러한 복잡한 과정 속에 있다고 주장합니다. 초기 세포가 어떻게 분화하여 뇌 세포와 같은 복잡한 구조를 형성하는지 이해하는 것은 생물학의 가장 큰 경이로움 중 하나입니다.
이러한 생물학적 과정은 화학적 기울기를 통해 유전자 발현 프로그램을 미세하게 변화시키는 방식으로 작동하며, 이는 세포가 어떻게 서로 다른 기능을 가진 세포들로 분리되는지를 설명합니다. 저자는 과거의 생물학 연구가 실제 실험과 질문을 통해 이루어졌어야 했으며, 단순히 결론만 전달하는 방식에 대해 비판합니다. 특히 에이버리(Avery)가 핵산의 역할을 발견한 실험처럼, 실제 물리적 모델과 실험을 통해 유전의 원리를 밝혀낸 역사적 과정을 강조합니다.
현대에는 생물학을 시뮬레이션하고 시각화하는 도구의 필요성이 더욱 커지고 있습니다. 저자는 생물학이 기계와 같은 세계를 다루기 때문에 시뮬레이션에 매우 적합하다고 지적하며, 이를 위해 마인크래프트나 MockMechanics처럼 생물학에 특화된 도구 키트가 필요하다고 제안합니다. 이는 단순히 지식을 암기하는 것을 넘어, 개발자들이 생물학적 개념을 물리적 공간에 구현하고 상호작용할 수 있는 환경을 구축해야 함을 시사합니다.
Hacker News
의견
피드 등록 2026-08-20
tyre
수집 2026-08-20 18:27
로블록스가 호주의 온라인 안전 규제 기관인 eSafety의 조사 결과에 따라 아동 안전 기능에 대한 변화를 약속했습니다. eSafety는 로블록스가 호주 온라인 안전법을 준수하지 않았다는 우려를 조사했으며, 특히 16세 미만 아동과 성인 간의 접촉을 방지하기 위한 충분한 조치를 취하지 않았다는 문제에 초점을 맞췄습니다.
eSafety의 올해 테스트 결과, 로블록스는 일부 새로운 안전 조치를 도입했음에도 불구하고 아동을 위험에 노출시키는 상태가 지속된다는 사실이 밝혀졌습니다. 조사 결과, 플랫폼은 아동과 성인 낯선 사람 간의 접촉을 허용하는 등 아동을 위험에 노출시킬 수 있는 상황이 발견되었습니다.
이에 따라 로블록스는 호주 아동을 그루밍 및 성적 착취로부터 보호하기 위해 더 많은 조치를 취하겠다고 약속했습니다. eSafety는 로블록스에게 추가적인 보호 조치를 이행하라는 법적 구속력이 있는 약속을 확보했습니다.
The Verge
뉴스
발행 2026-08-20
Jay Peters
수집 2026-08-20 18:28
프로젝트 사이버신은 칠레 알렌데의 경제 관리를 위해 네트워크 컴퓨터를 사용하려 했던 초기 시도였습니다. 이 프로젝트는 영국 사이버네틱스 학자인 스태퍼드 비어의 참여를 받았으며, 참가자들이 달성하고자 했던 목표와 시스템이 실제로 이룬 성과, 그리고 유사한 시스템이 현대 기술로 무엇을 할 수 있을지에 대한 질문을 던집니다.
사이버신은 네 가지 주요 구성 요소로 설계되었습니다. 생산 시설과 정부 기관을 연결하는 텔렉스 기계 네트워크인 사이버넷, 주변부에서 들어오는 데이터의 이상 징후를 감지하는 중앙 프로그램인 사이버스트라이드, 정책 입안자를 위한 거시경제 시뮬레이션 모델인 체코, 그리고 이를 통합하여 정보를 표시하는 운영실인 컨트롤 룸이 포함됩니다.
특히 이상 징후를 감지하는 사이버스트라이드 시스템은 현장 자율성을 보존하기 위해 경고 시 해당 공장으로 피드백을 보내는 방식으로 설계되었으나, 측정과 중앙 시스템 처리 사이에 발생하는 시간 지연 때문에 문제 발생을 조기에 감지하려는 본래의 목적은 실패했습니다.
비록 텔렉스 네트워크가 노동조합 파업을 조정하는 데는 유용했지만, 사이버네틱 원리나 이상 징후 감지 기능은 실제 경제 문제 해결에 크게 기여하지 못했습니다. 결국 이 프로젝트는 정치적 타협을 통해 마무리되었으며, 기술적 성과보다는 정치적 환경이 결과에 더 큰 영향을 미쳤음을 보여줍니다.
Hacker News
논문
피드 등록 2026-08-20
cassepipe
수집 2026-08-20 18:27
연방통신위원회(FCC)가 기가비트 속도가 사용자에게 너무 좋다는 이유로 목표를 포기하기로 공식 결정했습니다. 브렌단 카(Brendan Carr) 위원장은 바이든 행정부 시절 설정된 장기 광대역 속도 목표를 폐기하겠다는 2025년의 위협을 이행한 것입니다. 이 목표는 궁극적으로 다운로드 기가비트 및 업로드의 절반 기가비트 속도를 달성하는 것을 목표로 했습니다.
이는 미국 전역에서 광대역 속도를 확대하려는 장기적인 노력이 중단됨을 의미합니다. 이 목표는 미국 내에서 광범위한 고속 인터넷 접근성을 확보하기 위한 중요한 기준이었습니다.
특히, 콤캐스(Comcast)가 2013년에 이미 미국인들이 기가비트 인터넷이 필요하지 않다고 주장했던 지 13년 만에 이러한 논의가 다시 수면 위로 떠오른 점이 주목됩니다. 이는 민간 부문이 일부 지역에서 높은 속도를 제공했음에도 불구하고, 정부 차원의 인프라 목표 설정과 이행에 있어 정책적 변화가 발생했음을 보여줍니다.
The Verge
뉴스
발행 2026-08-20
TC. Sottek
수집 2026-08-20 18:28
xAI의 Grok 챗봇이 일부 사용자들에게 무의미한 응답을 보내는 버그가 발생했습니다. 사용자들이 PDF 생성을 요청했을 때 "match it without and your they and two for planets can practical and often cheese…"와 같은 의미 없는 텍스트를 받았으며, 이는 Grok Lite 사용자들이 수요일 아침부터 문제를 인지했다고 밝혔습니다.
이 문제는 Grok.com의 직접적인 쿼리에 한정되어 발생했으며, Grok 계정이 있는 X.com에서는 영향을 받지 않는 것으로 확인되었습니다. TechCrunch는 자체 테스트에서는 이 문제를 재현하지 못했으며, 현재 소수의 사용자에게만 영향을 미칠 가능성이 있다고 보고 있습니다.
xAI는 이 문제가 일시적인 생성 오류이며, 공식 상태 페이지에 따르면 모든 Grok 서비스는 정상적으로 작동하고 있다고 확인했습니다. 사용자들은 새로운 채팅을 시작하거나 응답을 다시 생성하면 문제가 해결된다고 밝혔습니다.
TechCrunch
뉴스
발행 2026-08-20
Russell Brandom
수집 2026-08-20 18:27
TechCrunch Disrupt 2026은 AI 시대에 지속 가능한 회사를 구축하는 방법에 대한 질문을 중심으로 진행되며, 투자자에게는 경쟁 속에서 선도적인 회사를 발굴하는 방법을 제시합니다. 이 행사는 단순히 네트워킹을 넘어, 20,000건의 맞춤형 미팅을 통해 투자자들이 시장의 흐름을 파악하고 잠재적인 투자 기회를 포착할 수 있는 기회를 제공합니다.
투자자들은 자신의 포트폴리오 단계에 따라 다른 트랙을 활용하여 이점을 극대화할 수 있습니다. 초기 단계 투자자들은 스타트업 배틀필드 200 심사 및 엑스포 홀을 통해 초기 베팅과 라운드 참여 기회를 우선해야 합니다. 시리즈 A 단계의 투자자들은 딜 흐름 카페와 1:1 미팅을 통해 양질의 거래 흐름과 속도를 확보하는 데 집중해야 합니다.
행사의 핵심은 스타트업 배틀필드 200에 있으며, 이는 투자자들에게 검증된 200개의 프리시리즈 A 스타트업을 제공하는 소싱 엔진 역할을 합니다. 이 스타트업들은 이미 상당한 자금을 모았으며 250건 이상의 엑시트를 기록하여 투자 가치가 입증되었습니다.
또한 투자자 패스는 딜 흐름 카페와 같은 독점적인 접근 권한을 제공하며, 숙박 및 교통 할인 혜택도 제공됩니다. 티켓 할인 혜택은 8월 21일까지 진행되므로, 투자자들은 이 기회를 활용하여 최대 300달러의 절감 효과를 얻을 수 있습니다.
TechCrunch
뉴스
발행 2026-08-20
TechCrunch Events
수집 2026-08-20 18:27
AT 프로토콜 URL 단축기인 atpr.to는 사용자가 자신의 PDS에 링크를 저장하고 관리할 수 있는 서비스를 제공합니다. 이 시스템은 사용자가 대시보드와 QR 코드를 통해 짧은 링크를 생성, 편집, 삭제할 수 있게 하며, 링크를 자신의 핸들 또는 DID에 연결하여 SVG 형식으로 내보낼 수 있습니다.
개발자들은 이 서비스를 JSON API를 통해 프로그래밍 방식으로 접근할 수 있어 링크 관리를 자동화할 수 있습니다. 또한 AT 프로토콜 신원을 사용하여 로그인함으로써 사용자들은 자신의 링크를 안전하게 관리할 수 있습니다.
이 서비스는 링크를 저장하고 관리하는 기능을 넘어, 사용자 데이터에 기반한 링크 관리와 프로그래밍 접근성을 제공하는 데 중점을 둡니다. 현재는 @seqre.dev에 의해 생성되거나 수정 대기 중인 단축 URL들이 있으며, 이는 AT 프로토콜 기반의 개인화된 URL 관리 시스템을 구축하고 있습니다.
Hacker News
출시
피드 등록 2026-08-20
jcbhmr
수집 2026-08-20 18:27
ChatGPT 출시 이후 웹페이지의 상당 부분이 AI의 저작권 또는 대폭적인 편집 흔적을 보인다는 연구 결과가 나왔습니다. Pew Research가 발표한 이 보고서는 ChatGPT 출시 이후 게시된 웹페이지의 35%가 AI에 의해 작성되었거나 크게 편집되었다는 것을 발견했습니다.
이 연구는 지난 5년간의 영어 웹페이지 약 50만 개를 수집하여 AI 작성 여부를 탐지하기 위해 Common Crawl 아카이브와 Open Pangram 기술을 사용했습니다. 특히 AI 작성 흔적은 .com 도메인에서 .edu나 .gov 도메인보다 약 10배 높은 비율로 나타났으며, .org 도메인에서는 4.6%의 AI 저작권이 발견되었습니다.
연구진은 이 분석이 완벽하지 않으며, AI 탐지 도구가 페이지를 잘못 분류할 수 있다는 점을 지적했습니다. 또한, 샘플에 AI 작성 도구가 존재하기 이전의 오래된 페이지들이 포함되어 있어 해당 페이지들은 AI 작성으로 간주될 수 없다는 점을 고려해야 합니다.
이러한 결과는 웹 콘텐츠의 생성 방식이 빠르게 변화하고 있으며, AI가 웹 생태계의 주요 콘텐츠 생산자로 자리 잡고 있음을 시사합니다. 이는 웹 개발자와 콘텐츠 제작자들이 AI 생성 콘텐츠의 확산과 그에 따른 새로운 기준을 이해하는 데 중요한 맥락을 제공합니다.
TechCrunch
뉴스
발행 2026-08-20
Sarah Perez
수집 2026-08-20 17:27
일부 Framework Laptop 13 사용자들이 최근 BIOS 업데이트로 인해 노트북이 벽돌(bricking)이 되는 문제를 보고했습니다. 이 문제는 Windows와 Linux 환경 모두에서 발생했으며, 특히 AMD Ryzen 7040 시리즈 메인보드를 사용하는 기기에서 문제가 집중적으로 보고되었습니다.
문제가 발생한 BIOS 업데이트 버전은 7월에 출시되어 현재도 Framework 웹사이트에서 다운로드할 수 있는 버전 3.20입니다. 일부 사용자는 이 업데이트를 실행하는 과정에서 업데이트 화면에서 멈추는 현상을 경험했다고 보고했습니다.
이 문제에 대해 Framework는 보증 기간 내에 교체 메인보드를 제공하는 방침을 밝혔으나, 보증 기간이 만료된 일부 사용자들은 새 메인보드를 구매해야 한다는 답변을 받았습니다. 따라서 해당 BIOS 업데이트를 적용하기 전에 사용자는 자신의 기기 상태와 보증 조건을 확인하는 것이 중요합니다.
The Verge
뉴스
발행 2026-08-20
Antonio G. Di Benedetto
수집 2026-08-20 17:27
로블록스가 아동을 성인으로부터 보호하는 데 실패했다는 주장이 제기되었습니다. 호주의 eSafety 위원회는 로블록스가 성인이 아동에게 접근하는 것을 막는 데 충분한 조치를 취하지 못했다고 밝혔습니다.
eSafety는 올해 초 로블록스의 안전장치에 심각한 격차가 있음을 발견하기 위해 테스트를 진행했습니다. 이 테스트 결과, 성인 낯선 사람이 아동에게 연결 요청을 보낼 수 있었으며, 아동의 프로필, 자기소개, 계정 이름, 연결 정보, 아바타 이미지 등 비민감한 생물학적 정보가 플랫폼 내 모든 사용자에게 노출되었으나 이를 제한할 수 있는 옵션은 없었습니다.
또한, 이러한 요청은 부모에게 알림을 보내지 않았으며, 악의적인 행위자들은 아동의 공개된 연락 목록을 검색하여 더 많은 표적을 찾을 수 있었습니다. 로블록스는 온라인 안전법에 따라 독립 감사에 제출되었지만, 이러한 발견은 플랫폼의 안전장치에 대한 근본적인 문제점을 시사합니다.
Ars Technica
뉴스
발행 2026-08-20
Ashley Belanger
수집 2026-08-20 19:28
초기 세레브라스 투자자 아디트 싱(Adit Singh)이 인프라 파트너인 메이필드(Mayfield)에 합류하며 새로운 투자 기회를 모색합니다. 싱은 과거 세레브라스의 첫 펀딩 라운드를 주도한 경험이 있으며, 현재 메이필드에서 반도체, 사이버 보안, 물리적 AI 분야에 투자할 예정입니다.
싱은 메이필드가 보유한 반도체 포트폴리오에 주목하며 이 자리를 선택했습니다. 메이필드는 현재 업스케일 AI와 루밀렌스(Lumilens) 등 투자 포트폴리오를 보유하고 있으며, 특히 반도체 분야에서 강점을 보이고 있습니다. 싱은 전기 공학을 전공한 칩 설계자로서 애플리케이션부터 트랜지스터까지 전체 워크로드를 이해하는 독특한 통찰력을 가지고 있습니다.
그는 최근 시드 인프라 거래 규모가 커진 점을 고려하여 메이필드의 대규모 시드 자금 운용 능력에 매력을 느꼈습니다. 메이필드는 30억 달러의 운용 자산을 바탕으로 최대 2,000만 달러에 달하는 시드 체크를 집행할 수 있는 역량을 갖추고 있습니다. 이는 개발자 및 스타트업 투자자들에게 새로운 인프라 투자 기회를 제공할 수 있습니다.
TechCrunch
뉴스
발행 2026-08-20
Marina Temkin
수집 2026-08-20 17:27
Cloudflare OAuth가 선택적 범위(optional scopes)를 지원하여 사용자가 애플리케이션이 접근할 수 있는 권한을 더 세밀하게 제어할 수 있게 되었습니다. 이는 개발자가 작업에 필요한 최소한의 접근 권한만 요청하고 나머지는 선택 사항으로 지정하여 보안을 강화하고 동의 절차를 간소화할 수 있도록 돕습니다.
기존의 동의 화면은 모든 권한을 일괄적으로 승인하거나 거부하는 방식이었으나, 이제 클라이언트 소유자는 특정 범위들을 선택적으로 표시할 수 있습니다. 사용자는 권한 부여 시 요청된 범위 중 선택적 범위를 제외하고 원하는 범위만 허용할 수 있게 되어, 불필요한 접근을 최소화하고 보안에 대한 통제권을 확보할 수 있습니다.
이 기능은 요청된 권한 흐름에 따라 필수 범위와 선택적 범위를 평가하며, 최종적으로 발급되는 액세스 토큰에는 사용자가 실제로 동의한 범위만 포함됩니다. 따라서 개발자는 권한 코드를 교환한 후 실제로 부여된 범위 집합을 확인해야 하며, 이는 사용자에게 필요한 최소한의 권한만 부여하는 신뢰할 수 있는 접근 방식을 구축하는 데 중요합니다.
Cloudflare Blog
뉴스
발행 2026-08-20
José Enrique Rodríguez
수집 2026-08-20 17:27
방위 산업 기술 분야의 거품이 통합 단계로 접어들고 있습니다. 수십억 달러가 투자되었음에도 불구하고, 많은 방위 기술 스타트업들은 반복 수익이나 장기 계약 없이 막대한 가치 평가를 받고 있으며 이는 실제 시장 규모와 괴리가 발생하고 있습니다. 현재의 가치 평가는 시장의 기대에 기반하고 있으며, 실제 정부의 자금 흐름과 실질적인 시장 규모를 고려하면 현재의 고평가는 수학적으로 지지되지 않습니다.
실제 방위 기술 시장 규모는 대중이 생각하는 것보다 훨씬 작으며, 실제 자금 지원 라인은 방위 기술 시장의 전체 예산보다 훨씬 적습니다. 특히 자율 시스템, 드론, 소프트웨어, 센싱과 같은 실질적으로 경쟁 가능한 분야의 시장 규모는 연방 예산 요청액보다 훨씬 작은 수십억 달러 수준입니다. 정부는 수많은 틈새 공급업체 대신 경험이 풍부한 소수의 신뢰할 수 있는 주요 계약업체와 시스템 통합업체와 협력하기를 선호합니다.
이러한 현실은 향후 18개월 내에 구조조정으로 이어질 것으로 예상됩니다. 많은 스타트업들이 다음 투자 라운드를 유치하는 데 어려움을 겪을 것이며, 결국 인수합병이나 가치 재조정을 통한 통합이 이루어질 것입니다. 따라서 개발자들은 단순히 높은 가치에 집중하기보다, 제품이 실제 전장에서 신뢰성 있게 작동하고 확장 가능한 단위 경제를 갖추었는지에 초점을 맞춰야 합니다.
Hacker News
분석
피드 등록 2026-08-20
asdfwebdf
수집 2026-08-20 18:27
YC P25에 속한 Sixtyfour가 소프트웨어 엔지니어 인턴을 채용하며 AI 기반 리서치 에이전트 시스템 구축에 참여할 기회를 제공합니다. 이 포지션은 6천 달러에서 1만 달러의 월급을 제공하며 샌프란시스코에서 직접 근무하게 되며, AWS, Kubernetes, Python, TypeScript 등 광범위한 기술 스택을 활용하여 백엔드 및 AI 에이전트 시스템을 개발하게 됩니다.
시퀀티포는 오픈 웹 리서치 및 데이터 구조화에 특화된 AI 에이전트를 구축하는 것을 목표로 하며, 인턴에게는 단순히 코드를 작성하는 것을 넘어 시스템 설계와 확장성에 대한 깊은 이해를 요구합니다. 지원자는 데이터 볼륨, 동시성, 지연 시간, 비용을 사전에 고려하여 대규모 시스템을 설계하고, 실제 부하에서도 작동하는 시스템을 구축하는 엔지니어링 기본기를 갖추어야 합니다.
채용 과정에서 회사는 강력한 시스템 설계 직관과 실제 시스템 운영 경험, 그리고 LLM 및 에이전트에 대한 진정한 호기심을 가장 중요하게 평가합니다. 특히, 엔지니어링의 핵심인 설계와 트레이드오프를 깊이 있게 고민하고, 결과에 대해 책임을 지는 자세를 가진 지원자를 선호합니다.
인턴에게는 실제 제품에 영향을 미치는 기능을 엔드투엔드로 구축하고, AI 에이전트의 성능을 입증하는 평가(evals)를 작성하며, 수백만 건의 기록을 처리하는 장기 실행 작업을 신뢰성 있게 처리하는 시스템을 구축하는 경험을 얻게 됩니다. 또한, 실제 AI 연구 에이전트와 대규모 시스템을 구축하는 엔지니어들로부터 직접적인 멘토링을 받으며 최신 LLM 및 개발 도구를 사용할 수 있는 충분한 예산을 제공합니다.
Hacker News
출시
피드 등록 2026-08-20
HPMOR
수집 2026-08-20 17:26