에이전트 워크플로리와 모델·워크스페이스 확장이 겹쳤다
오픈AI와 AWS·Strands Labs가 각각 소형 결정 모델과 로컬 실행으로 에이전트 운영 피로를 낮추는 사이, Berth·Akan.js v3·brgr 같은 도구로 워크트리가 맥과 코드 편집기로 내려왔다. 같은 날 오픈AI는 수학 성과 722편을 공개하고 챗GPT 오토리뷰를 전면 무료화했으며, 앤트로픽은 클로드 포 구글 워크스페이스 공개 베타로 문서·시트·슬라이드 안 호출 폭을 넓혔다. 구글은 EmbeddingGemma 2와 나노 바나나 2.1, 프롬프트 기반 게임 실험 Playground를 연이어 내놓고, 미스트랄은 1조 파라미터 Mistral Large 4 API 프리뷰와 10월 27일 가중치 공개를 예고했다. 한편 Reflection이 501B MoE 오픈웨이트 Beam으로 서구 오픈 모델 시장에 진입하며 대형 모델 경쟁이 다시 커졌다.
아래에서 묶음별로 자세히 볼 수 있습니다.
오픈AI가 내부 프런티어 모델로 만든 수학 성과 722편을 IAS 자문그룹 조언을 반영해 GitHub에 공개했고, 챗GPT 오토리뷰를 전면 무료화하며 청소년용 챗GPT에 College Planner·사진 PDF·플래시카드·퀴즈를 더했다. 앤트로픽은 클로드 포 구글 워크스페이스를 공개 베타로 내놓아 구글 문서·시트·슬라이드 안에서 사이드바로 클로드 호출을 넓혔고, CEO 다리오 아모데이의 2025년 보수가 1800만 달러로 드러났다. 구글은 단일 임베딩 공간의 온디바이스 멀티모달 EmbeddingGemma 2, 이미지 품질과 비용 효율을 높인 나노 바나나 2.1, 프롬프트로 게임을 만드는 실험형 Playground를 연이어 공개했고, 미스트랄은 1조 파라미터 Mistral Large 4 API 프리뷰를 10월 27일 가중치 공개 예고와 함께 내놓았다. Reflection은 501B MoE 오픈웨이트 모델 Beam으로 서구 오픈 모델 시장에 진입했다.
오픈AI가 연구 공개와 에이전트 안전 기능을 동시에 넓히고, 앤트로픽은 워크스페이스 통합과 스타트업 지원 확대로 생태계를 확장했으며, 구글·미스트랄·Reflection은 모델 진열과 온디바이스·오픈웨이트 진입으로 공급자 경쟁을 밀도 높게 이어갔다.
오픈AI와 앤트로픽이 에이전트와 워크스페이스로 제품 범위를 넓히고, 구글·미스트랄·Reflection이 모델·온디바이스·오픈웨이트로 대응하는 공급자 경쟁이 하루가 아니라 연쇄로 쌓인 흐름을 봐야 한다.
AWS와 Strands Labs가 옵션에서 답을 고르고 점수를 매기는 2B급 결정 모델 Strands Decider 2B를 오픈소스로 내놓아 저지연 로컬 실행으로 에이전트 비용을 낮췄다. Berth는 맥에서 워크트리와 에이전트를 한 화면에서 관리하고 노트북을 닫아도 작업을 이어가게 했고, Akan.js v3는 MCP 기본화와 OAuth 2.1 내장 인가 서버로 에이전트가 사용자 권한 안에서 동작하게 했다. brgr 플러그인은 Claude Code·Codex 등 다중 코딩 에이전트를 함께 돌릴 때 신뢰 확인·업데이트 멈춤·결과 복사 불편을 줄이고, TunnelForge는 SSH 터널·DB 덤프·복원·엔진 간 이전을 하나의 데스크톱 앱으로 묶었으며, Penguin Mail은 Linux용 Rust 이메일 클라이언트로 로컬 AI 비서 지원까지 포함했다.
결정 모델의 로컬 실행, 워크트리 관리, MCP·OAuth 기반 인가, 다중 에이전트 플러그인, DB 작업 통합 앱이 각각 다른 틈을 메우면서 에이전트 운영의 마찰과 피로를 줄이는 방향으로 도구층이 촘촘해졌다.
에이전트를 쓰는 것 자체보다 결정·권한·워크트리·다중 에이전트·DB 작업을 어떻게 묶어 운영 피로를 줄이는지가 오늘의 개발도구 중심 질문이다.
AI가 설계한 오픈TPU 추론 가속기가 FPGA 카드에서 10종 모델 실행을 마치고 비트 단위 일치와 4비트 가중치 성능을 확인하며, AI가 하드웨어 설계를 어디까지 수행해 자기 추론 칩을 만들 수 있는지 탐구하는 오픈소스 가속기로 공개됐다. EvolvingPrograms가 Lean으로 11개 정사각형 최적 포장 증명을 검증해 7,920개 로컬 모듈 수용과 0건 admission으로 완전한 최적성을 확인했고, GPT·Claude·Gemini·DeepSeek·GLM·Solar 여섯 모델이 2,400명 AI 시민의 행동을 나눠 맡는 AI 송도 월드 3D 도시 실험이 브라우저 기반으로 진행됐다. Travis42는 1866년 전보 요금 구조에서 착안한 ‘케이블스’ 지시를 LLM에 적용해 원문 대비 40~49% 토큰 절감과 하류 모델 독해력 유지(회복비 0.99~1.10)를 검증했고, 아카마이 DA Sheila는 vLLM과 NVIDIA Blackwell GPU에서 추측 디코딩을 직접 실행해 작업 유형과 GPU 여유 공간에 따른 적용 판단 방법을 소개했다.
오픈TPU의 자기 추론 칩 실험, Lean 기반 최적 포장 증명 검증, 여섯 모델이 2,400명 에이전트를 맡은 도시 실험, 전고체식 토큰 절감 검증, Blackwell 기반 추측 디코딩 시험이 각기 다른 층위에서 AI의 연산·증명·행동·효율 한계를 시험하는 흐름으로 이어졌다.
openTPU의 자기 추론 칩, Lean 증명 검증, 여섯 모델의 2,400명 에이전트 도시 실험, 토큰 40~49% 절감 검증, vLLM·Blackwell 추측 디코딩 시험이 AI를 연산·증명·행동·효율 면에서 시험하는 한 줄기다.
오픈AI와 앤트로픽이 호주 의회 청문회에서 AI 에이전트 데이터 침해 사고 의무 신고 규제를 지지했고, 오픈AI는 메디케어 포털 무단 접근 통보를 약 3개월 지연한 데 대해 사과했다. EmDash는 플러그인 레지스트리 게시글을 Cloudflare Clef로 자동 검수해 피싱·사기·사칭을 걸러내고, 예고 없는 보이스피싱 모의훈련 전화·문자 서비스를 개인용 무료 공익 앱으로 출시했다. 연구 측면에서는 OLMoE·DeepSeek-V2-Lite 등 MoE 개방 모델 3종이 코드 악성 여부를 묻자 도덕 판단 경로를 더 무겁게 사용해 답했고, 스튜어트 러셀 UC 버클리 교수는 현행 LLM 정렬 연구와 RLHF의 한계를 지적하며 인간 목표와의 완전한 일치가 구조적으로 불가능할 수 있다고 경고했다.
플랫폼과 정부가 사고 신고 의무를 논의·지지하는 한편, 플러그인 검수와 보이스피싱 예측 훈련 같은 예방 장치가 시민·소비자 쪽으로 내려왔고, 모델 자체의 도덕 판단 경로와 정렬 한계에 대한 학계 경고가 같은 안전 축을 다른 각도에서 건드렸다.
에이전트 사고 신고 의무, 플러그인 검수, 예측 훈련 앱, 모델의 도덕 판단, 정렬의 구조적 한계까지 안전·보안·정렬이 제품·정책·모델 내재화 세 갈래로 동시에 움직인 점이 핵심이다.
사전 인쇄 연구에서 Claude·ChatGPT 등 AI 챗봇이 부유층 프로필에 더 비싼 옵션을 제시하는 경향이 확인돼 소비자용 AI 비서의 공정성과 규제 필요성이 부각됐다. 안드로이드 어소리티가 제미나이 앱 업데이트에서 개인 통화 대행 화면을 발견하면서 기업 대상 콜 포 미에서 개인 간 통화로 확대될 가능성이 포착됐고, 채널 운영자 Chris는 Claude Opus 5.5에 100개의 창의적 UI 애플리케이션을 HTML로 만들게 해 많은 디자이너보다 낫다고 평가했다. Google은 텍스트 프롬프트로 게임을 만들고 플레이·공유할 수 있는 브라우저 기반 실험형 플랫폼 Playground를 공개했고, 예고 없는 보이스피싱 모의훈련 전화·문자 서비스가 개인용 무료 공익 앱으로 출시됐다.
소비자 AI의 가격 차별과 개인 통화 대행 정황이 신뢰성과 범위 확장 문제를 동시에 띄웠고, UI 실험과 게임 제작 플랫폼, 보이스 모의훈련 앱이 같은 소비자 층에서 체험·예방 용도로 나란히 나왔다.
부유층 가격 차별, 제미나이 개인 통화 대행 정황, Opus 5.5의 100종 UI 실험, Playground, 보이스 모의훈련 앱이 소비자 AI의 공정성·범위·체험·예방을 한 묶음으로 보여준다.
개인 AI 에이전트가 항공권 예약·구매 등을 하려 할 때 아마존·일부 항공사·리테일 사이트가 봇 차단으로 에이전트를 막아 사용자 혼란이 커졌고, 메타 등 기업이 에이전트-기업 간 표준을 모색하는 흐름이 보도됐다. 플랫폼이 노출 제한·검열을 예상해 ‘unalive’ 같은 완곡어법과 철자 변형이 확산되며 콘텐츠 필터링을 방해하는 현상도 함께 다뤄졌다. 2026년 개발자 설문에서는 5,463명 중 거의 절반이 고용 불안과 불충분한 임금을 경험하고 62%가 번아웃을 겪은 가운데, AI 사용 태도가 긍정 49%·부정 42%로 엇갈렸고 여성·LGB 등에서 인식 차이가 나타났다.
에이전트가 실제 사이트에서 막히는 충돌이 드러나자 업계 표준 모색이 붙었고, 알고리즘 회피용 완곡어법은 같은 플랫폼 긴장 속에서 언어가 바뀌는 쪽으로 번졌으며, 개발자 여론은 고용 불안·번아웃과 AI 양극화로 그 긴장을 노동 측면에서 다시 확인시켰다.
개인 에이전트가 웹사이트에서 실제로 막히는 장면, 알고리즘 회피용 완곡어법의 확산, 개발자 설문의 고용 불안·번아웃·AI 양극화가 플랫폼·노동·언어를 가로지르는 같은 마찰의 세 얼굴이다.
딥시크가 상하이 스타마켓 IPO를 준비하며 기존 74억 달러였던 투자 라운드 조달 목표를 최소 120억 달러에서 최대 150억 달러로 상향하는 방안을 논의 중이다. 클라우드 업체 Lambda는 IPO를 앞두고 Coatue Management와 Blackstone 주도로 최대 40억 달러를 조달하고 선 평가액 145억 달러를 추진하며, 백로그 급증의 상당 부분이 AI 수요로 설명된다. 구글은 AI 데이터센터 전력 확보를 위해 컨스텔레이션 에너지와 3.59GW 원전 전력 공급 계약을 맺고 원전 용량 확대와 AI 전력망 운영을 함께 추진한다. 리사 수 AMD 회장이 7개월 만에 방한해 연내 아시아 최초 AMD AI 우수 연구센터 설립을 점검하고 정부 3대 AI 메가프로젝트 참여·수백 명 규모 국내 인력 확보 등 협력 확대를 논의했다.
딥시크의 IPO 목표 상향과 Lambda의 대규모 조달이 자본·상장 축을 키우고, 구글의 대규모 원전 전력 계약과 AMD의 국내 연구센터 설립 움직임이 인프라와 지역 협력 축으로 같은 시기의 시장 확대를 서로 다른 면에서 떠받쳤다.
딥시크 IPO 목표 상향, Lambda의 40억 달러 조달, 구글의 3.59GW 원전 계약, AMD의 연내 국내 AI 연구센터 설립이 자본·전력·반도체·지역 협력의 한 줄기로 함께 움직였다.
HUMXN은 집주인이 무료로 배관·HVAC 등 주택 서비스를 받고 기술자가 웨어러블로 기록한 실제 작업 데이터를 AI·로봇 훈련용으로 전환해 3자가 이익을 얻는 프로그램을 미국 3개 도시에서 시작했다. 트웰브랩스는 에고센트릭 영상과 라벨링 자동화에 특화된 VLM 페가수스 1.6을 출시해 엔터·스포츠·공공 분야 영상 이해를 로봇 등 피지컬 AI로 확장했고, 스탠퍼드대 연구진은 노화 시 늘어나는 단백질 15‑PGDH를 차단해 늙은 생쥐의 연골 재생과 골관절염 예방 효과를 확인했다.
주택 서비스 현장에서 실제 작업 데이터를 쌓는 HUMXN의 실험, 1인칭 영상 라벨링을 자동화하는 트웰브랩스의 VLM, 노화 단백질 차단으로 연골 재생을 확인한 스탠퍼드대 연구가 실세계 데이터와 생체 실험이라는 다른 층위에서 피지컬 AI·바이오를 함께 밀었다.
로봇 훈련용 실작업 데이터 확보, 1인칭 영상 라벨링 VLM, 노화 단백질 차단을 통한 연골 재생 확인이 피지컬 AI와 생명과학의 실세계 실험이라는 같은 방향으로 연결된 점이 중요하다.
오픈소스 유지관리자들이 AI 기여 생성 비용은 낮아졌지만 검토 비용은 그대로여서 저품질·AI 생성 기여를 감당하지 못해 외부 PR 차단이나 버그 바운티 종료 사례가 늘었다. 캐나다 VPN Psiphon은 연방정부의 적법 접근 법안 Bill C-22가 현행안대로 통과되면 캐나다 밖으로 운영을 이전할 계획이고, 법안이 감시 기능 강제화로 이용자 개인정보 보호 핵심 기구를 무력화할 우려가 제기된다. 미국에서는 샌더스·오카시오코르테스 등 민주당·공화당·무소속 의원들이 연방 기관의 Flock 자동번호판인식 접근 제한 법안을 발의했고, 404 미디어 보도를 입법 근거로 주·지방 정부 자금 차단과 소송 허용을 담았다.
오픈소스 쪽은 AI 기여 폭증이라는 낮은 진입 비용의 부작용이 외부 PR 차단으로 나타났고, 캐나다와 미국 연방 쪽은 감시·개인정보·ALPR을 둘러싼 입법과 대응 이전으로 같은 갈등이 제도와 국경 차원에서 재현됐다.
오픈소스 유지보수의 AI 기여 폭증, VPN의 운영 이전 시사, 연방 Flock ALPR 제한 법안이 모두 AI·감시·플랫폼 시대의 외부 압력과 규제 대응이라는 한 줄기로 묶인다.