12 / 1056개의 콘텐츠

刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable - 华尔街见闻
News2026.09.18

刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable - 华尔街见闻

1. 🚀 구글은 최근 AI Arena에 'gemini-3.8-flash'라는 명칭으로 차세대 플래그십 모델인 Gemini 4 Pro를 비공개 테스트한 것으로 보입니다. 2. 📊 벤치마크 결과 Gemini 4 Pro는 코딩, 추론, 에이전트 능력 등 다양한 영역에서 OpenAI의 Astra와 Anthropic의 Fable 5.1을 압도하는 성능을 입증했습니다. 3. ⚙️ 이번 조기 성과는 모델 스스로 성능을 향상하는 RSI(Recursive Self-Improvement) 기술을 도입하여 훈련 효율을 극대화한 결과로 평가됩니다.

#AI Agent#Gemini 4 Pro#LLM
JunhaRyu
Hacking OpenAI
Blog2026.09.18

Hacking OpenAI

1. 🛡️ HacktronAI 연구팀은 Discourse 커뮤니티 포럼의 libheif 취약점을 악용해 원격 코드 실행(RCE) 권한을 확보하고, 이를 OpenAI SSO 설정과 연계하여 내부 시스템에 침투했습니다. 2. 🤖 AI 모델인 Claude Opus 5를 활용해 복잡한 메모리 손상 취약점을 신속하게 공격 코드로 전환함으로써, 기존에 수개월이 걸리던 공격 수행 시간을 며칠 내로 크게 단축했습니다. 3. ⚠️ 이번 사례는 보안 경계가 낮은 소프트웨어 환경이라도 고도화된 AI를 통해 강력한 위협으로 변모할 수 있음을 보여주며

#Discourse#Exploit#OpenAI
Homin.Lee
GitHub - browser-use/jev-ultrafast: i. am. speed.
Service2026.09.18

GitHub - browser-use/jev-ultrafast: i. am. speed.

1. ⚡ Jev Ultrafast는 동적으로 색인된 action space와 효율적인 LLM 연동을 통해 브라우저 제어의 지연 시간을 획기적으로 단축한 최신 브라우저 에이전트입니다. 2. 🌐 이 에이전트는 스크린샷 대신 구조화된 DOM 상태를 사용하여 클릭, 입력, 선택 등 명확한 operation을 실행하며, 불필요한 네트워크 호출을 최소화하여 높은 처리 효율을 달성합니다. 3. 🚀 실제 Google Flights와 Wikipedia 테스트에서 이전 버전 대비 평균 작업 시간을 약 25% 단축하며, 복잡한 사이트 내의 사용자

#Agent#AI#Browser Automation
Mineru
Qwen Studio
Blog2026.09.18

Qwen Studio

1. 🚀 Qwen3.8-Omni-Flash는 실시간 음성 및 영상 처리에 최적화된 차세대 네이티브 omnimodal 모델로, 1M-token context window를 지원하며 전작 대비 뛰어난 추론 성능과 비용 효율성을 제공합니다. 2. 🛠️ 이 모델은 Qwen-MM-Plugins와 Qwen-Live Harness를 통해 영상 편집, 회의 분석, 심층 연구와 같은 복잡한 long-horizon 워크플로우를 자율적으로 수행하는 agentic 기능을 강화했습니다. 3. 💡 특히 Agentic Understanding 방식을 도

#Agent#AI Model#Omnimodal AI
igor
How Claude is uplifting biomolecular modeling
Blog2026.09.18

How Claude is uplifting biomolecular modeling

1. 🚀 Claude는 FlashPairformer 커스텀 커널을 개발하여 biomolecular structure prediction 및 protein design 모델의 추론 속도를 평균 4배 가속화했습니다. 2. 🧠 Claude가 설계한 저메모리 'Big' mode를 통해 단일 NVIDIA GPU 노드에서 10,000 tokens 이상의 대규모 biomolecular system을 정확하게 예측할 수 있게 되었습니다. 3. 🧪 이러한 최적화 기술은 de novo protein binder 설계 시 이전보다 100배 적은

#AI#Biomolecular Modeling#Claude
Homin.Lee
GitHub - google/artemis: ARTEMIS turns natural-language instructions into reliable Android automation. It automates end-to-end workflows, captures logs, and integrates seamlessly with AI coding assistants such as Antigravity, Codex, and Claude Code.  It also achieves 99%+ success rate on AndroidWorld Benchmark.
Service2026.09.18

GitHub - google/artemis: ARTEMIS turns natural-language instructions into reliable Android automation. It automates end-to-end workflows, captures logs, and integrates seamlessly with AI coding assistants such as Antigravity, Codex, and Claude Code. It also achieves 99%+ success rate on AndroidWorld Benchmark.

1. 📱 ARTEMIS는 자연어 명령을 통해 안드로이드 기기에서 복잡한 테스트 작업을 자동으로 수행하는 다중 모달 기반의 크로스 앱 자동화 프레임워크입니다. 2. 🚀 이 시스템은 Flash와 Pro 실행 프로필을 지원하며, Model Context Protocol(MCP)을 통해 Antigravity나 Claude Code와 같은 AI IDE와 직접 연동되어 실시간으로 테스트를 제어합니다. 3. 📈 Google Research의 AndroidWorld 벤치마크에서 99% 이상의 성공률을 기록한 ARTEMIS는 화면 분석과 실시

#AI Coding Assistant#Android Automation#Cross-App Automation
Homin.Lee
Introducing System One Models & Jev - TypeSafe AI Blog
Blog2026.09.16

Introducing System One Models & Jev - TypeSafe AI Blog

1. 🚀 TypeSafe AI는 자동화 시스템을 위해 실시간 의사결정에 최적화된 새로운 클래스의 AI 모델인 Jev와 이를 위한 RLCD(Reinforcement Learning for Calibrated Decisions) 훈련 방식을 도입했습니다. 2. ⚡ Jev는 기존 LLM과 달리 텍스트 생성이 아닌 타입이 지정된 확률적 의사결정 값을 출력하여 환각을 방지하고, 병렬 샘플링을 통해 기존 모델 대비 약 200배 빠른 처리 속도와 높은 경제성을 제공합니다. 3. 🛠️ 이 모델은 정해진 구조 내에서 신뢰성 있는 결과를 도출함으

#AI#Automation#Jev
JunhaRyu
\
Video2026.09.16

\

1. 🏢 직장인 대다수가 AI 활용 능력을 저평가받거나 업무 역량을 의심받을까 우려해 AI 사용 사실을 숨기고 있습니다. 2. 📈 기업은 AI 도입으로 높아진 생산성을 새로운 평가 기준으로 삼고 있으나, 이로 인해 직원들은 과도한 업무 압박과 혼란을 겪고 있습니다. 3. ⚠️ AI 활용 여부를 평가 지표에 반영하려는 기업들의 시도는 오히려 AI 사용 은폐나 불필요한 업무 양산 같은 부작용을 초래하는 과도기적 상황에 놓여 있습니다.

#AI#문화 지체#생산성
Leon
\
Video2026.09.16

\

1. ☁️ Amazon은 전 세계적으로 확장된 클라우드 컴퓨팅 서비스를 제공하여 다양한 기업의 IT 인프라를 지원합니다. 2. 🌍 이 서비스는 Global 지역을 중심으로 데이터를 효율적으로 관리하고 최적화된 컴퓨팅 자원을 배포하는 기능을 수행합니다. 3. 💼 Foreign 시장에서도 안정적인 인프라 환경을 구축하여 전 세계 고객들에게 고성능 클라우드 솔루션을 제공하는 데 중점을 둡니다.

#Amazon#AWS#cloud
Leon
스킬샵 | 에이전트 마켓플레이스
Service2026.09.16

스킬샵 | 에이전트 마켓플레이스

1. 🚀 스킬샵은 사용자가 업무 효율을 높일 수 있는 다양한 AI 자동화 스킬을 구매하고 공유할 수 있는 전문 플랫폼입니다. 2. 💡 이용자들은 유튜브 영상 제작, 데이터 크롤링, AI 모델 생성 등 실무에 최적화된 스킬을 활용하여 복잡한 과정을 자동화하고 높은 작업 품질을 경험하고 있습니다. 3. 🛠️ 플랫폼은 스킬 검색부터 설치 안내, 판매 시스템까지 체계적으로 제공하여 AI 초보자도 쉽게 전문가 수준의 자동화 환경을 구축하도록 돕습니다.

#Agent#AI#Automation
Mineru
머스크 "그록 4.8 사전 학습 이번 주 완료...2.5조 매개변수·C++ 적용" - AI타임스
News2026.09.15

머스크 "그록 4.8 사전 학습 이번 주 완료...2.5조 매개변수·C++ 적용" - AI타임스

1. 🚀 Elon Musk는 이번 주 내로 새로운 AI 모델인 Grok 4.8의 사전 학습이 완료될 예정이라고 발표했습니다. 2. 🧠 해당 모델은 2.5조 개의 매개변수(parameter)를 기반으로 구축되어 이전보다 훨씬 강력한 성능을 발휘할 것으로 기대됩니다. 3. 💻 또한, 시스템 효율성을 극대화하기 위해 개발 과정에서 C++ 프로그래밍 언어가 적용되었습니다.

#AI#Elon Musk#Grok
Homin.Lee
Which tools do Claude Code, Codex and Cursor choose? We measured 16,893 sessions to find out.
Blog2026.09.15

Which tools do Claude Code, Codex and Cursor choose? We measured 16,893 sessions to find out.

1. 📊 연구진은 다양한 프로그래밍 언어와 환경으로 구성된 75개의 실제와 유사한 리포지토리를 구축하고, 4가지 페르소나를 가진 Coding Agent를 활용하여 16,893회의 실험을 수행했습니다. 2. 🤖 실험 결과, Cursor, Codex, Claude Code와 같은 주요 Coding Agent들은 웹 검색 방식과 사전 지식 의존도에 따라 도구 선택 기준이 크게 달랐으며, 동일한 요구사항에서도 언어나 리포지토리 맥락에 따라 최종 선정되는 서비스가 상이하게 나타났습니다. 3. 💡 분석 결과 Stripe나 Neon처럼 특

#AI Coding Agents#Benchmarking#Code Generation
devcoo
스크롤하여 더 보기