AI👥일반💼투자자2시간 전Advancing next-gen AI with materials science innovationSyensqo가 AI 반도체·데이터센터 성능의 병목이 첨단 소재라고 주장, 폴리머·엘라스토머·특수 유체가 핵심이라 강조SyensqoMicrosoft Discovery#AI반도체#소재과학#데이터센터🔬연구MIT Technology Review AI원문
AI🧑💻개발자9시간 전PlanFlip: Attacking Multi-Agent LLM Systems via Planning-Phase Prompt Injection멀티에이전트 플래너 단계를 노리는 4종 프롬프트 주입 공격 프레임워크 PlanFlip 공개GPT-5GPT-4o#프롬프트인젝션#멀티에이전트#AI보안📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전Democratizing AI with Small Language Models: Structured Benchmarking and Parameter-Efficient Fine-Tuning for Local Deployment135M~3B 오픈웨이트 모델 9종을 1,085문항·16주제 로컬 배치 벤치마크로 통제 평가QwenSmolLM2#소형언어모델#파라미터효율파인튜닝#로컬배포📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전Generative Ontology Induction: Domain-Agnostic Schema Discovery from Document Corpora Using Large Language Models문서 코퍼스에서 온톨로지 블루프린트를 자동 유도하는 도메인 무관 프레임워크 GOI 제안#온톨로지#지식그래프#LLM📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전JUMP: Single-Pass Membership Inference on Fine-Tuned Diffusion Language Models확산 언어모델(dLLM) 파인튜닝 데이터 대상 단일 패스 멤버십 추론 공격 JUMP 제안LLaDA-8B#멤버십추론공격#프라이버시#확산언어모델📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전A Survey on the Verification of Reinforcement Learning Policies안전 중요 도메인 RL 정책 검증 연구를 통합 정리한 서베이 논문 발표#강화학습#정책검증#AI안전📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전ColGraphRAG: Late-Interaction Evidence Retrieval for Multimodal GraphRAG멀티모달 GraphRAG의 이미지 후보 랭킹을 ColBERT/ColPali 계열 late-interaction 다중 벡터 점수로 교체ColBERTColPali#그래프RAG#멀티모달#증거검색📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전A Survey on GNN-based Link Prediction: Techniques, Applications, and ChallengesGNN 기반 링크 예측 연구를 아키텍처 관점에서 체계화한 서베이 발표#그래프신경망#링크예측#서베이📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전Masked Diffusion Language Models are Strong and Steerable Text-Based World Models for Agentic RL마스크드 확산 언어모델(MDLM)이 에이전트 RL용 텍스트 월드모델로 AR 모델보다 우수함을 입증Qwen3Mistral#확산언어모델#월드모델#에이전트RL📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전SelKV: Selective KV Cache Merging with Per-Token Merge-or-Drop and Attention CompensationKV 캐시 25%만 유지하고도 손실 최소화하는 학습 불필요(training-free) 압축 기법 SelKV 제안#LLM#KV캐시압축#추론최적화📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전Rater State Bias in RLHF Preference Data: An Audit FrameworkRLHF 선호 라벨이 응답 품질뿐 아니라 평가자의 심리 상태까지 반영한다는 구조적 교란 변수 제기#RLHF#데이터편향#선호데이터📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전RAIL Guard: Closing the Evaluation-to-Remediation Gap in Responsible AI for LLM Agents차단 후 재시도 대신 평가-수정-재평가 루프로 LLM 출력을 교정하는 RAIL Guard 공개RAIL Guard#LLM에이전트#AI안전#가드레일📰미디어arXiv cs.AI원문
AI🧑💻개발자💼투자자9시간 전Some Large Language Models Exhibit Consistent Risk AttitudesLLM 6종·인간 100명을 공간 탐색·임상 트리아지·금융 배분 과제로 위험 태도 측정#LLM#위험성향#의사결정📰미디어arXiv cs.AI원문
AI🧑💻개발자👥일반9시간 전Design and Validation of a Lightweight 1D CNN for Affective Touch Classification in Soft Plush Companions소프트 인형 컴퍼니언의 정서적 터치 인식용 경량 1D CNN 설계·검증 연구 발표#딥러닝#CNN#촉각인식📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전Deterministic Replay for AI Agent SystemsMITM 프록시로 외부 상호작용을 가로채 AI 에이전트 실행을 결정론적으로 재생하는 CLI 도구 agrepl 공개agrepl#AI에이전트#결정론적재생#재현성📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전Accurate and Efficient Long-Term Memory for LLM Agents엔티티 타입 그래프 저장·충돌 감지 기반 LLM 에이전트 장기기억 프레임워크 MOSAIC 공개MOSAIC#LLM에이전트#장기기억#메모리시스템📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전It Takes 8 Tokens: Weak-to-Strong Off-Policy RL via Auxiliary Branches약한 보조 모델의 짧은 세그먼트(최소 8토큰)를 주입해 탐험을 넓히는 오프폴리시 RL 기법 W2SPO 제안#강화학습#LLM추론#RLVR📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전PPO-HSC: An Exploratory Reinforcement Learning Framework Based on Wide-Area Policy Coverage OptimizationLLM 파인튜닝의 모드 붕괴 문제를 꺨냥한 탐험형 RL 프레임워크 PPO-HSC 제안#강화학습#PPO#LLM파인튜닝📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전Symbolic Augmentation Closes a Canonical-Equivalence Blind Spot in Neural Fact-Checkers과학 텍스트의 수치·단위 환각 검증용 5분류 오류 체계와 1500개 벤치마크 구축ModernBERT#LLM환각#팩트체킹#벤치마크📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전Generalist AI Control: Towards Multi-purpose Adaptive Algorithms단일 신경망으로 서로 다른 차수·동역학 시스템을 제어하는 'Generalist Controller' 제안#범용AI제어#신경망컨트롤러#어텐션메커니즘📰미디어arXiv cs.AI원문
AI🧑💻개발자9시간 전Shapley Context Pruning: A Cooperative Game Perspective for Context Reranking and Pruning컨텍스트를 협력 게임으로 모델링해 중요도를 귀속하는 Shapley Context Pruning(SCP) 제안#RAG#컨텍스트프루닝#섀플리값📰미디어arXiv cs.AI원문
AI🧑💻개발자13시간 전Grabette: an open system to record robot-manipulation dataPollen Robotics가 로봇 없이 사람 손으로 조작 데이터를 수집하는 오픈소스 핸드헬드 그리퍼 'Grabette' 공개Pollen RoboticsGrabette#로보틱스#오픈소스#데이터수집🏢공식HuggingFace Blog원문
AI💼투자자👥일반19시간 전China’s AI models have Trump’s AI world at war with itself중국 문샷(Moonshot)의 무료 오픈소스 모델 Kimi가 OpenAI·Anthropic급 성능으로 트럼프 진영 AI 전략가들의 내분을 촉발KimiMoonshot#미국 AI 정책#중국 AI 모델#트럼프 행정부🔬연구MIT Technology Review AI원문
AI🧑💻개발자21시간 전Introducing Cosmos 3 EdgeNVIDIA가 4B 파라미터 오픈 월드모델 Cosmos 3 Edge를 Hugging Face에 공개, 엣지 기기에서 로봇 추론·행동 생성 지원NVIDIACosmos 3 Edge#엔비디아#코스모스 3 엣지#엣지 AI🏢공식HuggingFace Blog원문
AI👥일반🧑💻개발자1일 전AI is more likely than humans to form biases when hiring프린스턴·시카고대 연구, 가상 채용 실험에서 LLM이 인간보다 약 65% 강하게 집단 고정관념 형성OpenAIAnthropic#AI 편향#채용 AI#LLM 연구🔬연구MIT Technology Review AI원문
AI🧑💻개발자1일 전Logic, Optimization, and Artificial Intelligence규칙 기반 AI에서 논리와 최적화의 결합을 정리한 서베이, AI 투명성 요구 속 재조명#규칙기반AI#논리학#최적화📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전MGDT: MLLM-Guided Diffusion Transformer with Relation-Adaptive Mixture-of-Experts for Multimodal Knowledge Graph Completion멀티모달 지식그래프 완성(MKGC)용 '정렬 후 확산(align-then-diffuse)' 프레임워크 MGDT 제안MGDT#지식그래프#디퓨전모델#멀티모달📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전AnovaX: A Local, Multi-Agent Voice Assistant with LLM Planning, Typed Executors, and Adaptive Recovery로컬 우선 데스크톱 음성 비서 AnovaX 공개, 데스크톱 자체를 행동 표면으로 활용AnovaXGemini#음성비서#로컬멀티에이전트#LLM플래닝📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전Do Coding Agents Need Executable World Models, Simplification, and Verification to Solve ARC-AGI-3?ARC-AGI-3 에이전트 성능 요인을 4개 중첩 Codex 기반 에이전트로 분리 검증ARC-AGI-3Codex#코딩에이전트#ARC-AGI#월드모델📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전Causal-Audit: Explicit and Auditable Graph-based Reasoning via Target-Aware Causal Chain Construction문맥 없는 개입형 질의응답을 위한 명시적·감사 가능 인과 추론 프레임워크 제안#인과추론#그래프추론#감사가능성📰미디어arXiv cs.AI원문
AI👥일반1일 전A Critical Analysis of Trustworthy AI Tools, Mark Frameworks, and the Implementation ChasmsOECD 데이터셋 기반으로 신뢰 가능 AI(TAI) 도구·인증마크 프레임워크를 실증 분석OECD#신뢰가능AI#AI윤리#AI거버넌스📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전Knowledge-Centric Agents for Workflow GenerationComfyUI 워크플로 생성을 지식 중심 문제로 재정의, 지식 역전·주입·추론 3단계 프레임워크 제안ComfyUI#LLM#AI에이전트#워크플로우생성📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전Beyond a Joke: Multi-Angle Reasoning for Detecting and Explaining Harmful Humor in Memes유머·혐오가 공존하는 밈 이해용 VLM 프레임워크 MAR-12 제안, 이론 기반 12개 관점으로 해석MAR-12PrideMM#멀티모달#유해콘텐츠탐지#밀맘분석📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전NeurOWL: An LLM-Based Neural-symbolic Framework for Incomplete OWL Ontology Reasoning불완전 OWL 온톨로지에서 비함의 포섭관계의 타당성 검증과 누락 공리 설명을 동시 수행하는 NeurOWL 제안NeurOWL#뉴로심볼릭#온톨로지추론#LLM📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전Behavioral Controllability of Agentic Models for Information Extraction: From Fixed Workflows to Reflective Agents반영(reflection)·메모리 등 에이전트 요소가 고정 LLM 워크플로 대비 실제 개선을 주는지 검증#LLM에이전트#정보추출#리플렉션📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전SeerGuard: A Safety Framework for Mobile GUI Agents via World Model Prediction모바일 GUI 에이전트의 위험을 실행 전에 차단하는 결과 인지형 안전 프레임워크 SeerGuard 제안SeerGuardSAWM#AI안전성#GUI에이전트#월드모델📰미디어arXiv cs.AI원문
AI🧑💻개발자💼투자자1일 전GraphDx: A Cost-Aware Knowledge-Enhanced Multi-Agent Framework for Sequential Diagnosis비용 인지 순차 진단 프레임워크 GraphDx, 진단 성공률을 50~68%에서 79~93%로 향상GraphDxDeepSeek-V3#의료AI#멀티에이전트#순차진단📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전Precise but Uncoupled: Reviewer Precision Does Not Guarantee Critique Uptake in Multi-Agent Math Reasoning4181개 Omni-MATH 문제 실험으로 리뷰어 정밀도와 비평 수용(uptake)이 별개임을 실증Omni-MATHgpt-oss-120b#멀티에이전트#수학추론#리뷰어에이전트📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전DrawingVQA: A Real-World Benchmark for Multi-Depth Visual-Textual Reasoning on Construction Drawings실제 시공 도면 대상 첫 MLLM 벤치마크 DrawingVQA 공개 — IFC 도면 33장, 전문가 검수 QA 92쌍DrawingVQA#멀티모달벤치마크#건설도면#시각추론📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전From Black Box to Executable Logic: Explainable Reinforcement Learning through Prolog Expert Systems학습된 심층 RL 정책을 실행 가능한 Prolog 프로그램으로 바꾸는 3단계 사후 변환 제안#강화학습#설명가능AI#Prolog📰미디어arXiv cs.AI원문
AI🧑💻개발자💼투자자1일 전Cura 1T: Specialized Model for Agentic Healthcare의료 특화 LLM Cura 1T 공개, 인간 승인 게이트를 둔 자기 진화 루프로 학습Cura 1T#의료AI#특화모델#에이전트헬스케어📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전AgentFAIR: A Multi-Agent Collaborative Framework for FAIRness Evaluation of Geospatial Datasets지리공간 데이터 FAIR 평가용 멀티에이전트 AgentFAIR 제안, 13개 세부원칙별 LLM 평가자 구성AgentFAIRFAIR-enough#멀티에이전트#데이터평가#FAIR원칙📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전ToolVerse: Unlocking Massive Environments and Long-Horizon Tasks for Agentic Reinforcement Learning약 400개 실전 MCP·4500여 개 도구로 대규모 실행형 에이전트 RL 환경을 자동 구축하는 ToolVerse 공개ToolVerseGUST#강화학습#AI에이전트#도구통합추론📰미디어arXiv cs.AI원문
AI🧑💻개발자💼투자자1일 전S1-Omni: A Unified Multimodal Reasoning Model for Scientific Understanding, Prediction, and Generation과학 이해·예측·생성 통합 멀티모달 모델 S1-Omni 공개, 대부분 벤치마크에서 GPT-5.5·Gemini-3.1-Pro 상회S1-OmniGPT-5.5#멀티모달#과학AI#통합추론모델📰미디어arXiv cs.AI원문
AI🧑💻개발자1일 전Neuro-Symbolic AI for LEED compliance: Document-Centric Benchmarking, Deterministic Numeric Checking, and When Multimodal Hurts로컬 4B 모델 gemma3:4b가 LEED 문서 검증 정확도 67.3%로 더 큰 llama3.1:8b를 상회gemma3:4bllama3.1:8b#뉴로심볼릭#문서심사자동화#LEED인증📰미디어arXiv cs.AI원문
AI🧑💻개발자3일 전Fine-tune video and image models at scale with NVIDIA NeMo Automodel and 🤗 DiffusersNVIDIA·Hugging Face가 NeMo Automodel-Diffusers 통합 공개, 체크포인트 변환 없이 Hub 모델 분산 학습NVIDIAHugging Face#파인튜닝#NVIDIA#NeMo🏢공식HuggingFace Blog원문
AI👥일반💼투자자4일 전The risk of weather data sabotage is rising파리 CDG 공항 기상관측소 온도 조작으로 예측시장 베터가 2만 달러 수익, 실제 18°C인 날 22°C 기록ECMWFAIFS#기상 데이터#데이터 무결성#AI 예보 모델🔬연구MIT Technology Review AI원문
AI🧑💻개발자4일 전NVIDIA Nemotron 3 Embed Ranks #1 Overall on RTEB, Advancing Agentic RetrievalNVIDIA가 오픈 임베딩 모델 Nemotron 3 Embed 3종 공개, 8B가 RTEB 1위(78.5%)NVIDIANemotron 3 Embed#엔비디아#임베딩모델#검색벤치마크🏢공식HuggingFace Blog원문
AI🧑💻개발자💼투자자5일 전Newer Models, Same Advantage브라질 포르투갈어 특화 DharmaOCR이 자체 벤치마크 0.925로 Mistral OCR4(0.798) 압도DharmaOCRDharma AI#AI모델#커뮤니티블로그🏢공식HuggingFace Blog원문
AI💼투자자👥일반5일 전AI-Native Insurance for Agentic AI: Pricing, Underwriting, and End-to-End Automation에이전틱 AI 배포의 인수·가격책정·계약설계를 위한 AI 네이티브 수리적 보험 프레임워크 제시#AI 보험#에이전트 AI#위험 관리📰미디어arXiv cs.AI원문