「多视角」共找到 4258 篇相关文章
刚刚,清华团队养出了一只「龙虾老师」!教育版OpenClaw震撼开源
清华教育学院与计算机系联合团队开源多智能体AI课堂OpenMAIC。它能一键生成交互式课程,AI老师语音授课、AI同学互动。经两年真实课堂验证,支持主流大模型,有望成教育版ClawHub。
GPU-MODE Leaderboards之vector_add histogram 以及一些有趣发现
文章介绍GPU-MODE Leaderboards中vector_add和histogram任务。分析vector_add实现、带宽利用率,rank1代码用cccl,带宽利用率超80%;histogram算子瓶颈在atomic冲突等,rank1也多用cccl,还给出rank2代码,最后提及任务中Hack行为及代码提交方式。
Google 发布首个全模态 Embedding 2 模型,文本图片音视频 PDF 统一到一个向量空间
Google发布Gemini Embedding 2模型,它是业界首个原生支持文本、图片、视频、音频和PDF五种模态的Embedding模型,可将这些数据映射到同一向量空间,在多模态RAG、跨模态搜索等场景有应用,还介绍了跑分、用法、竞品、价格等情况。
中东芯片王国与孤勇者:以色列和伊朗境内半导体企业一览
在地缘政治冲突下,中东地区晶圆代工厂供货受影响,中国台湾部分企业订单回升。文章梳理了以色列和伊朗半导体企业格局、能力与生态,以色列产业发达,多被巨头收购;伊朗产业落后,聚焦成熟制程。
我用 AI 翻译的三个阶段:提示词时代 → 推理模型时代 → Agent 时代
作者分享近 2 年 AI 翻译经验,将其分为提示词、推理模型、Agent 三个时代,介绍 Agent 翻译与提示词翻译区别,还阐述 Skill 创建迭代、三种翻译模式由来等,给出解决一致性问题等方法。
GPT-5.4发布,最适合OpenClaw的天选模型登场了。
GPT-5.4发布,作者认为它是OpenClaw天选模型。此前Claude贵且受限,GPT-5.3-Codex世界知识差。GPT-5.4代码能力强、世界知识优,还具多特性,如大上下文窗口,目前ChatGPT已上线。
告别「边画边说」:LatentMorph 开启视觉生成隐式潜空间推理新范式
现有的文生图模型缺乏动态思考与自我修正能力,香港科技大学团队提出LatentMorph框架,将隐式潜空间推理集成到T2I生成过程中,实验显示其显著提升基座模型性能,削减推理延时与Token消耗,实现人机认知对齐。
阿里千问负责人林俊旸突然离职,AI圈刷屏:Qwen 开源时代要变了吗?
3月4日凌晨,千问核心负责人林俊旸在X发文卸任。他是阿里最年轻P10级技术专家,主导研发多个关键项目。其离职引发关注,网友猜测Qwen或转向闭源,业内人士对他评价颇高。
AI for Health:从「实验室Demo」到「国民级健康伙伴」的范式跃迁 | GAIR Live 024期预告
医疗大模型正从“聊天工具”进化为“生命基础设施”,但面临诸多挑战。GAIR Live 024期圆桌将汇聚学术与产业顶尖智慧,探讨构建可信、高效、人机协同的医疗新范式,剖析核心议题,分享讨论精华。
博士学位答辩PPT分享 | Scalable Operation-aware Aerodynamic Design
杨奥博博士毕业于香港科大,长期研究多学科优化方法在飞行器等设计中的应用。其博士论文提出可扩展的、基于任务感知的气动设计框架,贯通关键环节,形成一体化方法体系,有多项创新成果。