「图像理解与生成」共找到 2990 篇相关文章
GPT-5 = Scaling Law失效?毕树超:永远有效,因为它反应的是数据结构,客观规律
Shuchao Bi在哥大演讲阐述AI发展。回顾自监督与强化学习路径,指当前发展遇高质量数据瓶颈,认为Scaling Law不会失效。还探讨通往AGI面临的问题,畅想AI重塑世界,提出两个理解AI发展的心智模型。
小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一
6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。
DeepSeek R1 的小更新,却大有深意?
5月28日,DeepSeek低调宣布R1模型小版本试升级,API接口和使用方式不变,但未公布具体更新内容。从用户反馈看,语义理解、逻辑推理等能力提升,实测表现出色。此次升级或有安全、产品路线等考量。
微软 CTO 在 Rust Nation UK 大会上详解成功经验、挑战及对 Rust 编程语言的承诺
微软Azure首席技术官Mark Russinovich在Rust Nation UK大会探讨推动Rust采用的因素,展示微软产品中Rust应用成果,介绍用生成式AI加速C/C++向Rust迁移的努力,还提及开发者反馈及微软对Rust的承诺。
智能体时代EDA工具革新,比昂芯科技专注AI驱动电路仿真及Chiplets设计
近期,AI+芯片设计生成成全球资本热门赛道。比昂芯科技早在2024年就启动AI在EDA领域的底层技术探索,形成AI原生EDA完整技术闭环。其研发总监吴晨博士在IDAS 2026分享实践,公司还有四大核心产品及服务。
Facet-0:NTU王子为团队让机器人在精密装配中「看得懂、插得准、出错能恢复」
新加坡南洋理工大学PINE Lab团队研发Facet - 0机器人基础模型,用于精密装配。它在五项计算机装配任务中平均成功率达82%,能让机器人理解接触状态、判断对错并改进。通过多阶段训练,降低人工干预率,提高失败恢复率。
国际PC巨头入局,Violoop押注个人主权AI|甲子光年
Violoop获亿元级融资,产品计划9月16日众筹。它想让AI设备随使用更懂用户,提出“个人主权AI”,即个人掌握经验与改进能力。研发聚焦让AI理解人,设置主权边界,有三层自进化路径,还探索多终端应用。
实测 MiniMax H3:开源“斩杀线”蔓延到视频模型圈
本文实测 MiniMax H3 视频模型,它 8 月 3 日开源,成本低至 0.5 元/秒,在编辑榜成绩佳。它定位全模态生成,能多素材输入。实测效果好,价格约为 Seedance 2.5 的三分之一,还支持原生剪辑,适配多芯片与工具。
北大2篇Skill炸场,Agent彻底进化
北京大学连发两篇论文,给出让 Agent 变强的答案:让 Skill 自己进化。`SESA` 针对工具增强的搜索问答,用四个阶段闭环使任务生成和技能记忆一起进化;`VeriSkill` 把验证器废信号变成可信更新,二者场景不同但核心一致。
伏曦量子完成天使及天使+轮融资,五源资本、启盈同创等跟投
近日,伏曦量子宣布完成天使及天使+轮融资,由全球动力电池行业龙头领投,多家机构跟投。该公司由赵琦博士创立,定位是帮助产业客户理解和使用量子算力,其核心价值是优化算法,让问题可在近期硬件测试。