「超树建模」共找到 2344 篇相关文章
Hinton预言失灵?掌握AI技能涨薪23%,比读硕士更赚钱
新智元报道,Hinton称AI会让贫富差距拉大,但掌握AI技能涨薪幅度超想象,比读硕士回报高。市场对AI科技岗需求创新高,企业愿为AI技能付高薪,实战能力比认证更重要。
OpenAI 不想再「跪着」买显卡了
《金融时报》消息,OpenAI 正和博通合作自研代号“XPU”的 AI 推理芯片,2026 年量产。其不仅在芯片发力,还在硬件、应用和算力基建多线出击,不过自研芯片也面临资金、人才和软件生态等问题。
Think in Games:做一个在王者荣耀中会玩和思考的Agent
文章介绍论文《Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models》,指出当前AI在游戏领域面临的困境,提出TiG框架结合大语言模型与强化学习,打造既会做又会说的AI,实验验证其高效性。
社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!
阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。
ICCV 2025 | 跨越视觉与语言边界,打开人机交互感知的新篇章:北大团队提出INP-CC模型重塑开放词汇HOI检测
北大团队提出 INP - CC 模型重塑开放词汇 HOI 检测。它提出交互感知提示生成和概念校准两项创新,结合输入图片特性构造提示集合,引入‘困难负样本采样’策略,在两大数据集上表现超 SOTA。
6.6K Star 打破次元壁!MCP-Use开源爆火:6行代码让LLM操控万物!
在AI Agent开发热潮中,MCP-Use作为开源Python库爆火。它用6行代码让LLM操控万物,支持多模型、多服务器,提供安全机制,适配网页浏览、3D建模等多种场景,降低AI Agent开发门槛。
无限长、零掉帧!StableAvatar口型同步全新技术
当前音频驱动头像视频生成扩散模型合成长视频时难兼顾音频同步与身份一致,瓶颈在音频建模。复旦大学提出StableAvatar,首个端到端视频扩散Transformer,能无限时长生成,还介绍原理与演示效果。
40年首次突破!清华大学发布全新最短路径算法,打破理论瓶颈:数据中心有望节省大量计算资源
清华大学Ran Duan、Longhui Yin团队发表论文,提出确定性新算法,在稀疏图上表现超经典Dijkstra算法。新算法时间复杂度为`O(m log²/³ n)`,不维护全局有序顶点队列,应用前景广,可节省计算资源。
甲小姐对话黄伟:一边“找死”,一边活下去 | 甲子光年
云知声创始人黄伟创业13年、筹备上市5年,其经历反映中国AI企业生存真相。他分享云知声上市波折、战略选择、应对竞争策略等,如在‘等死’与‘找死’间抉择,认为市场分散利于创业公司,AI 2.0竞争更激烈。
机器人手画圆圈,怎么就成为了一大难题了?
华人研究者 Tom Zhang 所在的 DaxoRobotics 团队推文称其机械手花两天画出圆圈,这或为机器人手首次画圈。该机械手用柔性手指夹笔画圆,靠肌腱控制,传统求解器难应对,还具超人类灵活性。