「港城大」共找到 5146 篇相关文章
RSS 2025|物理驱动的世界模型PIN-WM:直接从视觉观测估计物理属性,可用于操作策略学习
国防科大、深圳大学、武汉大学团队提出物理驱动的世界模型PIN - WM,能从视觉观测辨识刚体物理属性。还提出PADC提升迁移性能,经实验验证其在非抓握式操作技能Sim2Real迁移中表现出色。
拒绝不必要Think:微软&北大提出第一种自适应大型混合推理模型
大型推理模型冗长思考开销大,微软研究院和北大提出大型混合推理模型(LHRMs),它能依查询上下文决定是否思考。介绍了两阶段训练流程、评估指标,实验显示其超越现有模型且效率高。
谷歌云推出面向毫秒级延迟工作负载的 Rapid Storag
在 Google Cloud Next 2025 大会上,谷歌云推出 Rapid Storage,为频繁访问数据和延迟敏感应用提供毫秒级数据访问,有低延迟、高吞吐量等特点,还与亚马逊 S3 Express 被比较,目前处于预览阶段。
如何重现 DeepSeek 推理性能突破
DeepSeek-V3 是热门开源大模型,采用大规模 MoE 架构,优化推理性能是工程难点。阿里团队在 RTP - LLM 完成优化,对齐其推理系统性能,分享关键技术、不足与思考,还提及对 Qwen3 模型的优化策略。
微软裁撤 Python 之父的嫡系核心团队,CPython 团队没了
近日微软全球裁员,软件工程岗位受打击大。Faster CPython 团队多名核心人员被裁,该团队由 Python 之父牵头,推动了 Python 性能改进。同时,AI 总监 Gabriela de Queiroz 也被解雇,引发各方关注和讨论。
单月涨幅 20%,为什么还是要坚定押注 AI?|AGIX Monthly
关税博弈后,AGIX 表现出高弹性,过去一个月涨 23.15%。它是 AI 时代高成长股集合,虽回撤大但能率先反弹。1Q2025 财报季,AI 落地应用创造价值,多公司展现 AI 业务成效。
全球闲置算力训个模型,性能媲美R1,老黄天塌了!Karpathy曾投资它
全球首个分布式RL训练模型INTELLECT - 2发布,整合闲置算力完成训练,成本降低,性能媲美DeepSeek - R1。其采用分布式异步强化学习范式,团队开源四大关键组件,还获Karpathy等投资,未来有多项计划。
ICCV 2025万篇投稿破纪录,作者被逼全员审稿!网友痛批不如GPT
ICCV 2025论文投稿量达11152篇创纪录,评审结果公布后引热议。网友吐槽部分评审意见质量差,还有作者不满全员审稿制度。大会禁止用大模型评审,也暴露了同行评审流程的官僚问题。
字节Seed新方法!开源8B代码模型:自己筛数据训练自己,同量级SoTA,还能超越百亿级对手
传统code大模型依赖人工筛选数据,成本高、效率低。而Seed - Coder团队让LLM自己筛选数据训练自己,打造8B参数轻量级开源代码模型,性能超百亿级对手,不过也存在通用和数学能力短板。
编码封神,Gemini 2.5 Pro (I/O 版)视频秒转 App!网友:比 o3/Claude 强,Vibe 程序员集结!
谷歌 I/O 大会前,Gemini 2.5 Pro 预览版升级,重点在编码。它搞前端、做 UI 出色,能将视频变互动学习 App,推理速度提升。对标 GPT - 4.1 等,性价比高、表现优,获开发者好评。