港大」共找到 5104 篇相关文章

算法论文8

68页论文再锤模型竞技场!Llama4发布前私下测试27个版本,只取最佳成绩

《排行榜幻觉》论文指出Chatbot Arena存在问题,如少数厂私下多版本测试选最优、数据访问不平等、用Arena数据训练可提性能、模型被量静默弃用等,研究团队给出改进建议,官方也进行了回应。

量子位
新闻资讯7

全球首个 IPO 模型公司出现!智谱携 500 亿估值开启招股、70% 募资投研发,1 月 8 日登陆

12月30日,智谱华章启动股IPO招股,预计1月5日结束,1月8日挂牌。以每股116.20元计,募资约43亿元,市值超511亿元。70%募资用于模型研发,还引入多家基石投资者。

InfoQ
算法论文7

AIAA J | 西工翟凯宇、李楠等:膨胀拐角影响下入射激波/边界层干扰的标度律分析

高超声速进气道肩部区域的激波 - 膨胀波 - 边界层干扰影响,传统标度律有误差。本研究结合实验与理论,研究膨胀拐角影响下的入射激波/边界层干扰,提出改进标度律,还构建混合监测框架实现准确预测。

力学与人工智能
新闻资讯8

百川开源医疗模型 M3,王小川:今年会发布两款 ToC 产品,正在做硬件

1月初OpenAI、Anthropic推出医疗产品,百川智能也开源医疗模型Baichuan - M3,评测成绩突出。王小川表示今年会发布两款ToC产品,还在做硬件,阐述了百川在医疗领域的目标与策略。

Founder Park
新闻资讯8

2026崇礼论坛成功举办,俞敏洪、周鸿祎、沙宝亮等近百位咖共话AI新风向|甲子光年

2026年1月23 - 25日,2026崇礼论坛在张家口崇礼区太舞小镇举办,俞敏洪、周鸿祎等近百位咖共话AI。设四专场论坛探讨技术落地、商业闭环等问题,还启动了“崇礼企业家联盟”。

甲子光年
开源动态8

文生图进入R1时代:中文MMLab发布T2I-R1,让AI绘画“先推理再下笔”

中文MMLab团队发布首个基于强化学习的推理增强文生图模型T2I - R1。它提出双层级CoT推理框架和BiCoT - GRPO强化学习方法,解决生成评估难题,为多模态生成提供新范式。

量子位
算法论文8

模型能“原地”改参数了!字节Seed&北新论文:测试时推理无需加层重训练

字节Seed和北研究团队提出In - Place TTT方案,让模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。

量子位
开源动态8

带图推理碾压同类开源模型!中文微软等开源OpenThinkIMG框架,教AI学会使用视觉工具

中文、微软等联合推出OpenThinkIMG开源框架,解决AI使用视觉工具面临的集成难、缺数据、适应差等问题,还公开核心技术V - ToolRL。该框架在图表推理任务上表现超GPT - 4.1,为下一代AI智能体提供基础。

量子位
新闻资讯7

王田苗三问具身牛:模型还在「拨号上网」,机器人靠什么拿下真实订单?| WRC 2026

在2026世界机器人会的圆桌论坛上,王田苗向具身智能头部企业CXO抛出尖锐问题。嘉宾围绕量产卡点、模型应对物理世界不确定性及产业终局生态展开讨论,并就商业化落地节奏达成共识。

AI科技评论
算法论文8

前OpenAI科学家&GPT之父:预训练精准数据过滤,极低成本削弱模型危险能力数千倍

Claude价值观塑造者Neil Rathi和GPT之父Alec Radford发论文,提出预训练时精准“删掉”危险知识碎片,以极低计算成本将模型特定危险能力削弱数千倍,且不损通用智能。

AIGC开放社区