「AI表现」共找到 11082 篇相关文章

新闻资讯8

性能比肩Gemini 3 Pro!昨晚,阿里千问最强模型来了

1月26日深夜,阿里千问旗舰推理模型Qwen3 - Max - Thinking上线,综合性能对标GPT - 5.2与Gemini 3 Pro。它突破传统推理方式,有自适应工具调用能力,助其在企业级AI竞争中领先。

机器之心
新闻资讯7

奥特曼仓促亮剑GPT-5.2!一张图爆火全网,全面碾压Gemini 3

谷歌发布Gemini 3,其惊艳表现打乱OpenAI阵脚,公司进入「红色警戒」,将提前于12月9号发布GPT - 5.2应对。网传GPT - 5.2测试分数全面超Gemini 3 Pro,但遭网友质疑。OpenAI面临用户流失等危机。

新智元
开源动态8

2M大小模型定义表格理解极限,清华大学崔鹏团队开源LimiX-2M

大语言模型在结构化表格数据处理上表现不佳,清华大学崔鹏团队开源的 LimiX-2M 模型,仅 2M 参数,却能同时支持分类、回归等任务,性能超越经典模型,且训练、运行成本低,科研友好。

机器之心
推荐文章8

被轻视的巨大市场,大厂做不好的Local Agent为何难?| 甲子光年

文章指出大模型边际收益递减,AI竞赛规则生变,产业从‘参数竞赛’转向‘效率革命’。本地Agent有潜力,但主流产品体验差。GreenBitAI深耕低比特模型,推出Libra,有望撬开万亿美元增量市场。

甲子光年
产品应用7

Qwen深度研究一夜升级!可生成网页和音频播客,新模型能认医生手写体

Qwen版深度研究加速进化,增加听觉和视觉输出,可生成网页和音频。改进功能同时更新模型,Qwen3 VL能识别医生手写体。实测新功能表现出色,Qwen3-VL系列更新后性能优异。

量子位
开源动态8

1.58bit不输FP16!微软推出全新模型蒸馏框架,作者全是华人

微软推出蒸馏框架BitNet Distillation,实现几乎无性能损失的模型量化。它含三阶段,经实验在多下游任务表现近全精度模型,降内存开销、提推理速度,作者全是微软研究院华人。

量子位
算法论文8

北大彭一杰教授课题组提出RiskPO,用风险度量优化重塑大模型后训练

北大彭一杰教授课题组提出 RiskPO,解决大模型后训练陷入「均值陷阱」问题。它将风险规避理念融入优化目标,用「关注奖励分布左尾」替代「追求整体均值」,在多领域数据集上表现超越 GRPO 等。

机器之心
推荐文章7

AGI 路线图第二阶段:游戏即模型训练|AGIX PM Notes

文章围绕AGI展开,介绍AGI路线图第二阶段“游戏即训练”,指出游戏是训练agent的理想环境;还提及Dreamer系列研究进展。同时涵盖本周市场动态、多家公司AI动态及ETF复制指数的方法、优劣和影响。

海外独角兽
新闻资讯8

「从追赶者到引领者,路有多远?」 我们和CANN一线开发者聊了聊

AI浪潮下,硬件竞争转向软件等生态之战,华为昇腾及其CANN站在变革前沿。本文与开发者对话,探讨CANN开源意义、早期挑战、演进及未来战略,开源将带来技术透明、生态赋能等红利。

机器之心
新闻资讯7

马斯克周末血裁xAI 500人

上周四晚,xAI内部突袭测试,淘汰率达33%,超500人被裁。此前其数据标注团队规模持续增长,多为直聘。此次战略转变,将扩专业标注员规模,或押注垂直行业AI。

量子位