康奈尔大学」共找到 5304 篇相关文章

新闻资讯8

奥特曼最新深度访谈:AI至今没有iPhone时刻!

OpenAI首席执行官山姆·奥特曼在深度对谈中复盘模型发展,谈及砍掉Sora和自研浏览器聚焦平台,认为AI缺iPhone时刻,还分享ChatGPT决策过程、创业经历,提出从成功经验等观点,反驳末日论。

AI寒武纪
算法论文8

Loss收敛不代表会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假会”样本

模型微调(SFT)是主流LLM落地方案,但家默认训练完就是完了。腾讯混元团队发现SFT存在不完全习现象(ILP),论文完成了定义ILP、找根因、提诊断框架和验证干预等工作。

量子位
新闻资讯8

国产AI高考708分,这款模型靠什么成为「屏蔽生」?

高考放榜,媒体对国内外模型进行测试。综合成绩上,讯飞星火X2物理、历史类表现优异;单科专项中,它在数、作文等测试也领先。其优势源于数据积累、理解评判标准,还采取软硬件一体化落地路径。

机器之心
8

上线不到一年,收徒百万,首个真人级AI导师技术底牌首次曝光

2025年初,与爱为舞落地国内首个真人级AI一对一导师产品「爱」,上线不到一年有超百万员使用。它突破传统AI教育局限,自研全栈技术体系,从多方面打造优质AI导师,为AI Agent规模化落地定义范式。

机器之心
新闻资讯8

7个月翻一番!AI agent能力飙升,METR报告揭示指数级进化规律

非营利研究机构METR报告显示,Agent能力每7个月翻一番,这在9项基准测试中得到验证,任务涉及编程、数等领域,模型正迈向高度自动化,且Agent性能提升快,未来处理复杂任务能力或更强。

量子位
开源动态7

The Batch: 948 | GLM 5.1:面向长时任务的能力提升

Z.ai将旗舰开源权重语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数能力落后闭源模型,价格有提升。

DeeplearningAI
新闻资讯7

给AI打个分,结果搞出17亿估值独角兽???

模型竞技场LMArena官宣拿下1.5亿美元A轮融资,估值升至17亿美元。它前身是Chatbot Arena,由LMSYS创建,核心成员多为顶尖高校霸。LMArena评估规则有趣,成新模型必测榜单,计划用新资金运营平台、扩团队。

量子位
新闻资讯7

AI眼镜:又怕小米做,又怕小米不做

过去一年AI眼镜产品密集落地,小米和Rokid跻身全球出货量前三。市场处于“又怕小米做,又怕小米不做”的微妙氛围,厂试水但未全力投入,给中小厂商留下建立技术壁垒的窗口期,显示技术或成首个分水岭。

远川科技评论
新闻资讯8

Karpathy最新发文:醒醒!别把AI当人看,它没欲望也不怕死

Andrej Karpathy在推文中反驳将模型视作「更聪明人类」的观点,指出模型是「非生物」智能,其进化压力、习机制、运行方式与人类不同。清楚这是全新智能,对理解模型很重要。

新智元
开源动态8

告别AI胡说八道,Meta新方法CoVe准确率飙升 28%

模型‘幻觉’问题一直是‘严肃使用场景’的难题。Meta AI团队提出CoVe新方法,让模型会‘自我反省’。该方法通过四步走实现自我纠错,能幅降低幻觉率,还具备三优势。

CourseAI