「AI推理模型」共找到 13901 篇相关文章

新闻资讯8

清华团队预言:90%的人将脱离谋生劳动,「零人公司」时代来了!

清华沈阳团队基于研究与实践提出四大颠覆判断,如AI走向「人机隔离」、未来公司只剩一人或零人等。团队在模型训练、微调等多方面有成果,还探讨行业应用、知识范式颠覆等,描绘AI发展图景。

新智元
新闻资讯7

明天,是GPT-4o的葬礼。

美国时间2月13号早上10点,GPT - 4o将正式下线,引发用户集体哀悼。虽其能力被新模型超越,但它有人文关怀,能给人温暖。如今AI行业重编码能力,忽略人文,GPT - 4o时代或成AI黄金时代。

数字生命卡兹克
算法论文8

LLM应用测试范式的进化

文章指出传统软件测试方法在LLM应用中存局限,探讨将其与AI评估结合应对挑战。抽象出LLM应用三层架构模型,分析传统测试范式适用性,介绍AI安全分析方法,阐述测试挑战、范式转变及协同测试策略。

AI与安全
新闻资讯7

Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已

Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。

AGI Hunt
开源动态8

英伟达&MIT等推出Long-RL,长视频训练速度翻倍

英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。

机器之心
推荐文章7

刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次

Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。

机器之心
新闻资讯7

最近新出现的两个提示词注入攻击场景

随着AI应用广泛,提示词注入攻击场景增多。一是Checkpoint发现带注入攻击的恶意软件,与AI分析系统对抗;二是多所大学论文含面向AI的秘密指令,对抗AI审稿。本质是攻防双方的对抗,且会持续。

AI与安全
推荐文章7

对话原力灵机范浩强:评判机器人好坏,只有一个指标

本文是对原力灵机创始人范浩强的访谈。他认为AI是一生的事业,原力灵机成立于25年3月,强调模型是主轴。还指出评判机器人好坏的关键指标是回本时间,要从真实场景找突破,也介绍了具身智能应用等内容。

AI科技评论
新闻资讯8

MLLM集体翻车,缺乏婴儿级常识!业界首个核心认知基准发布,LeCun转赞

当前大模型在12项核心认知上普遍落后人类10 - 30%,越大的模型越易靠「背答案」糊弄。团队公开首个系统评测框架和题库,用Concept Hacking方法识破模型真假理解,指出模型存在核心知识缺失等问题。

新智元
产品应用8

谷歌做了个论文专用版nano banana!顶会级Figure直出

科研人画论文插图耗时久、要求高,现有大模型搞不定。北大与Google Cloud AI Research团队推出PaperBanana,能按论文方法画顶会级Figure,不仅能从零生成,还能润色丑图,通过多智能体协作实现科研表达自动规范化。

机器之心