「Llama 3.1」共找到 3432 篇相关文章
LLM规划能力飙升79%!Google:内在自我批评技术拿下多项SOTA
Google DeepMind研究《通过内在自我批评提升大语言模型的规划能力》,不借助外部验证器,让LLM反复“自评+重写”,使Blocksworld准确率从49.8%升至89.3%,还介绍了方法及跨模型验证情况。
MiniMax今早上市,股价疯涨80%!一群95后跑通了中国AI的价值
1月9日9:30,MiniMax于港交所上市,截稿时股价疯涨近80%。该公司仅用约5亿美元便让全模态模型进入国际第一梯队,员工平均年龄29岁。其以低投入、高产出及全球化业务,展现了中国AI的实力与潜力。
狂奔AGI,Claude年终封王!自主编码近5小时震惊全网
METR报告称Claude Opus 4.5能持续自主编码5小时,超OpenAI最强编程模型。AI编码智能体任务时长指数级增长,不过迈向AGI仍面临长期记忆难题,未来一年该领域或有突破。
理想的眼镜,和李想的眼界
今年11月,李想称要让理想成具身智能领域最佳企业。一周后,理想发布AI眼镜Livis。Livis解决了轻便、续航与性能的矛盾,还利用造车积累实现资产复用。理想推它是因AI眼镜潜力大,能输出跨场景AI能力。
梁文锋,Nature全球年度十大科学人物!
权威科学期刊《自然》公布2025年度十大科学人物榜单,梁文锋因DeepSeek模型对AI领域的重要贡献与变革性影响成功当选。此外,中国研究员杜梦然也因相关研究入选,还有多位其他领域人物因各自成就上榜。
他们让万亿参数RL学会了「省着跑」,顺便砍掉九成算力
2025年,强化学习成大模型进化主战场,但万亿参数模型跑RL成本高。Mind Lab团队实现1T参数模型LoRA高效RL训练,GPU消耗降90%,技术开源。此外还有Memory Diffusion记忆机制等成果。
别再问什么工作被AI取代!Karpathy直指本质:你的工作「可验证」吗?
前特斯拉AI负责人Andrej Karpathy提出,软件1.0自动化能指定的任务,软件2.0自动化能验证的任务。判断任务能否被AI接管,关键看是否满足可重置、可高效试错、可自动奖励三条准则。
工作场景AI化,一个月花100美元订阅AI工具值吗?
InfoQ《极客有约》X AICon 直播栏目邀请来也科技胡一川等探讨 AI 时代「10x 个体」与「10x 组织」。指出「10x 个体」核心是主动思考、善用工具,组织应从「固态」向「液态」转型,还分享了 AI 工具使用与落地经验。
23岁零基础用AI编程月入5000+:一个00后的淘宝变现实战
23岁小伙大骏零基础用AI编程,先做图片处理小工具在淘宝售卖,后通过私域运营让收入翻3 - 4倍。他分享了AI编程变现经验,强调好奇心、行动力和佛系心态很重要。
同一天,百度、OpenAI双双发力高智能AI!先来实测一波原生全模态文心5.0
2025年,OpenAI凌晨更新GPT - 5系列,百度在世界大会发布文心5.0。它采用原生全模态统一建模技术,参数达2.4万亿,评测领先。实测表现佳,其技术在多方面突破,为大模型演进提供路径,助百度重回竞争中心。