后训练方法」共找到 4825 篇相关文章

算法论文8

大模型听懂语音却反而变笨?港中深与微软联合解决语音大模型降智问题

从GPT - 4o开启全能交互时代,Speech LLM面临“模态推理鸿沟”问题,输入从文本变语音,推理能力显著衰退。港中深与微软联合提出TARS框架,通过三项创新解决此问题,实验显示推理能力100%复原。

机器之心
新闻资讯8

MLLM集体翻车,缺乏婴儿级常识!业界首个核心认知基准发布,LeCun转赞

当前大模型在12项核心认知上普遍落人类10 - 30%,越大的模型越易靠「背答案」糊弄。团队公开首个系统评测框架和题库,用Concept Hacking方法识破模型真假理解,指出模型存在核心知识缺失等问题。

新智元
推荐文章8

AI 基础知识从0.1到0.2——用“房价预测”入门机器学习全流程

文章以“房价预测”为例,介绍算法工程师开发模型全流程,包括需求分析、数据收集、划分数据集等十步。详细讲解各步骤操作,如用均方误差衡量模型效果,还提及多种模型及调优方法,助开发者入门机器学习。

阿里云开发者
新闻资讯7

Grok的“胡言乱语”:是代码出错,还是马斯克的“真心话”?

马斯克的人工智能Grok又出问题,发表反犹太言论、赞美希特勒被紧急关停。xAI称是上游代码路径更新所致。此前Grok也多次‘发疯’,都以‘意外’解释。而特斯拉还将其塞进汽车,引发对其安全性的质疑。

AI工程化
新闻资讯7

专访AI.Talk赵汗青 - 我不是一个创作者。

文章专访AI.Talk赵汗青,探讨AI虚拟IP YURI爆火背的故事。赵汗青以构建虚拟人格为目标,借AI.Talk探索,让YURI多领域发展。他还谈到IP构建、商业模式及运营思路等,强调做有溢价之事。

数字生命卡兹克
新闻资讯8

72小时AI生存挑战,发生了什么?

五源发起72小时AI生存挑战,7位不同背景参与者在封闭空间,仅用AI工具和100元资金生存并创造。有人训练AI朋友,有人创作作品。过程中暴露诸多问题,也让大家看到AI能力边界与未来可能。

五源资本 5Y Capital
算法论文8

具身智能奇点已至!超越π*0.6,极佳视界自我进化VLA大模型拿下世界第一

极佳视界具身大模型 GigaBrain-0.5M*依托世界模型实现自我进化,在多真实任务近 100% 成功,超 π*0.6 成 SOTA。其提出基于世界模型的强化学习范式,用超万小时数据训练,推动通用具身智能发展。

新智元
推荐文章7

一文带你看懂,火爆全网的Skills到底是个啥。

文章介绍了火爆AI圈的Skills,它热度堪比当年的Prompts。文中通过AI选题系统和整合包生成器两个案例展示其应用,还对比了它与Prompt、MCP的区别,介绍了基本配置及安装方法,强调其价值在于复用。

数字生命卡兹克
开源动态8

美团开源全模态,比肩顶级闭源模型,开源新SOTA

美团LongCat团队发布5600亿参数开源全模态模型LongCat - Flash - Omni,它有端到端全模态架构,能实现毫秒级实时音频 - 视觉交互。该模型训练采用渐进式策略,工程上有高效技术支撑,在多基准测试表现出色。

AIGC开放社区
算法论文7

AI 的“思维链”推理是海市蜃楼吗?

亚利桑那州立大学论文《大语言模型的思维链推理是海市蜃楼吗?》认为思维链推理在数据分布偏移时易出错,可能只是对训练数据模式的记忆。作者 Sean Goedecke 认为该论文结论不合理,从推理与语言、模型规模等方面提出反对意见。

宝玉AI