大模型开发」共找到 10018 篇相关文章

算法论文8

Anthropic、Thinking Machines Lab论文曝光:30万次压力测试揭示AI规范缺陷

Anthropic和Thinking Machines Lab等机构研究人员提出模型规范压力测试法,基于细粒度价值体系生成超30万个查询场景,分析12个前沿模型回答,揭示模型规范存在原则冲突、解释歧义等缺陷。

机器之心
产品应用7

再也不怕面瘫脸!YouTube黑科技:AI帮你「永久微笑」,连僵尸都咧嘴笑

YouTube在Shorts相机里实现AI实时「重绘」人脸,效果自然。它通过知识蒸馏将模型「瘦身」成小模型,用迭代蒸馏打磨细节,PTI保证身份特征,MediaPipe搭建推理管道,还将拓展视频生成功能。

新智元
产品应用8

真情实感体验了阿里「千问APP」后,为什么说它是「中国的ChatGPT」?

近日阿里推出面向全球的千问APP。从产品定位、模型能力、效果来看,它接近ChatGPT,是“中国的ChatGPT”。它打通Qwen模型和应用,界面极简,功能多,体验佳,有望让家重新认识阿里模型应用。

机器之心
产品应用8

一周对战2500万局,这些「AI假人」让人类游戏玩家破防了

2025年巨人网络《超自然行动组》成黑马,新玩法中游戏怪物“假人”接入AI模型。上线一周参与近2500万场对局,成国内首个深度融合AI模型并规模化落地的DAU游戏。

机器之心
新闻资讯8

MIT天才博士刚毕业,就被前OpenAI CTO抢走!年薪或300万起步

MIT天才博士肖光烜刚毕业就官宣加盟Thinking Machines,主攻模型预训练。他履历耀眼,博士论文破解LLM三难题,构建高效模型框架。Thinking Machines薪资可观,平均年薪超OpenAI等公司。

新智元
算法论文8

Evaluation is All You Need:评估设计的微小差异如何扭曲结果

论文以DeepSeek - R1 - Distill系列模型为例,指出模型评估中看似客观的基准测试结果对评估细节极度敏感,细微评估条件变化会致分数波动,削弱模型对比可信度,呼吁建立新评估标准。

深度学习自然语言处理
新闻资讯7

AI手搓蒙娜丽莎!8次临摹,最像那版全被自己改没了

AI工具平台TryAI搭建「绘画竞技场」,让GPT - 5.6 Sol等四个视觉模型临摹蒙娜丽莎等,记录实验过程。结果显示,模型最终作品不如中途最佳版,且成本差异,工具使用方式不同。

新智元
新闻资讯8

0.027B手机AI模型,估值2亿美金,三个清华学霸如何获得国际学生创新赛冠军

10月15日,清华万格智能团队“基于类脑架构的下一代通用模型与智能体生态”获中国国际学生创新赛(2025)冠军。团队由三个清华本科生创立,此前已完成融资,估值达2亿美元。其智人HRM模型有诸多优势,还研发出顶尖气候预测专家模型

AIGC开放社区
产品应用8

波士顿动力Atlas人形机器人再现逆天进化:通用AI机器人真的要来了

波士顿动力为Atlas人形机器人训练全新型行为模型LBMs,它是语言指令驱动的策略模型,能完成复杂操作任务。构建模型有四步骤,实践遵循三原则,还展示了其多方面操作能力与特点。

AI寒武纪
算法论文8

12个Ai编程Agent同台PK,最贵的不一定是最强的

上海交和美团联合发布PRDBench论文,将12个主流AI编程Agent放入50个真实Python项目测试。结果显示,基础模型写代码强,商业版调试优势明显;专门训练的裁判模型比通用模型靠谱。

CourseAI