深度学习模型训练」共找到 8647 篇相关文章

产品应用8

破解300年数学难题,智能体大突破!谷歌发布超强AI Agent

今天凌晨谷歌Deepmind发布编程AI Agent——AlphaEvolve,它与Gemini深度集成,能评估算法。它解决了300多年的数学难题,还提出新算法,提升大模型计算效率,可优化GPU指令,架构含多模块。

AIGC开放社区
算法论文8

告别死记硬背!SkillRL自动提炼Skills持续进化

大型语言模型智能体常孤立运行,难从经验学习。SKILLRL受人类技能启发,提出有效经验迁移需抽象。它通过经验驱动的技能蒸馏、分层技能库和递归技能进化机制,在多实验中表现出色。

PaperAgent
产品应用7

回复:用 AI 辅导教学问题

家长询问用Gemini 2.5 pro的OCR功能辅助孩子预习九门课程的问题,包括撰写提示词、有无更合适AI方案、家长角色及评估学习成果等,回复给出对应建议,如没必要上传教材等。

宝玉AI
新闻资讯7

月薪3万,去内蒙草原给DeepSeek守机房

深度求索放出数据中心高级运维工程师等岗位,要将效率至上哲学从软件延伸到机房运营。其选择乌兰察布建数据中心,因当地条件优、产业生态成熟。且传闻其新一代大模型V4将发布,算力成决胜关键。

量子位
开源动态8

史上最大高质量科学推理后训练数据集开源,快速让Qwen3等变“科学家”

上海创智学院、上海交通大学发布开源科学推理后训练数据集MegaScience,含约125万条问答对,覆盖多学科。它解决了现有数据集的问题,实验显示能提升模型科学推理能力,已完整开源相关组件。

量子位
开源动态8

SFT+RL双管齐下:ReasonGen-R1如何破解文生图「指令不遵」难题?

上海科技大学等机构提出 ReasonGen-R1 框架,结合链式推理监督微调与强化学习,提升自回归图像生成模型推理和创作能力,已全面开源。介绍了其训练阶段、实验结果及推理链模式。

机器之心
算法论文8

谷歌最新发表的Science论文,颠覆了人类对ASI的想象

谷歌等机构研究者在《科学》发文,提出真正智能爆炸已发生,是多元、社会性且与人类深度缠绕。推理模型内部涌现‘思想社会’,当下人机协作进入‘半人马时代’,还探讨了AI扩展、对齐及治理问题。

新智元
产品应用8

「AI黑客」来袭,Agentic AI如何成为新守护者?

AI 发展带来网络安全新威胁,如生成式 AI 诈骗、深度伪造等。业内共识是以 AI 对抗 AI,有模型防护、行业应用、政府协作三类尝试。青藤云安全推出全栈式安全智能体「无相」,革新安全思维。

机器之心
新闻资讯7

Meta被控盗用成人影片训练AI,遭索赔3.6亿美金,成人影片居然是训练AI的最佳素材?

美国成人影片制作公司Strike 3 Holdings指控Meta自2018年起下载并分享2396部成人影片,约81.7TB,用于训练AI模型,涉嫌严重侵权。Meta未回应,文章还分析了用成人影片训练AI的可能原因。

开源AI项目落地
推荐文章7

对话冯雷:从 AI 播客,到真人感 Agent

本文是对ListenHub创始人冯雷的对话记录。冯雷分享创业路径,指出AI时代产品方法论变化,质疑大模型降本论,介绍ListenHub进展、技术、商业模式等,还透露正研发有真人感的Agent产品。

AI科技评论