从零训练」共找到 4909 篇相关文章

新闻资讯8

赌自己会失业!田渊栋八人天团狂揽44亿元,杀入「递归进化」赛道

Recursive Superintelligence由八位顶尖AI研究员创立,获GV、英伟达等投资6.5亿美元。他们要让AI自我训练,实现递归自我进化,若成功或使AI研究员岗位消失。此前已有相关成果,产品端Anthropic也在推进AI主动性。

新智元
算法论文8

ICLR 2026|首个微观世界模型MicroVerse来了,AI开始模拟看不见的世界

过去两年,世界模型成为大模型演进重要方向,但现有模型多聚焦宏观世界。本文提出MicroVerse模拟框架,将研究边界拓展到微观尺度,还推出MicroWorldBench评测基准和MicroSim - 10K数据集,推动AI视觉模拟迈向科学模拟。

机器之心
新闻资讯8

谷歌AI的“心脏”长什么样?读懂TPU就够了

文章介绍了谷歌TPU的发展历程,2015年为解决AI计算效率瓶颈自研,发展到如今成为谷歌“经济支柱”。还对比了谷歌、英伟达、亚马逊的芯片路线,强调谷歌全栈垂直整合策略使TPU在推理时代优势明显。

芯师爷
开源动态7

来了,DeepSeek又悄悄开源LPLB项目

DeepSeek 悄悄开源 LPLB 项目,该项目解决 MoE 小批量训练专家每批 token 数抖动问题。LPLB 在 EPLB 基础上,将‘冗余专家’看成带容量边的图,每批解一次线性规划,实现 token 重新路由,单节点 100µs 级求解。

PaperAgent
新闻资讯8

英伟达咽喉上的苏州女人

一份英伟达供应链名单让英诺赛科进入大众视野。其创始人骆薇薇九年前回国创业,带领公司“三无小作坊”逆袭。英诺赛科采用IDM模式和8英寸工艺,成全球首家量产8英寸硅基氮化镓晶圆企业,还将与英伟达合作。

量子位
新闻资讯7

推理能力大比拼,《推理模型综合测评报告 2025 》正式发布

过去半年,推理能力成大模型新分水岭。InfoQ研究中心评测八款热门模型,围绕五大维度,用超90%原创试题。发现各模型在不同维度表现有差异,推理模型发展正‘一个大脑’变为‘带工具的多能智能体’。

InfoQ
推荐文章8

Karpathy的软件3.0:Agent的原生世界

OpenAI联合创始人Andrej Karpathy在Sequoia Ascent大会上表示,AI Agent正改变软件与工作模式。编程基本单位写代码变为给Agent下达指令,软件3.0以上下文窗口为程序,LLM为解释器。他还提出理解AI能力分布的框架,给出创业建议。

AIGC开放社区
算法论文7

引入小目标注意力模块改进YOLO12用于无人机视角下的岸边人员玩水检测

文章介绍用小目标注意力模块改进YOLO12,用于无人机视角下岸边人员玩水检测。先介绍YOLO12特点与结构,再说明小目标注意力模块CBAM优势、流程及代码,接着阐述改进方法、数据集情况,最后给出训练和测试模型的代码与结果。

机器学习AI算法工程
产品应用7

电脑操作、技能、连接器、工作伙伴:豆包的牌来了

最近字节有两个豆包相关新闻,一是在训练超大模型,二是反对模型蒸馏。豆包上线大批 Agent 相关工作任务能力,覆盖办公场景,如电脑操作、技能商店等,过程流畅且可观察,还更新移动端,实现远程控制。

MacTalk
新闻资讯8

触觉具身来了个梦之队:天使轮近亿

5月27日,上海新智具身智能科技有限公司宣布完成近亿元天使轮融资。该公司源自复旦大学,核心团队实力强。它聚焦触觉具身智能,构建技术闭环,在数据采集、模型训练等方面有进展,已在工厂落地POC验证订单。

量子位