「AI模型开发」共找到 13865 篇相关文章
「死亡互联网理论」刷屏硅谷!Reddit创始人预警,奥特曼公开发声
近段时间,「死亡互联网理论」刷屏硅谷,Reddit联合创始人称互联网被AI内容淹没,失去了真实的生命力。OpenAI创始人Sam Altman也认同其有一定道理。如今AI浪潮加速了互联网「死亡」,还可能带来模型崩溃。
英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限
学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。
Lumina-mGPT 2.0:自回归模型华丽复兴,媲美顶尖扩散模型
上海人工智能实验室等团队提出Lumina - mGPT 2.0自回归模型,统一多种图像任务。它采用独立训练架构、统一多任务处理框架和高效推理策略,实验表现优异,后续将优化采样时间并扩展至多模态理解。
真实科研水平集体不及格!全新基准SFE给主流多模态LLM来了波暴击
上海人工智能实验室AI4S团队推出SFE评测基准,首创三级评估体系,涵盖五大科学领域66项任务。评测显示主流MLLMs在高阶科学任务有挑战,不同模型、学科表现有差异,还构建了SciPrismaX平台推动AI科学评估生态发展。
月烧35万元token、逼得Claude官方连夜限速!被全网吐槽的中国“榜一大哥”,已经靠 AI 年入千万了
X用户“刘小排”认领30天按200美元计划消耗5万美元Claude Code token一事。他靠AI年入近千万,用Claude Code做产品,回应网友质疑,称在规则内使用,还分享创业经验,认为AI是长期机会。
Reddit一张神图疯传!2年后,你的笔记本就能跑Fable 5
r/LocalLLaMA社区一张图刷屏AI圈,显示Fable 5级AI预计2年后可在笔记本本地运行。从历史模型看,前沿能力从云端到本地约24个月。这意味着AI正从云端垄断走向桌面民主化。
谷歌首次曝光太空AI计划:要建“AI版星链”,AGI的终极基础设施?
谷歌曝光Project Suncatcher计划,要构建太空AI计算集群。此设想是部署卫星星座建“太空数据中心”。虽面临诸多挑战,但从物理学和经济可行性看并非遥不可及,谷歌已发表相关预印本论文。
全球医疗榜第一,中国AI杀疯了!医疗AI迈入Harness时代
火爆的Harness架构在医疗圈落地,智诊科技发布面向医疗健康行业的Agent OS平台WiseClaw 2.0。它以健康档案为核心,有三层流水线等设计,适用于多场景,且在模型、中层能力和上层治理有优势,还获融资加速发展。
明星AI编码助手涨价10倍惹怒开发者!CEO 回应:有人花千元薅了我们10多万,不挣钱不可持续
10月16日,AI代码助手Augment Code更新定价模式,按AI使用量计费,用户称成本涨超10倍。CEO称原模式不可持续,举例有用户带来高额成本。行业内多家公司也调整定价,反映AI编码助手成本和定价难题。
扎克伯格急了!Meta内部文件曝光:宁用竞品,也要废掉祖传系统
Meta的「超级智能实验室」发起内部革命,加速AI开发。扎克伯格豪赌AI,投巨资重组团队、吸引人才。内部文件显示,Meta强制员工用AI,还让员工弃自研系统,用Vercel等平台。