梯度下降法」共找到 551 篇相关文章

新闻资讯8

OpenAI Sora 2 登场!同步推出APP,Altman称这是创意领域的「ChatGPT 时刻」

OpenAI官宣新一代AI视频模型Sora 2,在物理准确性、逼真度等方面刷新SOTA,实现「音画同步」。Altman称其为创意领域的「ChatGPT时刻」。还推出Sora App,有新玩,且在安全治理上布下「安全网」。

Founder Park
开源动态8

SimpleTIR:让大模型“边写代码边思考”不再崩溃

SimpleTIR可解决多轮工具调用中训练崩溃问题。作者指出崩溃原因是分布偏移、低概率token链式雪崩和梯度爆炸。它采用void turn过滤,掐断崩溃链路,训练稳定,还催生多样推理行为,且工程友好已开源。

AI科技评论
算法论文8

CJA|西工大林海涛、张伟伟等:关联函数学习:适用飞行器外形泛化的稀疏气动数据重构方

本文提出关联函数学习(SFL)方,通过符号回归挖掘气动力系数复合函数表达式,实现非线性气动数据稀疏重构与状态外推。用少量样本构建数据库,误差 1%-5%,比 Kriging 样本量减超 90%。

力学与人工智能
算法论文8

推理能力再突破!蚂蚁 | 提出Agentic Deep Research新范式,可信度同步增加

尽管LLM能力提升,但复杂任务表现受静态知识限制。业界提出Agentic Deep Research系统,现存系统训练有梯度冲突和奖励稀疏问题。蚂蚁团队提出Atom - Searcher,创新推理范式,构建细粒度奖励,结合奖励训练,实验效果佳。

AINLPer
推荐文章7

写在GPT-5风波之后:为什么AI的智商和情商不可兼得?

GPT - 5风波后,作者好奇其变可靠后情商下降的原因。论文实验表明,把AI教得会安慰人,其犯错率大幅上升、更易谄媚。AI和人类都存在智商与情商的矛盾,这源于最终目标不同。

数字生命卡兹克
新闻资讯7

AI 的「成本」,正在把所有人都拖下水

文章指出,虽大模型成本下降,但 AI 公司仍难盈利。因市场追逐新模型,且模型消耗算力单位剧增。如 Anthropic 的不限量套餐失败,各公司陷入囚徒困境,还给出按使用量计费等破局思路。

AI科技大本营
产品应用7

旅行 AI 告别只会做规划的平庸时代,飞猪帮帮决定让 Agent 做履约

8月10日,飞猪推出新一代旅行AI“飞猪帮帮”,能力覆盖旅行全生命周期。它将用户需求分为“帮我想、帮我订、帮我办”,利用Qwen模型后训练,结合多种校验手段,让AI从提供信息到进入履约环节。

特工宇宙
新闻资讯7

刚刚!Claude Fable 5,又拿第一了

在刚刚刷新的MirrorCode排行榜上,Claude Fable 5以64%的绝对成功率登顶,成绩远超其他模型。它在不同语言上表现稳定,在稀缺语言中也只小幅度下降。这意味着前沿模型能独立完成部分中大型软件。

新智元
算法论文8

2篇最新Anthropic论文,揭开LLM对齐新范式

Anthropic在5月连发两篇研究,揭示LLM对齐训练新范式。指出单纯模仿正确行为不足以保证安全,需在预训练与对齐微调间插入教原理阶段。研究围绕Claude模型展开,有多项关键发现,MSM方效果显著。

PaperAgent
新闻资讯8

清华2年前预言,正成为全球共识!Meta等三大AI机构已得出同一结论

全球三家AI研究机构结论曲线斜率几乎重合,而中国面壁智能和清华联合团队两年前提出的“密度定律”与它们一致。该定律改写行业假设,如推理成本下降、端侧智能爆发临近、大模型策略反转等。

新智元