编程大模型」共找到 9745 篇相关文章

推荐文章8

给还在厂工作的朋友 21 条忠告

Addy Osmani分享《在谷歌14年得到的21条教训》,涵盖工程师工作多方面,如解决用户问题、达成共识、偏向行动、清晰表达等,对厂工作者有指导意义。

MacTalk
算法论文8

让扩散模型「可解释」不再降质,开启图片编辑新思路

过去三年扩散模型席卷图像生成领域,但可解释性研究是‘黑箱’,且现有尝试常致性能下降。香港中文学与上海人工智能实验室团队提出TIDE框架,可解释且不降质,还带来新图像编辑方式。

机器之心
算法论文8

750篇论文,彻底把统一多模态模型摸清了

未来迈向AGI需多模态AI系统。南等联合发表综述,涵盖754篇文献。分析传统路线痛点,介绍统一多模态模型定义、技术路线、训练方法等,还提及应用场景及未来方向。

PaperAgent
新闻资讯7

厂这波Agent混战,杀死10多个AI名品

2026年8月AI圈组织架构调整频繁,阿里、字节整合多款产品,腾讯、百度也有动作。办公Agent成厂混战核心,虽有产品被整合,但各厂优势不同,终局难测。

鲸选AI
新闻资讯7

马斯克发起编程人机战!卡帕西说了不

马斯克邀卡帕西与Grok 5编程对决,卡帕西婉拒,称更愿合作。网友看法不一,有人认为是马斯克伸橄榄枝,也有人猜测因xAI核心工程师离职,卡帕西或成接班人,未来是否回归待察。

量子位
产品应用8

实测Qwen-MT翻译模型,确实又快又好

阿里云百炼最新翻译模型Qwen-MT开放,有支持多语言互译、提供专业功能、轻量级架构等亮点。实测显示其响应快、回译准确、能调风格,200字文本仅需2.5秒。

量子位
算法论文8

模型手语翻译新进展:CAPO-SLT拿下中文三项最高分 | EMNLP'26

vivo AI Lab团队针对自动手语翻译生成中,无视觉证据支撑的错误累积导致语义偏移的痛点,提出置信度感知策略优化方法CAPO-SLT,仅调整强化学习更新规则,不修改主干网络,在中文手语翻译测试中拿下三项指标最高分,成果将发表于EMNLP'26。

量子位
算法论文8

SFT远不如RL?永不过时的剃刀原则打开「终身学习」模型训练的

现代AI系统学习新任务时会灾难性遗忘旧知识,限制其持续学习能力。麻省理工学院研究者对比SFT和RL后发现,相同性能下RL更不易遗忘,提出遗忘定律,解释了RL优势源于其on - policy特性。

机器之心
新闻资讯7

4比0横扫Grok 4,o3强势夺冠,首届模型对抗赛结果出炉

备受AI圈关注的首届谷歌Kaggle AI Chess赛落幕。o3以4 - 0横扫Grok 4夺冠,Gemini 2.5 Pro 3.5 - 0.5击败o4 - mini获季军。此前Grok 4被视为夺冠热门,决赛却频频失误。

机器之心
算法论文8

纯靠“脑补”图像,模型推理准确率狂飙80%丨剑桥谷歌新研究

剑桥、伦敦学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。

量子位