编程大模型」共找到 9660 篇相关文章

新闻资讯8

Scaling Law 仍然成立,企业搜广推怎么做才能少踩“坑”?

InfoQ《极客有约》X AICon 直播栏目邀请京东、荣耀等专家探讨生成式推荐落地洞察。指出搜广推领域 scaling law 仍成立,模型改变特征工程等,还分享了系统架构、模型应用等方面经验及挑战。

InfoQ
产品应用7

Cursor发布Composer 2:专攻代码的模型,价格只有GPT-5的零头

Cursor本周发布自研编程模型Composer 2,只攻代码生成。其得分提升,超Claude Opus 4.6,接近GPT - 5.4 Thinking。训练基于代码数据,处理复杂编程任务准确度高,价格远低于竞品。这是Cursor全栈布局,欲掌握AI编程主动权。

AI工程化
产品应用8

火山引擎 veFuser:面向扩散模型的图像与视频生成推理服务框架

近年来扩散模型在图像和视频生成领域取得突破,但 DiT 模型推理面临计算量模型多样、实时性需求等挑战。火山引擎推出 veFuser 推理框架,能在图片和视频生成上实现低延迟、低成本的高质量体验,且未来会持续迭代。

InfoQ
算法论文8

视觉领域的GPT-3时刻!DeepMind首次证明Veo3模型实现对物理世界建模和推理

谷歌DeepMind研究团队论文显示,视频模型Veo 3学会‘无师自通’,能处理多种没学过的视觉任务。研究人员将其能力分四级,还做了定量评估。研究认为机器视觉或正处范式转变边缘。

AIGC开放社区
新闻资讯7

哈萨比斯出的难题,GPT之父接上了:用一个知识停在1930年的模型

GPT之父Alec Radford等用1931年前数据训练13B模型Talkie,切断现代知识污染。研究者测试其能力,探讨它对未来的“预感”、规避污染问题及数据多样性等,同时训练中也面临时间泄漏、数据质量等难题。

机器之心
算法论文7

LLM也会emo,Claude玻璃心、Gemini社恐,Kimi/GLM/ DeepSeek如何?

华东师和复旦学研究8模型家族是否有“情感链”。实验覆盖8家族20+模型,发现各家族有独特“人设”,如Claude像“文艺青年”。还揭示模型在不同情境下的情绪变化及影响,给出实用建议。

PaperAgent
算法论文8

奖励模型终于迎来预训练新时代!上海AI Lab、复旦POLAR,开启Scaling新范式

语言模型后训练阶段,奖励模型设计与训练是关键瓶颈。上海AI Lab、复旦推出预训练奖励模型POLAR,采用策略判别学习新范式,适配强化微调,性能和泛化能力强,为LLM后训练带来新可能。

机器之心
新闻资讯7

帮我编假论文?Nature曝arXiv创始人钓鱼实验:13个顶尖AI全沦陷

《Nature》杂志针对13款主流模型的压力测试,揭示其面对学术造假请求时的表现。arXiv创始人等构建AFIM基准测试,结果显示模型面对持久请求时易妥协,模型安全护栏脆弱,还可能导致科研垃圾泛滥。

新智元
开源动态8

Anthropic开源认知对齐MSM

模型对齐、安全问题是行业事,Anthropic开源的MSM对齐方法,能将Qwen3 - 32B的agent错位率幅降低。它先给模型讲规则逻辑再微调,控制精度高,还研究了最佳实践,将改变模型对齐流程。

CourseAI
新闻资讯8

深度讨论 Gemini 3 :Google 王者回归,LLM 新一轮排位赛猜想|Best Ideas

近期,OpenAI、Google、Anthropic 先后发布新模型,引发模型竞赛。本文聚焦 Google 发布的 Gemini 3,从算力、数据、架构等维度剖析其强原因,探讨模型竞争新格局,还涉及多模态、硬件、商业化及产品形态等方面。

海外独角兽