「大模型编程」共找到 9841 篇相关文章

算法论文8

GPT-6 或有"生命"!MIT新作实现LLM自我进化,冻结权重时代终结

MIT新作《Self-Adapting Language Models》实现LLM自我进化,SEAL框架让模型自己生成“自编辑”微调自身。它能实时学新数据、修复知识、形成记忆。经两种场景验证,小模型也能超越GPT - 4.1等。

PaperAgent
新闻资讯7

永别了,人类冠军!AI横扫天文奥赛,GPT-5得分远超金牌选手2.7倍

国际天文与天体物理奥赛(IOAA)中,GPT - 5和Gemini 2.5 Pro完胜人类选手。俄亥俄州立大学团队考察五大顶尖LLM,发现它们大多达金牌水平,但在几何、时空推理等方面有困难。

新智元
开源动态7

详解Github 35K+项目:打通200+数据源,构建企业级AI的数据统一入口,支持MCP【上篇】

文章实测开源的AI数据统一访问引擎MindsDB,介绍其架构、安装启动方法,展示跨多数据源统一查询、AI模型赋能数据查询等功能,还将在下篇介绍知识库与智能体特性。

AI大模型应用实践
算法论文8

一个标点就能迷惑LLM-as-a-Judge!

论文揭露惊人漏洞,一个标点或通用推理开场白就能欺骗最先进的LLM裁判,导致强化学习训练崩溃。研究通过实验验证漏洞,提出Master - RM模型,其FPR近乎0%且保持通用裁判能力。

深度学习自然语言处理
新闻资讯8

深圳SEO&GEO大会:搜索没死,只是竞争规则变了!

深圳SEO&GEO大会探讨搜索新形势,多位嘉宾分享见解。如Zac老师认为AI增长不代表搜索失价值,SEO应随搜索逻辑升级;Paul老师提出大品牌应将SEO目标转向争答案席位等。

白杨SEO优化教程
算法论文8

训练提速5倍,响应缩短50%:动态自感知能力,重塑高效LLM Reasoning范式

大型语言模型“思维链”技术有冗余,传统优化方案存在静态先验与动态能力错配问题。论文提出的DR.SAF框架赋予模型动态自感知能力,通过三模块协作,实现推理“精准瘦身”,解决根本冲突。

深度学习自然语言处理
新闻资讯8

AI不是比人聪明,是输得起!菲尔兹奖得主点破OpenAI十项成果

OpenAI发布内部版模型Astra的十项成果,引发数学界震动。菲尔兹奖得主Timothy Gowers分析其成果,指出AI优势在‘输得起’,还探讨找例方法、模型短板,给出训练建议与衡量跨越门槛的标准。

新智元
产品应用7

一年吃掉一块固态硬盘,Codex日志bug被骂「劣质软件」

OpenAI旗舰编程工具Codex因日志Bug,一年写入量达640TB,耗尽硬盘寿命。该问题4月就有反馈,拖两月才处理,仅减少约85%写入。Codex类似问题至少9个,AI编程工具质量引质疑。

新智元
推荐文章7

拒绝招聘、产品粗糙,却成史上最快增长软件公司!4个00后“整顿”创业圈:大家都不信,才是我们的机会

Cursor是极速崛起的AI编程工具,操刀手是4个00后。创始人Michael Truell分享经验,从早期失败项目获教训,虽有GitHub Copilot,仍因看好编程未来投身其中,3个月发布产品并不断迭代。

AI前线
开源动态8

“边说边思考”,Mini-Omni-Reasoner 开创实时语音推理新范式

Mini - Omni - Reasoner将推理能力引入大型语音模型,开创“边说边思考”范式,实现实时语音推理与交互。推出Spoken - Math - Problems - 3M数据集,经四阶段生成流程构建。训练采用分阶段策略,性能超基础模型。

GitHubStore