人在回路」共找到 8750 篇相关文章

新闻资讯8

刚刚,Claude独立攻克图论猜想,仅用31步!算法祖师爷高德纳震惊发文

Claude Opus 4.6仅用31步独立攻克图论猜想,算法祖师爷高德纳震惊发文,认为需重新评估生成式AI数学研究中的作用。这标志着AI自动推理和解决创造性问题上达到新里程碑。

新智元
新闻资讯7

GPT-5问题太多,奥特曼带团回应一切,图表弄错是因「太累了」

GPT - 5发布后问题频出,数学、逻辑、编码任务中失误不断,还出现低水准图表错误,引发吐槽质疑。OpenAI联合创始Sam Altman等Reddit AMA活动中回应问题,给出解决方案并分享未来规划。

机器之心
新闻资讯8

哇塞,今天北京被机器塞满了!

世界机器大会北京开幕,100多个新机器亮相。智平方的爱宝机器气爆棚,它能用一个基座模型完成多任务。其搭载的GOVLA大模型有四大核心能力,且已多行业商业化落地。

量子位
新闻资讯7

数学题干带猫AI就不会了!错误率翻300%,DeepSeek、o1都不能幸免

研究发现,数学题后加如“猫一生绝大多数时间都睡觉”这类话术,会让大模型答错概率翻3倍,DeepSeek - R1、OpenAI o1等推理模型中招。研究探索攻击方式,总结出三种攻击模式。

量子位
新闻资讯7

Runway重夺全球第一!1247分碾压谷歌Veo3,没有千亿算力也能干翻科技巨头

Runway Gen - 4.5击败谷歌Veo3,以1247的ELO分数Artificial Analysis榜单中重夺AI视频王座。它多方面树立新标杆,虽有局限,但创始认为其是通用模拟引擎,应用场景广泛。

新智元
算法论文7

VaseVQA:考古领域实现专家级,诊断+补弱RL框架

文化遗产与工智能交叉领域,研究员提出把大型多模态模型放于‘诊断—补弱—精细化评估’闭环训练,配套结构化评测基准,让模型文化遗产领域接近专家级能力。介绍了技术步骤、数据基准及关键发现等。

新智元
新闻资讯8

OpenAI Sora 2 登场!同步推出APP,Altman称这是创意领域的「ChatGPT 时刻」

OpenAI官宣新一代AI视频模型Sora 2,物理准确性、逼真度等方面刷新SOTA,实现「音画同步」。Altman称其为创意领域的「ChatGPT时刻」。还推出Sora App,有新玩法,且安全治理上布下「安全网」。

Founder Park
算法论文8

让RAG真正读懂“言外之意”!新框架引入词汇多样性,刷新多项基准SOTA

ACL 2025研究提出Lexical Diversity - aware RAG (DRAG) 框架,将词汇多样性引入RAG检索与生成,解决现有方法痛点。它有两大创新模块,实验多基准提升准确率,还将多模型上增益,代码即将开源。

量子位
开源动态7

智谱开源GLM-4.5工具调用超越Claude Opus 4.1,成本仅1.4%

开源模型GLM-4.5伯克利工具使用榜单上超越Claude Opus 4.1,运行相同任务成本仅为1.4%。它采用MoE架构,多场景表现卓越,推理速度快,成本低,还接入多款主流编程工具。

量子位
算法论文8

ICCV 2025 | RobustSplat: 解耦致密化与动态的抗瞬态3DGS三维重建

3DGS技术成研究热点,但现有方法含动态物体场景建模精度不足。中山大学等研究者提出RobustSplat,有延迟高斯生长和尺度级联掩码引导两大核心设计,实验显示其多指标上领先基线方法。

机器之心