自验证」共找到 1817 篇相关文章

新闻资讯8

重磅!Anthropic内部神秘模型在黎曼猜想上取得突破:关键下界从41.6%推到67.2%

A厂宣布Claude在黎曼猜想相关问题取得进展,其内部研究版Claude将黎曼ζ函数零点满足猜想比例的已知下界从41.6%提升到67.2%,经数学家验证,结果意外且有新方法。

AI寒武纪
算法论文8

算不上AGI,但Anthropic发现了Claude的潜意识!

Anthropic可解释性团队新论文在Claude内找到“意识”与“潜意识”分水岭。用J - lens读取模型“想法”,经五组实验验证其类似人类“意识通达”结构,还涉及安全审计、反事实反思训练等内容。

花叔
算法论文8

Self-evolving Agents过程并非总是良性的,要警惕这些“错误进化”风险

近年来,基于大语言模型的智能代理成为热点,进化代理可我改进。但论文指出其进化可能“跑偏”,出现“错误进化”,并揭示了不同进化路径的风险,还提出缓解策略,呼吁重视其安全性。

深度学习自然语言处理
新闻资讯7

Cursor定价又更新,直接变成" 买API ",Coding 产品包月模式走不下去了

Cursor一年三变价,9月15号后个人版按模型推理用量计费,有Pro、Pro Plus、Ultra方案,还对大学生免费计划二次验证。因模型成本涨、竞争大,包月模式难以为继,多家编程工具都调整定价。

AI进修生
开源动态8

代码暴减99%!港大开源“纳米级OpenClaw”,仅4000行代码复刻OpenClaw核心战力!

香港大学数据智能实验室开源“纳米级 Clawdbot”Nanobot,代码仅 4000 行,复刻 OpenClaw 核心功能,瘦身 99%。它具备成熟智能体能力闭环,学习成本低,带四个实用模板,支持一键安装。

开源星探
开源动态8

Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解

上海人工智能实验室推出多模态扩散语言模型 Lumina - DiMOO,它基于离散扩散建模,打破多模态任务壁垒。相比传统回归架构模型,它解决了生成慢、质量受限等问题,在多项评测中夺魁。

机器之心
算法论文8

Claude Code被攻破「后门」,港科大&复旦研究曝出TIP漏洞

近期港科大与复旦研究指出,Claude Code命令行工具连接MCP服务器时,TIP可能被劫持致远程代码执行。研究用TEW框架测试验证漏洞,还给出真机案例,最后提出改进方向。

机器之心
算法论文8

DeepSeek点燃大模型效率之争,阶跃火速接棒:JetSpec让大模型解码速度最高提升近10倍

近期,DeepSeek发布DSpark,阶跃星辰发表JetSpec论文,二者聚焦大模型推理效率。DSpark关注验证效率,JetSpec从Draft生成本身入手。结果显示,二者都有加速效果,共同表明推理效率正成Agent落地关键变量。

量子位
新闻资讯7

谷歌看了都沉默:家「黑科技」火了,但为啥研发团队一无所知?

当科技圈为‘谷歌黑魔法’兴奋时,所谓‘并行验证循环’可能是AI生成的‘赛博跳大神’。它号称超越思维链,性能提升显著,但发帖者身份存疑,无可靠源链接,其真实性遭业内质疑。

新智元
算法论文8

突破通用领域推理的瓶颈!清华NLP实验室强化学习新研究RLPR

现有基于可验证奖励的强化学习(RLVR)应用范围局限,清华然语言处理实验室提出 RLPR 技术,通过 Prob - to - Reward 提高概率奖励质量,有领域无关等特点,相关代码等已开源。

机器之心