等变建模」共找到 8416 篇相关文章

新闻资讯7

数学题干带猫AI就不会了!错误率翻300%,DeepSeek、o1都不能幸免

研究发现,在数学题后加如“猫一生绝大多数时间都在睡觉”这类话术,会让大模型答错概率翻3倍,DeepSeek - R1、OpenAI o1推理模型中招。研究探索攻击方式,总结出三种攻击模式。

量子位
开源动态8

准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了

OpenHands 团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。

机器之心
推荐文章7

当 AI 开始重写负载,数据库该如何重新设计?

AI正改写数据库命题,新数据对象进入生产链路,AI Agent带来更复杂任务链路。在腾讯云数据库DBTalk上,三位研究员从不同方向探讨当负载被AI改写,数据库该如何重新设计,包括内核优化、资源管理和测试测评方面。

InfoQ
开源动态7

Stripe 发布基准测试:AI 智能体可开发集成方案,但校验环节存在短板

Stripe推出基准测试套件,评估AI智能体构建完整Stripe集成方案的能力,测试聚焦金融系统贴近生产环境的集成场景。测试显示,不同任务类型评测结果差异显著,核心瓶颈在于验证环节,当前智能体短板在校验逻辑方面。

InfoQ
7

突发|Andrej Karpathy官宣加入Anthropic!

周二晚间,Andrej Karpathy在X上自宣加入Anthropic,将在核心预训练团队工作。他是AI领域极具影响力人物,曾任职OpenAI、特斯拉。此次加入或助推Anthropic上市,也让OpenAI面临压力,或引发新一轮AI军备竞赛。

机器之心
算法论文7

AI游戏生成迎来「机制觉醒」:可自我进化的玩法设计师

文章指出当前大模型生成游戏存在玩法创新不足、评分虚高问题。CreativeGame技术关注此问题,通过先写设计文档、激发创意、设计记忆架构方式,让AI围绕机制持续迭代,探索可解释、可追踪、可迭代的创作范式。

AI科技评论
算法论文8

DeepSeek刚解决了AI视觉最后一块拼图:极低成本+精准视觉定位,AI接管电脑已无死角

DeepSeek放出新论文《Thinking with Visual Primitives》,解决多模态大模型中长期被忽视的“说不清位置”问题。提出将空间标记作为“最小思维单元”插入推理链条的方案,在多个任务上达前沿水平,但也存在精度、触发机制和泛化能力局限。

AI寒武纪
推荐文章8

/phodal-writer:如何把十年写作经验整理成一个 Skill

作者Phodal分享将十年写作经验整理成写作Skill的过程。指出用AI写作输出不稳定,问题在于未将写作决策工程化。经样本整理、模式提取、规则改写步骤,形成可复用的写作系统,强调其可放大经验可迁移性。

phodal
新闻资讯7

卡帕西都整破防了:AI Coding没门槛,可部署环节真嗯啊的难

AI Coding界明星卡帕西公开吐槽,代码不再是AI编程瓶颈,部署才是。他以自己开发「菜单图片生成器」的经历为例,指出部署环节问题频发。他认为应让AI调用和配置,还推荐了Stripe Projects优化产品。

量子位
新闻资讯7

程序员面试天:Meta 破例允许在编程面试中使用AI

Meta允许求职者在编程面试中使用AI,这一决定与Amazon科技巨头不同。扎克伯格对AI编程很有热情。网友看法不一,Meta回应称此举合理,还计划在招聘中更广泛用AI,强调人际交流仍是面试一部分。

AGI Hunt