「领域特定语言」共找到 2859 篇相关文章
竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500
大语言模型在竞赛编程场景易失败。南大、清华等研究者提出Solvita框架,由四个角色形成闭环,构建可训练图结构知识网络积累经验。实验显示其在多评测中表现强,提升不靠增加token。
诺奖得主和Claude联手发论文,结论是:AI时代更需“笨功夫”
7月,诺奖得主乔治·帕里西与弗朗西斯科·赞波尼发表论文,借助Claude终结困扰领域十二年的猜想。此前帕里西批判AI,此次合作后态度转变,强调人机协作及人类独立思考的重要性。
CVPR 2026 ReSAM:每个目标只标1个点,SAM就能学会分割遥感图像
CVPR 2026收录论文《ReSAM: Refine, Requery, and Reinforce: Self-Prompting Point-Supervised Segmentation for Remote Sensing Images》,提出让SAM每个目标只标1个点,通过R³循环自己生成高质量伪标签训练。在WHU建筑数据集上,1点标注与全监督差距仅1.3%,省99%标注成本。
Claude Science几周干完两年活,10倍科研提速真来了?
2026年6月30日,Anthropic发布Claude Science,定位面向科学家的AI工作台。它将科研拆成可审计流水线,整合工具链,自带可追溯代码,有协调与审查智能体,首落生命科学领域,与Google、OpenAI玩法不同。
今天起,Claude Design要把设计师和程序员变成同一种人了
Anthropic官宣Claude Design大版本更新,有四大亮点,如设计系统一键导入、代码双向同步等。设计师亲自演示新功能,还引出两条新命令。设计工具领域竞争激烈,背后是科技巨头抢占用户入口。
散步那晚朋友说 AI 会让钱变毛,我觉得他抓错了点
朋友认为AI火会让钱贬值,但作者觉得更先发生的是财富搬家。以股市和A股为例说明钱在向特定方向流动,普通人难参与,还指出资产能否被新购买力承认很关键。
腾讯混元CL-bench续作发布,让大模型读懂你的日常生活
腾讯混元团队推出CL - Bench Life,用于精准衡量AI在现实生活中的“上下文学习”能力。测试12个语言模型,结果显示模型处理高噪声零碎context能力不足,揭示当前顶尖AI模型还远未读懂日常。
确认!DeepSeek多模态AI已经开测
DeepSeek研究员陈小康、陈德里确认其V4视觉模式开始灰度测试。更新后出现识图模式,具备真实图像理解能力。陈小康是多模态研究组负责人,陈德里负责语言模型等核心方向,V4可谓满血归来。
成本降九成,准确率100%!MIT反常识架构挑战硅谷信仰
慕尼黑工业大学等研究者指出企业AI落地问题源于数据乱。RUBICON架构用AQL查询语言,把操作权交用户,让LLM在精确范围工作。测试中它准确率100%,成本低,优于现有智能体AI方案。
Anthropic开始抢科学家了?周薪2.7万驻场,专治Claude专家级错误
Anthropic新推出STEM Fellow岗位,招募STEM领域专家驻场三个月,周薪3800美元,用其判断力校准Claude输出质量。其三年来科研路线不断加码,正构建科研生态。AI科研瓶颈是判断力而非算力。