智能测试用例生成系统」共找到 4835 篇相关文章

算法论文8

推理token减少46%!Meta新方法缩短思维链,告别重复推导

Meta等联合提出元认知复用机制,让模型总结解题思路,提炼为“行为”存于“行为手册”。实验显示,该机制在数学基准测试中显著优化,保持准确率时最多减少46%推理token使用量。

量子位
新闻资讯8

重磅!Claude Sonnet 4.5发布,可连续编程30小时,Claude Code同款构建工具也开放了

Anthropic发布Claude Sonnet 4.5,官方称是全球最强代码、复杂智能体构建及擅用计算机的模型。伴随产品全家桶升级,还开放Claude Code构建工具,发布Imagine with Claude。该模型能力强且更安全。

AI寒武纪
新闻资讯8

李飞飞押注的3D世界模型黑科技,被这篇论文一次性扒光!

李飞飞创业公司World Labs发布空间智能模型成果,推出Marble平台。本文分享3D、4D世界模型技术综述,系统梳理原生表示的世界模型,给出分层分类法、数据集与评测指标,并开源维护。

PaperAgent
新闻资讯7

Copilot强塞马斯克Grok新模型,遭开发者集体“抵抗”!GitHub内部工程师曝:我们是被“胁迫”的

微软旗下 GitHub 深化与 xAI 合作,将 Grok Code Fast 1 整合进 Copilot。但 GitHub 内部举报人指其安全测试不足、团队被‘胁迫’。此引发开发者‘抗议’,部分要求撤销合作,也有人看好合作价值。

AI前线
新闻资讯7

小扎高薪挖来的人又跳回OpenAI了!首席科学家赵晟佳也要回去

扎克伯格高薪挖人组建Meta超级智能实验室,对标OpenAI和Google DeepMind。但刚挖来的人有回流,老员工也出走,涵盖多岗位。重组致管理混乱,华尔街质疑720亿美元AI投资回报。

量子位
产品应用8

很多创业者都没意识到,Deep Research 也是做 Go-to-Market 的利器

用好 Deep Research 可提升 AI 产品 GTM 效率,主流 AI 产品都有该功能。前 Meta 战略总监写实用指南,从技巧、提示词公式、工具选择等阐述,还给出 5 个 GTM 用例及提示词模板。

Founder Park
开源动态8

百川开源医疗增强大模型 Baichuan-M2:更符合中国临床诊疗场景,可 4090 单卡部署

百川智能发布并开源医疗增强大模型 Baichuan-M2,以更小尺寸反超 OpenAI 新模型。它可 4090 单卡部署,成本低,在 HealthBench 评测表现佳,免费开源,更适配中国临床诊疗场景。

InfoQ
算法论文8

打破传统游戏逻辑!Google | 提出Concordia ,通过Mutil-Agent构建游戏引擎!

Google DeepMind和多伦多大学研究人员提出Concordia软件库,用AI驱动智能体担任GM,基于「实体 - 组件」架构,让工程师和设计师分工,可灵活构建复杂游戏场景,还支持不同交互动态和多种使用动机。

AINLPer
新闻资讯7

疯狂……韩国开发出强大的核灾难处理人形机器人。丑,但实用

韩国原子能研究院正开发用于核灾难响应和废料处理的人形机器人,目标是能举200公斤重物。与其他机器人相比,其举重能力优势明显。不过在真实核灾难现场应用还需长期测试

AGI Hunt
算法论文7

The Batch:826 | 提高输出准确性的记忆层

通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员在transformer架构加可训练记忆层,可高效存储提取信息,提升计算效率,测试显示其能提升模型输出质量。

DeeplearningAI