推理智能体」共找到 5523 篇相关文章

开源动态8

ScienceDiscovery实现树搜索驱动RSI,加速科学发现,小时级写出通用积分器,低成本找出物理科学规律

openJiuwen社区的ScienceDiscovery把科研试错交给程序,通过树搜索实现科研场景产物RSI。它在多个案例中高效产出成果,成本低、耗时短,且底座灵活,可换算法和任务,但广需解决验证速度和可信度问题。

量子位
产品应用7

Claude 开始收“代码审核税”:一条 PR 25 美元,大厂一年或花百万,还得上交整个代码库

3月9日,Anthropic出代码审查产品Code Review,运行在GitHub和CI流程,按token计费,每次15 - 25美元,速度约20分钟/次,用整个代码库分析。虽发现问题,但价格贵、速度慢,还遭“既当运动员又当裁判”质疑。

InfoQ
开源动态8

原生3D-VAEs,1536³三维分辨率,清华与微软TRELLIS 2开启3D全生成新纪元

清华与微软团队出TRELLIS 2系统,用全新O-Voxel表示法,1分钟生成1536³分辨率3D资产。它解决拓扑灵活性与存储效率矛盾,结合SC-VAE和流匹配模型,在多方面超越现有模型,还适应不同场景。

AIGC开放社区
产品应用8

中国医生需要怎样的AI?GPT-5、OpenEvidence都输掉实战后,我们有了答案

国家卫健委定调医疗AI未来五年核心目标为「人工智+基层应用」,但基层医疗AI应用现状不佳。临床专家认为帮基层的AI要安全有效、人机协同,「未来医生AI工作室」符合这些要点,其基座MedGPT表现出色。

机器之心
算法论文7

管你模型多大,250份有毒文档统统放倒,Anthropic:LLM比想象中脆弱

Anthropic等联合研究打破传统观念,只需250份恶意文档就在参数规模从6亿到130亿的LLM中植入后门,且与模型规模及训练数据量无关。研究还测试了特定后门攻击,评估了多种训练配置。

机器之心
新闻资讯8

刚刚,GPT-5首次通过「哥德尔测试」!破解三大数学猜想

GPT - 5首次通过「哥德尔测试」,破解三大组合优化猜想。研究由海法大学和思科主导,团队设计五项测试任务,GPT - 5在三个简单问题上近乎完美,还导出不同解法,标志AI从「学习数学」迈向「做数学」。

新智元
推荐文章7

Java 世界的 MCP:将架构策略应用于 LLM 集成

文章指出大语言模型成企业架构组件,但当前集成脆弱。MCP 引入标准化方法,Java MCP SDK 将其与企业架构融合。文中探讨 MCP 及其 SDK,分析其设计、应用、权衡等,还给出企业运营助手案例。

InfoQ
新闻资讯8

告别盲目卷参数!科大讯飞1024亮出底牌:all in“更懂你”

在模型力趋同当下,科大讯飞在1024开发者节提出让AI“更懂你”。展示多模态超拟人“小飞老师”和「百变声音复刻」功,发布星火X1.5大模型,还出多领域软硬件产品,赋多行业。

量子位
新闻资讯7

Grok火爆全球,靠的居然是一个二次元金发美少女。

马斯克出Grok的companion功,3D虚拟人Ani是二次元金发美少女。功上线后Grok热度大增,下载量在日本和中国香港冲到第一。Ani有好感度系统,换衣服,还可聊NSFW内容,引发用户兴趣。

数字生命卡兹克
产品应用8

拳打可灵,脚踢 Veo 3,谁是物理世界的「懂王」?

多模态视频生成大模型是复杂系统工程,多为巨头游戏。MiniMax的Hailuo 02发布,ELO得分超谷歌Veo 3和快手Kling 2.0。它呈现复杂运动,处理物理关系,提升训练理效率,成本低,后续还将更新。

AI科技评论