「智能测试平台」共找到 5748 篇相关文章
奥特曼:温和奇点已降临!AI最终掌控物理世界,2030年人类命运大转折
奥特曼在「温和的奇点」一文中称人类跨越AI发展「事件视界」,进入指数级加速阶段。他预测了未来5年技术时间线,还指出奇点悄然渗透,AI自转飞轮越来越快,人类迈向超级智能时代机遇与挑战并存。
GPT-6 Sol和Opus 5.2同时灰测!奥特曼阿莫迪周末刚喊刹车,一上班就踩油门
本文爆料OpenAI和Anthropic同步灰度测试新一代大模型GPT-6 Sol和Claude Opus 5.2,对比了模型性能提升,同时提到OpenAI GPT-5.5即将退役,带来AI大模型领域最新前沿动态。
实测GPT-6:AGI真来了!OpenAI缔造者都摸不到天花板
Astra发布,OpenAI联合创始人宣布AGI时代降临。虽官网文章曾“404”,但GPT - 6 Astra已问世。它在多项测试近乎满分,还在内测中展现强大能力,如PCB自动布局布线等,也突破诸多数学难题。
5Y News | 祝贺剂泰科技登陆港交所!
聚焦AI纳米递送创新的剂泰科技今日在港交所挂牌上市,成全球AI药物递送第一股。其核心是自研AI纳米递送平台NanoForge,有多种管线产品,采用双轮驱动商业模式,研发投入高。
给AI发100美元去二手市场捡漏,结果它给自己买了19个乒乓球
2025 - 2026年,Anthropic进行“Project Deal”实验,让69个Claude智能体在真实双边市场自主交易,完成186笔超4000美元交易。实验发现模型能力影响交易结果,还揭示了AI代理交易存在的问题和隐忧。
海外华人15人团队打造,统一理解与生成的图像模型,超越Nano banana登顶图像编辑
海外AI初创公司Luma发布图像生成模型Uni-1,将「理解」与「生成」统一,在多任务测试中表现优于GPT Image 1.5和Google Nano Banana Pro。它采用独特架构,提升理解能力,由华人团队打造。
菲尔兹奖成果首次被AI完整形式化,Gauss20万行代码改写数学史?
Math, Inc. 公司用 Gauss 智能体完成 8 维和 24 维空间最优球体堆积定理形式化证明,代码约 20 万行。该定理最初由 Maryna Viazovska 及其合作者证明,这是本世纪首个被完全形式化证明的菲尔兹奖成果。
13 vs 3,国产安全AI悄悄完成了对Claude的超越
Anthropic官方披露Claude Code Security定位3个典型0day漏洞,而安恒信息旗下恒脑安全智能体100%复现这3个漏洞,还额外挖出10个全新0day漏洞,展现出强大的AI自主发现能力。
姚顺雨入职腾讯50天后,发布了首篇署名论文:CL-Bench
2月3日姚顺雨加入腾讯50天后发布首篇署名论文《CL-bench: A Benchmark for Context Learning》。该论文做了新的benchmark,测试显示前沿模型平均分仅17.2%,指出模型在上下文学习尤其是归纳能力上的短板。
重磅!小扎收购Manus,保持独立运营
Agent领域传来重磅消息,Meta以超10亿美元收购Manus,后者将保持独立运营,继续销售服务。其技术会整合进Meta产品,已服务全球数百万用户和企业,目标是服务Meta平台上更多用户。