自主智能测试」共找到 5117 篇相关文章

产品应用8

GLM-5正式发布,744B参数,对标Claude

GLM-5正式发布,对标Claude,参数从355B扩至744B,预训练数据增加。采用GlmMoeDsa架构,部署成本降低。数据表现佳,在多测试中成绩亮眼,还能直输Office文档,部署支持多框架和国产芯片,早期反馈积极。

AI工程化
开源动态8

NVIDIA重磅开源!OmniVinci 仅 9B 模型就拿下多模态冠军!

英伟达推出全模态大语言模型 OmniVinci,架构有三大创新。OmniVinci - 9B 模型表现亮眼,多测试中大幅超 Qwen2.5 - Omni,且训练量仅为其六分之一。其架构经多阶段流程实现全模态理解,还支持多种功能。

带你学AI
算法论文8

Codeforces难题不够刷?谢赛宁等造了个AI出题机,能生成原创编程题

LiveCodeBench Pro团队推出AutoCode框架,利用LLM自动化竞赛编程问题创建与评估。该框架结合验证器 - 生成器 - 检查器框架与双重验证协议,在测试用例生成上可靠性佳,还能生成新问题,同时揭示了LLM在创作上的优劣势。

机器之心
新闻资讯8

刚刚,奥特曼预言:人类「只剩」最后5年!

奥特曼接受采访时预测,到2030年AI将全面超越人类,届时或诞生攻克量子引力难题的超级智能。他认为人们应关注任务变化,人类关怀有存在价值,且AI要与人类价值观对齐。同时,OpenAI开展巨额算力基建。

新智元
开源动态8

超越DeepSeek-R1,数学形式化准确率飙升至84% | 字节&南大开源

字节跳动Seed团队与南京大学联合发布CriticLean框架,将数学自然语言到Lean 4代码的形式化准确率从38%提升至84%。该框架创新性地将评估模型置于核心,解决语义对齐等问题,还构建了相关基准测试和数据集。

量子位
产品应用8

西门子不造机器人,为什么机器人进厂的故事里总有它?

本文以西门子南京工厂人形机器人试工案例切入,剖析西门子不生产机器人,却依托开放生态平台Xcelerator连接上下游伙伴,解决工业机器人进厂落地的各类痛点,推动具身智能落地真实工业场景的业务逻辑。

量子位
新闻资讯8

一个「流浪」数学家的遗产,正在被AI公司疯抢

2026年,OpenAI等公司用AI解决多个匈牙利数学家Paul Erdős提出的问题,震动数学界。这些问题分布广、难度跨度大,适合模型测试。不过,AI证明的验证和人类数学家地位受关注。

机器之心
新闻资讯7

提前实测Opus 5:3D细节封神,然而有一个致命缺陷

全网苦等Opus 5,结果其暂缓发布,理由是怕威胁人类对高级AI的控制,遭网友怒批。部分开发者提前实测,它3D细节表现出色,但耗token且看图测试翻车,原定有诸多强大特性。

新智元
新闻资讯7

5亿买一个域名,这个币圈狠人,想让你60秒拥有自己的AI贾维斯

币圈狠人Kris Marszalek豪掷7000万美元购入AI.com域名,打破人类域名交易纪录。他坚信这是通往AGI的入场券,想借此推个人AI智能体,构建去中心化网络,但此举是豪赌还是愚蠢仍未知。

新智元
新闻资讯8

全球TOP 13战队翻车实录!机器人极限求生,比科幻片还残酷

第五届ATEC科技精英赛线下赛,13支精英战队机器人在真实世界极限挑战中状况百出。比赛打破舒适区,考验机器人行走、操作等能力,暴露了环境感知、智能决策、硬件算力等技术瓶颈。

新智元