「超算Colossus 2」共找到 3764 篇相关文章
7个AI玩狼人杀,GPT-5获断崖式MVP,Kimi手段激进
OpenAI总裁转发基准测试,让7个LLMs玩210场狼人杀。GPT - 5胜率96.7%断崖式领先,国产Qwen3和Kimi - K2分列第4、6。测试方分析模型性格,还借此研究LLMs社会行为,长远目标是实现AI驱动的市场研究。
VLNVerse“宇宙降临”:吴琦团队交出2025具身导航最终答卷
自2018年吴琦团队发表首篇VLN论文后,领域碎片化问题凸显。2025年末其推出全栈平台VLNVerse,涵盖场景生成、物理模拟、任务基准和通用模型,欲打通Real2Sim2Real,推动VLN向Embodied VLN跨越。
180亿深圳芯片黑马,华为猛下单
4月25日晚,云天励飞公告2024年营收超9亿,同比增81.3%,截至4月28日收盘市值超180亿。该公司以‘算法芯片化’为基础,在推理算力、行业赋能、消费级业务均有布局,还与华为等合作。
具身智能本体的重要性和技术差距,可能被大大低估了
目前,具身智能发展的讨论多聚焦模型和数据,而本体易被忽视。灵御智能凭借高性能本体在‘申智杯’夺冠,其灵御TA2机器人受关注。文章从多维度剖析本体重要性,并介绍了灵御TA2的优势。
5.1K Star!Codebuff 把整个 AI 编程团队装进你的终端!
Codebuff是开源AI编程助手,获超5.1k stars。其多智能体架构让不同智能体分工协作,理解代码上下文更好、编辑更准。官方测试中完成率61%,超Claude Code。它免费且上手简单,还能创建自定义智能体。
The Batch: 969 | 谷歌的机器人模型有了腿
谷歌发布 Gemini Robotics 2(GR2),能将相机图像和文字指令转为机器人关节控制命令,可同时控制人形机器人腿、躯干、手臂和手部,简化模型训练和设计,不过谷歌未公布其基础模型等信息。
Qwen拿半成品刷下AIME'25满分,给别人留点面子吧……
开源之王Qwen的Qwen3“超大杯”推理版虽为早期预览版,仍在训练中,但已在AIME 25和HMMT25达100%准确率,超GPT - 5系列。该预览版可在Qwen Chat免费试用,API已上线阿里云。
李开复入场Agent!零一万物推出“万仔”,直接对话CEO走独特“一把手工程打法”
今早,李开复宣布零一万物升级万智平台2.0并推出企业级Agent智能体。他指出AI Agent正重构企业架构,零一万物采用“一把手工程打法”,万智2.0有五大功能,还预计了AI Agent三个演进层级。
英伟达叫板DeepSeek?怒投260亿美元,要打造最强开源模型
英伟达已成为人工智能时代基础设施的一部分,2023年11月推出首个Nemotron模型进入通用大模型领域。未来五年将投260亿美元构建开源模型,还发布了性能最强的开源模型Nemotron 3 Super。
告别高昂重制成本!港科大广州、快手可灵发布立体视频转换单步推理新方案
随着 3D 设备发展,人们对 3D 立体视频需求增加,但高昂制作成本成阻碍。快手可灵与港科大广州团队联合提出 StereoPilot 模型,能快速将 2D 视频转为高质量 3D 视频,还构建了 UniStereo 数据集。