为旌科技」共找到 4994 篇相关文章

新闻资讯7

GPT-5准确率不足40%!北大发布多模态、高难度化学基准SUPERChem

北大团队发布多模态、高难度化学基准SUPERChem,构建评估大语言模型化学推理能力新体系。测试显示,GPT - 5准确率仅38.5%,与低年级本科生相当,且模型在高阶推理有短板,该基准模型优化指明方向。

新智元
新闻资讯7

颠覆算力格局!全球首个星座级太空AI算力服务,在中国诞生

第四届琶洲算法大赛中,国星宇航与佳都科技联手推动「慧行·AI上星」实验,标志国星宇航成全球首个提供常态化星座级太空算力商业服务公司,验证太空算力承载行业应用可行性。

新智元
算法论文8

仅用提示词工程摘下IMO金牌!清华校友强强联手新发现,学术界不靠砸钱也能比肩大厂

清华校友杨林和黄溢辰,仅用提示词设计和自我迭代验证流程,让基础模型Gemini 2.5 Pro达到IMO金牌水平。他们设计的流程分六个步骤,用差异化提示词,最终5道题生成严谨解答。

量子位
算法论文8

生成式视角重塑监督学习!标签不只是答案,更是学习指南 | ICML 2025

上海交大等机构团队在ICML 2025提出预测一致性学习(PCL),通过扩散过程消减标签信息,引入噪声标签,将标签学习分解渐进式任务,实现标签信息复用。在多模态任务实验中,PCL表现优于传统监督学习。

量子位
新闻资讯7

AI教父Hinton:曾了儿子卖身谷歌,如今担心AI 会毁灭人类

AI教父Hinton曾给有学习障碍的儿子攒钱,将神经网络公司卖给谷歌。在谷歌他意识到AI可怕,离开后成AI风险大声疾呼者。他既担忧AI危害,也描绘了人类与AI共生的美好愿景。

AGI Hunt
算法论文7

无需人类插手!AI战队自主进化,人类玩家瑟瑟发抖

论文《Agents of Change: Self - Evolving LLM Agents for Strategic Planning》以桌游《卡坦岛》“考场”测试AI战略能力。研究团队设计四代AI特工,实验显示能自我进化的AI完爆静态AI,不过也存在计算成本高、依赖基础模型等问题。

深度学习自然语言处理
新闻资讯7

黄仁勋129亿买下AI圈GitHub!Hugging Face守了10年的独立没了

英伟达黄仁勋宣布以129.303亿美元收购Hugging Face,这是英伟达史上最大整体收购。此前Hugging Face曾拒绝英伟达5亿美元入股,如今求发展选择被收购。英伟达借此掌控开源AI分发,承诺平台开放,但开发者利益存变数。

新智元
产品应用7

Anthropic总想摔碎程序员饭碗,甩出了“以后只招两种人”名单。

昨天Anthropic发布新产品Claude Tag,被Karpathy赞LLM交互第三范式。Claude Tag与之前的Claude Code远程插件有4方面差别。产品负责人Fiona Fung分享,Anthropic人均代码交付量剧增,招人只看两类人。

探索AGI
产品应用8

让问题不过夜:交易领域“问诊”Agent实践

文章针对研发支持中的痛点,构建智能Agent系统,将问题抽象业务答疑与问题诊断两类能力。介绍了系统架构、构建演进、知识体系、质量评估等内容,还展示实战成效,指出当前边界与下一步方向。

阿里云开发者
新闻资讯8

一副手套,干翻硅谷炫技派!中国队杀入战场,狂卷100万小时数据

硅谷具身智能玩家数据发愁,中国灵初智能另辟蹊径,用数据手套采集工人操作数据,成本低且数据泛化性强。其专注物流细分场景,2026年收敛资源做深现有场景,目标推100万小时数据训练模型。

新智元