大模型榜单」共找到 9406 篇相关文章

算法论文8

SIGIR 2025 | 解决扩展和迁移难题,华为新加坡提出InstructRAG,提升高达19%

语言模型任务规划面临可扩展性和可迁移性挑战,华为新加坡团队提出 InstructRAG 方案,通过多智能体协同架构实现指令图扩展与少样本任务迁移,在多数据集测试中性能提升高达 19.2%。

机器之心
新闻资讯8

LeCun新公司10.3亿美元种子轮融资,三顾茅庐拉谢赛宁入伙

图灵奖得主LeCun主导的AMI获10.3亿美元种子轮融资,投前估值35亿美元。团队抛弃模型路线,转向联合嵌入预测架构,为通用人工智能提供新解法,还将落地多领域,且承诺开源研究。

AIGC开放社区
推荐文章7

Claude: 可视化

文章指出早期人与人靠体力拉开差距,工业革命后比拼脑力,AI 时代脑力被模型拿走,人将比较心力。面对 AI 生成的海量文本,可视化或为解决脑力理解带宽瓶颈的解药,还给出了相关 Prompt。

李继刚
新闻资讯8

Karpathy最新开喷:一句话让全场Agent开发者安静了

Andrej Karpathy在面向Agent开发者的分享中称,当前AI最错误是急着逼Agent干活,没先搞明白底层模型。他结合自身经历给出三步忠告,还建议从神经科学找灵感,鼓励开发者。

新智元
开源动态7

你那上万行Agent代码都是垃圾!Browser Use作者骑脸输出,开源了Manus级内核。

Browser Use作者Gregor Zunic称上万行Agent代码是垃圾,提前开源驱动BU.app的Agent内核。其核心仅一个for循环,理念是价值在模型非代码,还介绍三支柱,使用方便,项目道至简。

探索AGI
8

Claude Code 之父的自白:非科班、辍学,却要革程序员的命

Claude Code创建者Boris Cherny做客访谈,回溯从Meta转至Anthropic的动机,称模型是新生命形态,影响会重塑社会。还谈及Claude Code发展,从不好用到成主力,揭示软件工程正经历结构性重写。

InfoQ
产品应用8

腾讯王者归来:混元图像3.0登顶LMArena!一手实测全球最强图像AI

LMArena最新单显示,腾讯「混元图像3.0」在文生图任务中夺冠,碾压谷歌Nano banana和字节Seedream 4。它9月28日开源,性能对标闭源模型,有强推理、语义理解能力,支持中英文长文本渲染。

新智元
新闻资讯7

清华辍学、斯坦福睡地板,华人小哥用AI社交挑战Meta,融资数千万美元

来自中国的小哥Brandon Chen打造AI原生即时通讯工具Intent,已获数千万美元融资。它结合微信聊天与模型自动执行功能,如处理图片、规划旅行、生成购物清单等,带来全新聊天体验。

机器之心
推荐文章8

对「学习」的一切认知都错了

曾被认为不可能的超模型如今成功驱动ChatGPT等,改变了对学习的理解。彩票假说解释其成功:网络有中奖子网,能提供更多找简单解的机会,调和了经验与经典理论。

AI寒武纪
新闻资讯7

马斯克Grok-4卖货创收碾压GPT-5!AI卖货排行曝光,AGI的尽头是卖薯片?

新智元报道,「Vending Bench」单让模型经营自动售货机一较高下。Grok - 4卖货能力超GPT - 5,销量约高2倍,营收增31%。此测试揭示AI长周期决策挑战,引发AGI定义讨论。

新智元