「AI模型性能」共找到 14034 篇相关文章

新闻资讯7

Anthropic把Claude送去当店长,结果AI疯了~

周末,Anthropic开展“Project Vend”实验,让Claude 3.7 Sonnet在旧金山经营小卖部。实验为期一个月,AI老板Claudius业绩不佳,亏损严重,还出现“发疯”等不可预测行为。Anthropic会继续优化它。

探索AGI
新闻资讯7

100亿美元押注AI:红杉换帅后,寻找“白天鹅”

2026年8月,红杉资本募得约100亿美元。新掌舵人林君睿和帕特接受专访,称当下是“白天鹅”市场。此前红杉经历领导层更替,新团队调整投资决策,还补仓Anthropic,布局AI多环节。

DeepTech深科技
新闻资讯7

Nano Banana爆火之后,一个神秘的「胡萝卜」代码模型又上线了

OpenAI草莓命名引发潮流,Recraft小熊猫、谷歌Nano Banana等跟进。现Anycoder平台出现神秘代码模型Carrot(胡萝卜),能力强,网友对其归属猜测不断。

机器之心
算法论文7

AI穿越战争迷雾,72%的准确率化身中东冲突预言家

阿联酋和美国研究人员用中东冲突测试AI推理表现,发现其能看透利益博弈、预判战局演变。AI擅沿客观限制推演,在经济领域敏锐,政治领域较难,整体预测准确率达72%。

AIGC开放社区
开源动态8

Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解

上海人工智能实验室推出多模态扩散语言模型 Lumina - DiMOO,它基于离散扩散建模,打破多模态任务壁垒。相比传统自回归架构模型,它解决了生成慢、质量受限等问题,在多项评测中夺魁。

机器之心
开源动态8

DeepSeek开源的文件系统,是如何提升大模型效率的?

2月28日,DeepSeek开源高性能分布式文件系统3FS以解决人工智能训练和推理挑战。介绍了分布式文件系统优势,深入解读3FS的组件、CRAQ协议等,还探讨其与其他系统差异及性能相关问题。

机器之心
产品应用8

以「场景」定义算力:AI时代,通用算力不只“通用”

当AI狂欢席卷全球,阿里云和AMD通过‘一芯三用’重新定义AI时代算力选型逻辑,从‘参数崇拜’回归‘业务本质’。联合发布三款基于AMD Zen 5架构‘Turin’处理器的全新ECS实例,精准匹配不同业务场景需求。

InfoQ
算法论文8

拒绝计算“一视同仁”!Elastic Attention:让大模型学会“看人下菜碟”

现代大语言模型用全注意力机制计算复杂度高,现有混合注意力策略是静态的。为此提出Elastic Attention,引入轻量级Attention Router,具备动态路由等亮点,在主流模型测试中效果好。

深度学习自然语言处理
新闻资讯7

Agent 元年,小厂碎步快跑反超

2025 年被视为 Agent 元年,AI 从“助手”走向“员工”。飞猪“问一问”出圈,虽小厂在模型、技术上不占优,但 AI Agent 落地门槛降低,小厂抓住场景和体验,或在 AI 时代弯道超车。

AI科技评论
新闻资讯7

Chrome危!AI浏览器新品大爆发,OpenAI都来抢饭碗

AI时代浏览器成兵家必争之地。英伟达投资的Perplexity推出AI浏览器Comet,OpenAI也将发布。老牌谷歌Chrome难撼动,新势力各有亮点,国内市场争夺也愈发胶着。

量子位