成本性能」共找到 6965 篇相关文章

新闻资讯8

扒光谷歌Gemini 2.5:一份官方“翻车报告”,揭露AI Agent的8个秘密。

谷歌DeepMind发布Gemini 2.5技术报告,以玩《宝可梦 红/蓝》为例,展示构建有效智体的案例。该系统架构由多部分组,但运行状况百出,如上下文过长变差、产生幻觉等,也有亮点,还提炼避坑方法。

探索AGI
产品应用8

实测 Seed 2.1:豆包基模超进化,国产模型力跨过质变点

作者在做面向 Agent 项目时,因 Claude Code 内存开销大,需更轻方案。火山引擎 Force 大会发布 Seed - 2.1,作者实测其在办公、编程、图像理解等方面表现出色,认为它跨越质变点,将赋国内 AI 生态圈。

特工宇宙
新闻资讯7

突发!微信绝密「龙虾」爆出,14亿用户体验或将颠覆

据The Information报道,腾讯正为微信秘密研发全新AI智体,项目高优先级、绝密,或从去年上半年开始酝酿。若与微信生态打通,将全球最大AI智体落地场景。Meta则收购Moltbook,抢建AI智体社交图谱。

新智元
产品应用8

录屏扒代码、截图改网页!Kimi K2.5把「视觉x代码」玩明白了

Moonshot AI推出最强Agentic模型Kimi K2.5,发布后热度起飞。它实现多功一体化整合,具备设计审美,支持可视化编辑,推出编程工具Kimi Code。在多项测试中表现优异,还在办公领域发挥作用,其智体集群提升了效率。

量子位
新闻资讯7

AI祛魅之后:2026年将是AI脱下华丽外衣并穿上工装的一年

2026年AI将从概念验证迈向产业深处,展现实用价值。行业焦点从构建大模型转向让AI好用,还会从依赖算力扩张过渡到研究新架构。小模型崛起、智体互联标准化、世界模型构建及物理智落地趋势。

AIGC开放社区
算法论文8

NIPS 2025 Spotlight | 港大提出TreeSynth方法,一句话生百万规模数据集

港大团队提出TreeSynth方法,受决策树启发,将数据合问题映射到其空间分割机制。它采用两阶段流程,从零合数据,还可优化现有数据集。实验显示其在多基准任务上性提升显著,可扩展性佳。

机器之心
新闻资讯7

DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜

DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案解决核心挑战,实验证明NVFP4在大规模训练中可行。

机器之心
产品应用7

十万个人类,在这个AI小镇里做赛博上帝。

港科大研发的Aivilization(AI小镇)是容纳十万AI智体的虚拟世界,玩家创造AI小人并像上帝般指令观察。游戏画风治愈,但大家拼命卷,还呈现了如现实般的赚钱玩法及不同生活态度。

数字生命卡兹克
新闻资讯7

翁荔创业大模型首秀!告别“120亿美元估值0模型”

Thinking Machines Lab发布首个模型TML - Interaction - Small,联合创始人翁荔演示。该模型让实时交互原生力,响应延迟比GPT - realtime - 2.0快4倍,解决了多数AI“回合制”问题,还介绍了实现机制和公司过往情况。

量子位
产品应用7

Claude 开始收“代码审核税”:一条 PR 25 美元,大厂一年或花百万,还得上交整个代码库

3月9日,Anthropic推出代码审查产品Code Review,运行在GitHub和CI流程,按token计费,每次15 - 25美元,速度约20分钟/次,用整个代码库分析。虽发现问题,但价格贵、速度慢,还遭“既当运动员又当裁判”质疑。

InfoQ