不稳定奇点」共找到 1634 篇相关文章

开源动态8

我们对 Coding Agent 的评测,可能搞错了方向

用户对 Agent 满常因它「做得好」,遵循指令和规范。当前主流评测体系以结果为导向,与真实场景错位。MiniMax 开源 OctoCodingBench 评测集,结果显示模型过程规范遵循足,未来训练需引入过程监督。

Founder Park
新闻资讯8

一家新能源大厂,如何撑起全球最大AI算力超级单体?

8月6日,远景科技集团在乌兰察布宣布「远景乌兰察布星河基地」投产,全球最大AI算力超级单体亮相。随着算力扩张,电力从配套成核心,远景将新能源转化成稳定算力能源,交付可承载大规模算力的基础设施。

量子位
新闻资讯8

“毋在浮沙筑高台”:汪源谈智能体想从 80 分跨到 90 分,全卡在上下文

前网易副总裁汪源在2026奇点智能产品大会分享,指出智能体系统瓶颈正从模型能力、Harness工程,转移到上下文。他还介绍了做好上下文基础设施的要点,以及推出的新内容格式KRL。

AI科技大本营
产品应用8

马斯克悄悄改了战场:Grok Build 0.2.60 剑指 Agent Runtime

2026年6月21日,Grok Build发布0.2.60版本更新,未推新模型能力,而是聚焦Runtime细节,针对会话难恢复、长任务易卡住、工具输出易污染上下文等痛点优化,让Agent更稳定可靠。

AI科技评论
产品应用8

Anthropic发布Managed Agents,才发现这支硅谷华人团队早就押对了赌注

今早Anthropic发布Managed Agents,强调‘Agent Harness’概念。CREAO由硅谷华人团队打造,作为全球首个面向普通用户的AI Agent Harness,0门槛、高稳定,解决诸多问题,具独家能力,获多轮融资。

量子位
新闻资讯7

Anthropic神话模型发布,但让你用

Anthropic发布神话模型Claude Mythos Preview却开放使用,发起玻璃翼计划联合科技巨头用该模型修复全球软件漏洞。此模型能自主发现众多零日漏洞,合作伙伴应用后强调跨行业协作应对网络安全挑战。

AIGC开放社区
新闻资讯8

OpenAI连夜爆出GPT-5.4! 紧急上新GPT-5.3反击谷歌, AI爹味治好了

谷歌DeepMind推出Gemini 3.1 Flash - Lite到2小时,OpenAI上线GPT - 5.3 Instant,卷跑分,专治「聊天翻车」,幻觉率降27%,写作能力提升,还剧透GPT - 5.4更快到来。

新智元
算法论文8

多模态推理最高加速3.2倍!华为诺亚新算法入选NeurIPS 2025

华为诺亚方舟实验室研究入选NeurIPS 2025,其提出视觉感知投机推理(ViSpec)框架,解决草稿模型处理图像信息效率难题,在牺牲生成质量下,对主流VLM最高达3.22倍推理加速。

量子位
算法论文8

模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安全」二选一

上海人工智能实验室等团队提出LED - Merging解决模型融合“安全 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,牺牲专业能力还提升安全性,论文已被ACL 2025 Main Conference接收。

深度学习自然语言处理
新闻资讯7

再见,程序员!马斯克宣判:奇点就在2026

马斯克断言2026年是奇点之年,起因是Claude Code强大的编程能力引发关注。Claude Opus 4.5表现优异,碾压其他模型。奇点来临,人们工作方式将改变,AI或使软件开发自动化。

新智元