推理时纠错」共找到 2622 篇相关文章

产品应用8

天选Windows打工AI来了!实测完Claude Cowork国产版:超顶

硅谷Claude Cowork出圈后,国产昆仑万维Skywork桌面版登场。它支持模型自由切换、海量Skills集成,实测任务完成率高、速度快、有自纠错机制,依托上下文能力升级,是国产AI创新力量的展示。

量子位
产品应用8

一个全新的世界模型,终于让AI视频进入了“无限流”代。

AI视频公司PixVerse推出实世界生成模型PixVerse R1,用户可输入Prompt修改视频进程,无干涉视频会自行延续。该模型为世界模型补上实视频生成方向,实测体验乐趣十足。

数字生命卡兹克
新闻资讯7

AI编码工具变 “格式化神器”?Claude CLI半年频当“系统杀手”,多位开发者痛斥:心血都没了!

近日Reddit上一则对Claude CLI的控诉帖引发关注。一位开发者用其清理软件包,整个Mac系统被清空。类似情况并非个例,‘删库’成AI工具通病,开发者需强化安全操作意识。

InfoQ
产品应用7

谷歌Nano Banana 2 来了,图片AGI提前到来?

伴随Gemini 3、GPT 5.1小道消息,谷歌Nano Banana 2提前到来。它采用多步骤生成流程,有自我纠错循环,能替代部分Photoshop功能,在细节、配色等方面比一代提升明显,即将正式上线。

探索AGI
新闻资讯7

GPT-5的所有传言,以及,Sora 2?

OpenAI今晚1点举办直播,GPT - 5将亮相。发布前关键信息汇总,包括直播长变长、GitHub泄露四个版本、三档定价策略、突破人类基准测试等,还或同步发布Sora 2。

AGI Hunt
产品应用8

华为版《黑客帝国》首次亮相:训推复杂AI前先“彩排”,小级预演万卡集群

华为首次亮相数字化风洞虚拟环境平台,可在训推复杂AI模型前“彩排”,小级预演万卡集群。其包含Sim2Train、Sim2Infer、Sim2Availability,分别解决训练、推理、高可用问题。

量子位
新闻资讯7

爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?

第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,结果意外,仅做出一题,DeepSeek R1 挂零。不同模型架构表现差异不大,暴露出大模型做算法题短板,推理模式表现更好。

InfoQ
算法论文7

AI让全人类思维越来越雷同!南加大研究实锤:认知多样性正在被抹平

南加州大学论文指出,AI正让全人类想法和表达同质化,体现在语言、视角和推理三方面。原因包括训练数据有偏差、训练目标求稳、人们过度依赖。研究人员虽在想办法,但效果有限,呼吁勿无节制依赖。

量子位
算法论文7

The Batch: 896 | 教会模型说出真相

大型语言模型有会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规能‘自白’。通过强化学习训练,测试显示微调模型在多项评测中多能承认问题,自白机制可监控模型行为。

DeeplearningAI
开源动态8

华为推出软工代码智能体SWE-Lego,解锁SFT训练极致性能

华为研究团队推出仅基于监督微调(SFT)的软件工程代码智能体SWE-Lego,无需复杂RL流程,在SWE-bench Verified基准中表现出色,项目已开源。它有数据、训练和测试扩展三大创新。

机器之心