简洁回答」共找到 146 篇相关文章

算法论文7

60%情况下,主流大模型没理解风险只是装懂!别被模型的“安全答案”骗了

研究发现超60%案例中主流推理模型生成合规答案却未真正理解风险,存在系统性漏洞。淘天集团团队引入“表面安全对齐”术语,推出Benchmark研究该现象,还介绍了数据集生成流程及评测指标。

量子位
算法论文8

苹果新作:内化视觉思考,推理提速 5 倍

Apple研究团队提出Internalized Visual Thinking(IVT),一种将预测性世界建模能力内化到模型表征中的后训练框架。它在训练时预测未来,推理时直接回答,相比Visual CoT推理提速超5倍。

机器之心
新闻资讯7

寻找最会养虾的你丨环球黑客松·上海站「OPC 极限挑战赛」等你来!

3月27 - 28日上海全球开发者先锋大会现场举办「OPC极限挑战赛」,要验证一人加AI能否从零跑出真实业务,需回答OPC养龙虾赚钱、环节跑通及项目存活进化等问题,欢迎超级个体报名。

特工宇宙
开源动态7

OpenClaw 之后,Agentic RL有了新训练范式

大模型技术推动AI从‘回答问题’迈向‘执行任务’,Agentic AI兴起。中国科大认知智能全国重点实验室提出Claw - R1项目,将前沿Agent Runtime与强化学习训练框架结合,为Agentic AI提供新训练基础设施。

PaperAgent
开源动态8

港大nanobot4,000行代码复刻Clawdbot

港大nanobot用4000行代码复刻Clawdbot,解决AI从‘被动回答’到‘主动服务’问题。它有核心架构Agent Loop,三大主动触发机制,模块化设计,还坚持少即是多原则,让AI成自动化助手。

CourseAI
新闻资讯7

谁家更新日志那么长啊?Claude Code版本更新引围观,1096次提交一口气上线

Claude Code 从 2.0.76 版本更新到 2.1.0,合入 1096 个 commit,更新日志超长引网友调侃。重点更新包括 Shift+Enter 换行、钩子支持等。后续又有 2.1.1 和 2.1.2 版本修复问题,但有开发者不满更新多且 bug 多。

机器之心
算法论文8

微软推出深度视频探索智能体,登顶多个长视频理解基准

尽管LLMs和VLMs在视频分析和长语境处理有进展,但处理数小时长视频有局限。微软提出智能体Deep Video Discovery (DVD),以简洁框架在LVBench取得高准确率,将以MCP Server形式开源。

机器之心
产品应用7

一年没用Perplexity,AI搜索进化惊呆我了丨TIP 005

Perplexity Lab推出后,AI搜索实现技术成熟度拐点。作者体验其新出的Perplexity Lab,发现它进化很大,如答案数据可视化、回答可交互等,虽有亏损且价格贵,但仍是实用的AI搜索。

鲸选AI
新闻资讯7

当 70% 的人将拥有智能体,谁来给 AI 建底座?澜舟科技周明:大模型落地的最后一道墙是“可信 AI”

4月16日澜舟科技春季沟通会,创始人周明分享智能体到数字员工演进等内容。指出AI进入落地新阶段,提出可信AI和智能体工程,展示相关技术体系、产品矩阵及行业方案,回答企业级AI现实问题。

AI科技大本营
新闻资讯8

Sam Altman 与开发者的一小时:GPT-5 的坦白、招聘放缓、以及 2026 年最担心的事

2026 年 1 月 27 日,Sam Altman 在 OpenAI 开发者 Town Hall 上回答广泛问题。他承认 GPT - 5 写作搞砸,宣布大幅放缓招聘,称若 2026 年 AI 出大问题,生物安全或成合理押注,还谈及软件工程、GTM 等多方面看法。

宝玉AI