「计算机操作能力」共找到 3753 篇相关文章
AI版盗梦空间?Claude竟能察觉到自己被注入概念了
Anthropic最新研究发现LLM有内省迹象,Claude能察觉概念注入。研究用概念注入测试,虽模型内省能力有限且不可靠,但能力强的Claude Opus 4和4.1表现好,未来内省或更复杂。
百度搜索变天了:怎么搜索你们定
百度 App 搜索框大改版,升级为智能框,支持多模态输入,降低使用门槛。还推出多项功能,如百看、智能创作、深度搜索等,接入 MCP 服务,推动产品能力多方面转变,探索新盈利模式。
大模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion
上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。
现在,你可以在手机上用AI生成一个APP了。
作者参加百度Create 2026 AI开发者大会,介绍百度秒哒。它是能帮开发产品的Agent,虽与顶级产品有差距,但全链路适配、对国内生态友好。大会上线APP版,能直接生成安装包,操作简单,解锁普通人创造力。
Claude 吞噬整个AI编程栈?“Vibe Coding 公司的最大错觉是以为自己有护城河”
近日网友爆料Anthropic开发类似Lovable功能,可构建全栈应用。此前Claude Code源码泄露,展示其构建软件开发全流程“执行层”能力。AI编程进入“大收割时代”,模型厂商吞噬工具趋势显现,Lovable等平台护城河受挑战。
告别人工干预!KDD Cup 2026 Data Agents 赛道:定义下一代数据智能体能力边界
KDD Cup 2026 发布 Data Agents for Complex Data Analysis 赛道,由香港科技大学(广州)和清华大学联合承办。旨在推动 AI 告别人工干预,具备自主任务分解等能力,还推出 DataAgent - Bench 测试平台,有丰厚奖励,公布关键时间节点。
从Token到词元:全模态时代的基模与交互入口
2026年3月24日国家数据局确立“词元”为Token标准译名,Token生成与消耗方式在多模态场景正发生变化。模思智能获数亿融资,探索从语音到全模态的路径,成果颇丰且完成能力闭环,其发展受关注。
GLM-5深夜登场,这是国产开源模型首次逼平Claude Opus 4.5。
GLM - 5深夜发布且开源,参数量从355B扩展到744B,跑分仅次于顶级模型,开源排第1。能力逼近Claude Opus 4.5,BrowseComp基准得分超普通GPT - 5.2。价格便宜,是国内可用且性价比高的大模型。
AI被严重低估!AlphaGo缔造者罕见发声:2026年AI自主上岗8小时
AlphaGo作者Julian发声,指公众对AI认知落后,低估其进展。实验室里AI已能完成复杂任务且指数进化。研究显示AI能力逼近专家,2026年或可自主工作8小时,2027年或超人类。也有人质疑趋势可靠性。
GPT-5刚刚正式发布,首次面向免费用户开放
OpenAI正式发布GPT - 5,有架构统一、性能大幅提升、全用户开放三大核心变化。测试数据显示性能进步明显,采用新定价策略面向所有用户开放。但演示未带来突破感,编程能力还面临Claude Opus 4.1挑战。