「通用能力」共找到 3715 篇相关文章
AI版盗梦空间?Claude竟能察觉到自己被注入概念了
Anthropic最新研究发现LLM有内省迹象,Claude能察觉概念注入。研究用概念注入测试,虽模型内省能力有限且不可靠,但能力强的Claude Opus 4和4.1表现好,未来内省或更复杂。
超10万亿Tokens的高质量数据集是怎么炼成的?专访中国电信天翼AI阮宜龙
中国电信天翼AI打造超10万亿Tokens高质量数据集,依托星辰MaaS平台构建“数据—模型—服务”闭环。其与研究院推进技术研发并落地产品,建“三全”星辰大模型体系,还在多行业展现应用价值。
百度搜索变天了:怎么搜索你们定
百度 App 搜索框大改版,升级为智能框,支持多模态输入,降低使用门槛。还推出多项功能,如百看、智能创作、深度搜索等,接入 MCP 服务,推动产品能力多方面转变,探索新盈利模式。
大模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion
上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。
Claude 吞噬整个AI编程栈?“Vibe Coding 公司的最大错觉是以为自己有护城河”
近日网友爆料Anthropic开发类似Lovable功能,可构建全栈应用。此前Claude Code源码泄露,展示其构建软件开发全流程“执行层”能力。AI编程进入“大收割时代”,模型厂商吞噬工具趋势显现,Lovable等平台护城河受挑战。
告别人工干预!KDD Cup 2026 Data Agents 赛道:定义下一代数据智能体能力边界
KDD Cup 2026 发布 Data Agents for Complex Data Analysis 赛道,由香港科技大学(广州)和清华大学联合承办。旨在推动 AI 告别人工干预,具备自主任务分解等能力,还推出 DataAgent - Bench 测试平台,有丰厚奖励,公布关键时间节点。
从Token到词元:全模态时代的基模与交互入口
2026年3月24日国家数据局确立“词元”为Token标准译名,Token生成与消耗方式在多模态场景正发生变化。模思智能获数亿融资,探索从语音到全模态的路径,成果颇丰且完成能力闭环,其发展受关注。
「被动感知」到「理解接触」!它石智航重磅发布OmniVTA视触觉世界模型
它石智航联合六大顶尖机构推出OmniVTA视触觉操作框架和OmniViTac大规模视触觉数据集。该框架核心是从被动感知到主动预测触觉,通过多模块协同让机器人有预测、理解和修正能力,实验表现优。
GLM-5深夜登场,这是国产开源模型首次逼平Claude Opus 4.5。
GLM - 5深夜发布且开源,参数量从355B扩展到744B,跑分仅次于顶级模型,开源排第1。能力逼近Claude Opus 4.5,BrowseComp基准得分超普通GPT - 5.2。价格便宜,是国内可用且性价比高的大模型。
斯坦福×英伟达发布AI推理新范式,刷新了多领域SOTA
斯坦福与英伟达联合发布论文 TTT - Discover,提出新范式,不追求通用,在推理阶段针对特定难题修改模型参数。它战绩辉煌,但成本高、是偏科生且需打分器,其出现是技术与哲学的突破。