「通用推理技术」共找到 5010 篇相关文章
图像编辑模型不止生成:BIGAI&上交大提出EAR范式,系统测试其视觉规划能力
上海交通大学联合北京通用人工智能研究院提出EAR范式,构建AMAZE基准,分析图像编辑模型视觉推理能力。研究发现模型零样本表现弱,扩散式模型更适合视觉规划,CoT效果不稳定等。
吴恩达:图灵测试不够用了,我会设计一个AGI专用版
AI大神吴恩达2026年要做新的图灵-AGI测试,弥补AGI定义无统一标准、现有基准测试易误导大众的空白。该测试聚焦AGI经济性和实际产出,能更好衡量AI通用能力。
1万亿参数Ling-1T开源,国产LLM牛了~
Ling-1T是Ling 2.0系列首款旗舰“非思维”模型,总参数量达1万亿。预训练数据超20万亿token,支持128K上下文长度。在多项任务中表现出色,是目前已知最大的FP8训练基座模型,已完成全面评测。
中国光芯片迎来“迈向高端”黄金窗口期
近期光芯片领域热度攀升,政策、产业、资本利好。AI算力爆发使光芯片从‘通信管道’升级为‘战略性资源’,需求大增但供给端短板凸显。本土产业链分层,高端赛道迎来突破窗口期,有三条主流技术路线。
“十五五”时期中国芯片三个着力点
中国集成电路产业近十年‘自主可控’取得阶段性成果,但也面临风险挑战。‘十五五’时期,产业应推动供应链从自主到全球融合赋能、创新链从跟随到技术主权觉醒、产业链从脱节到全链协同共振。
医疗AI迎来大考!南洋理工发布首个LLM电子病历处理评测 | AAAI'26
南洋理工大学研究人员构建EHRStruct基准,涵盖11项核心任务、2200个样本,用于评测LLM处理结构化电子病历的能力。研究发现通用大模型优于医学专用模型,提出的EHRMaster框架与Gemini联合后性能超现有模型。
台积电CoWoS的接班人:CoPoS
台积电将CoPoS定位为CoWoS下一代接班人,计划取代CoWoS - L。它用面板尺寸基板替换硅中介层,突破现有技术限制。目前已启动试点线验证,预计2027年小规模生产,或成高端芯片封装主流。
15亿美元AI独角兽崩塌,全是印度程序员冒充!微软亚马逊惨遭忽悠
Builder.ai自称用AI简化软件开发,吸引微软、软银等巨额投资,估值超15亿美元。但实际靠人工冒充AI,创始人虚报营收。丑闻曝光后投资被冻结,公司破产,引发AI交易技术尽职调查讨论。
突发!阿里Qwen深夜地震,林俊旸官宣「下台离开」
深夜,Qwen负责人林俊旸宣布离开Qwen团队,未透露去向和接任者。他是阿里最年轻P10技术高管,跨学科背景,在阿里6年连升四级,推动Qwen开源模型发展,还关注AI未来。
Anthropic 新研究:AI出错是“热混乱”
Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。