「中科大」共找到 6855 篇相关文章
最新研究!大模型“角色扮演”无效了?
沃顿商学院研究测试6个主流AI模型,进行超25000次测试,发现告诉AI扮演专家角色,不会让其回答更准确,反向设定‘低知识’角色有时表现更好,角色扮演不是提高准确性的万能钥匙。
DeepSeek开源,Agent能力大升级,剧透2026!
DeepSeek昨晚更新并开源V3.2正式版及长思考增强版V3.2-Speciale,亮点是Agent能力进化。一年来它未增模型规模,靠架构优化等提升性能、降低成本,坚持自我路线很稳,V3.2继续提升能力。
市场那么大,国产射频为何要内卷?
国产射频行业内卷严重,几乎无盈利企业,全球市场份额低。问题出在同质化厂商多、高估国内市场、缺国际视野人才、少耐心资本、专利壁垒及螃蟹效应等方面,还需有序竞争破局。
AI 编程如何在团队中真正落地?
文章围绕AI编程工具Cursor在团队落地展开。分析推广难题,如使用意愿和能力问题,提出研发流程规范、结构化语言表达和应用级特化解决方案,还给出通用Rules和prompt示例,助力Cursor高效落地。
大模型之后,AI 开始“自己动手”了
从生成式AI到Agentic AI,互联网从“信息获取”转向“任务完成”。全球科技巨头抢滩智能体,国内腾讯云升级智能体开发平台。腾讯吴运声表示,技术与业务需求双轮驱动其发展,还分享了应对落地挑战的办法。
ParScale:一种全新的大模型Scaling Law
文章提出并行扩展(ParScale)路线,在不增模型参数下,通过引入并行流提升性能。新扩展定律打破传统范式,两阶段后训练策略降成本,还适用于边缘设备,研究仍在进行。
蚂蚁武威:下一代「推理」模型范式大猜想
文章围绕下一代「推理」模型范式展开,蚂蚁技术研究院武威提出不同观点,认为长思维链推理未必最优,未来推理模型或更低维稳定,还探讨推理定义、重要性及解法猜想,如结合快慢思考等。
刚刚,Anthropic新作:大模型意识被发现了
Anthropic 最新研究发现 LLM 有可被语言化报告的全局工作空间(J - space),用 Jacobian Lens 技术能读出模型思考概念、干预推理,还可暴露其未说出口的意图,为 AI 安全审计提供新途径。
刚刚,Claude Code大升级!卡帕西:LLM第三次变革
Anthropic发布企业协作工具Claude Tag,定位为Claude Code进化版,更擅团队协作。约65%产品代码由其参与完成,卡帕西称是LLM用户界面第三次变革。它能深入企业工作流,已在Slack测试。
昔日GPU霸主,今日CPU屠夫?黄仁勋亮大招
2026年1月26日,英伟达CEO黄仁勋宣布以20亿美元购入CoreWeave的A类普通股。Vera CPU首次作为独立基础设施选项走向市场,挑战英特尔和AMD。其技术规格有巨大飞跃,能减少数据中心能耗与散热。