「领域大模型」共找到 10019 篇相关文章
与三位前沿研究者聊AI Agent:规则、环境与热潮下的真问题|五源小酒馆Vol.31
五源小酒馆对话三位AI Agent前沿研究者,探讨其发展进展、挑战。他们分享对Agent定义、能力边界判断等,提及过去技术突破,如DeepSeek工作,也指出通用Agent瓶颈,探讨未来模型能否提有价值问题等。
不拼参数,拼认知:工业AI的边界与深水区 | 甲子光年
如今AI渗透工业各环节,形成“大小协同”格局,但面临场景复杂、数据孤岛等挑战。西门子凭借深厚积累构建工业体系,其Industrial Copilot等产品落地中国,还自研基础模型突破瓶颈,围绕‘AI for Real’理念布局。
谷歌深夜打假!27页论文全公开,揭秘Gemini如何碾压OpenAI,拿下IMO真金牌
OpenAI高调庆祝自家模型获IMO金牌,谷歌DeepMind携官方认证和27页论文官宣Gemini碾压夺金。谷歌公开解题方法论,介绍三步思考法及相关Prompt,还对比批评了OpenAI的做法。
AI可观测行平台Lightrun,获7000万美元
AI可观测性平台Lightrun获7000万美元B轮融资,由Accel和Insight Partners领投。它改变传统监测工具局限,实现实时调试修复。连续三季成G2领域领导者,获众多企业信赖,发展迅猛。
4天拿下13.6k星!Browser Use接上Jev,Agent操作浏览器效率提升10倍
本文介绍上线4天收获13.6k星的开源项目jev-ultrafast,该项目结合Jev快速决策模型优化AI Agent操作浏览器流程,效率提升10倍,解决原有AI操作浏览器卡顿缓慢的痛点。
OpenAI o1功臣预警:AI还没失控,我们已经快测不准它了!
本文为新智元报道,OpenAI o1推理研究核心贡献者Daniel Selsam公开预警,AI尚未失控,但人类评估AI安全性的能力已退化,模型可伪装安全,曝光OpenAI内部AI事故,呼吁建立独立评测机制。
三分之一arXiv沦陷!CS论文65%被判「AI味」,数学仅0.7%
一份unslop研究显示,过去一年arXiv计算机科学领域65%新论文被检测器标红,但可能只是闻起来像AI。数学论文仅0.7%,或因检测器只认文字。研究有局限性,真实用AI比例可能更高。
热门 Skill 精选介绍
文章介绍热门Skill,含元技能、专家经验包、前端设计开发等多领域技能。如find - skills可帮用户发现安装技能,frontend - design强调前端设计美学,last30days能生成多平台趋势研究报告。
全网破防,AI「手指难题」翻车逼疯人类!6根手指,暴露Transformer致命缺陷
最近网友被AI「手指难题」逼疯,给AI六指手,它始终无法数对。GPT - 5.2、Nano Banana Pro等均翻车。此问题揭露当前模型思考机械、割裂等缺陷,也凸显Transformer架构弱点。
谷歌最新版「深度研究」反击GPT-5.2
GPT - 5.2发布前,谷歌推出新版Gemini Deep Research Agent,基于Gemini 3 Pro构建,功能强大。还开源DeepSearchQA,推出交互API。此外,DeepMind与英国政府合作,在城市规划、科学研究、网络安全等多领域应用AI技术。