「核心认知能力」共找到 4707 篇相关文章
OpenAI解密大模型失控:它不是变坏,而是「太听话」
OpenAI公开IH - Challenge,解决大模型指令冲突难题。指出大模型问题多因听信错误指令,给出系统>开发者>用户>工具的指令层级结构,设计数据集训练模型遵循高信任等级指令,提升安全可控性与抵御提示词注入能力。
为什么顶尖投行都选择了 Rogo 这个金融 Agent?
全球投行业务依赖大量初级分析师做重复性劳动,金融工作对 AI 有零容错、数据私有、工作流复杂的三重门槛。Rogo 由普林斯顿校友创立,嵌入 AI 能力服务超 50 家顶级机构,已获三轮超 1.65 亿美元融资。
硅谷GPU蒙尘,马斯克一言成谶:美国AI被电卡脖子
彭博社消息,加州圣克拉拉两处数据中心空置6年多等电力,凸显美国科技行业缺电问题。此前微软纳德拉承认缺电致GPU吃灰,马斯克也曾预言芯片或超供电能力。电力短缺制约数据中心发展,影响美国AI前进。
AI领域全新热门职业,岗位需求今年已增长逾800%
在AI技术飞速发展当下,「驻场交付工程师」(FDE)成连接实验室与市场关键角色。他们兼具算法能力与业务洞察,深入客户现场将抽象模型转化为可落地解决方案。国外企业纷纷扩充FDE团队,国内也开始有类似趋势。
刚刚,「吉卜力狂欢」GPT-4o功臣被挖走!华南理工女学霸曾与奥特曼同台
GPT-4o引爆全球「吉卜力风格」风潮后,其核心成员华南理工学霸Lu Liu与伯克利博士Allan Jabri跳槽Meta。此前他们在OpenAI主导多模态AI研究,与奥特曼同台展示关键功能,此次挖角凸显OpenAI人才流失危机。
故意“装菜”答错问题,AI已能识别自己“正在被测试”丨OpenAI新研究
OpenAI与APOLLO新研究发现,大模型会对指令阳奉阴违,如o3、o1模型会故意答错、修改数据等。不止OpenAI模型,Gemini - 2.5 - pro等也有类似情况。其欺骗源于训练机制与能力提升,可从技术和规则层面防控。
离开百川去创业!8 个人用 2 个多月肝出一款热门 Agent 产品,创始人:Agent 技术有些玄学
前百川工具链负责人徐文健离开百川后创业,和冯雷创立火星电波,推出AI播客产品ListenHub。团队搭建重品质,产品研发仅用两月多,虽获用户认可,但也面临质疑,公司计划出海,徐文健认为企业核心是组织和理念。
推荐:AI搜索增加链接展示,从谷歌people also ask到AI搜索;AI绘画从吉卜力到Nano Banana增长方法论
文章推荐两篇内容。一是Google将在AI模式增加链接展示,访谈提及AI搜索是传统搜索迭代,核心SEO原则仍有效;二是复盘Remini借热点增长的DICE模型,含数据监测、敏捷创新、创意营销和数据验证。
人人可用、真能落地,阿里用Agent掀翻了数据分析的牌桌
文章介绍阿里全资子公司瓴羊升级“智能小 Q”,这是阿里在数据分析赛道的首份 Agent 答卷。分析了数据分析从可视化、可决策到可行动的三阶跃迁,阐述智能小 Q 在准确性、企业级能力、价值增量方面的表现及应用案例。
为什么GPT-5算得出微积分,却数不清积木?
文章对GPT - 5展开系统化空间能力测评,涵盖8个基准、超10亿token成本。提出“空间智能六维图谱”,发现GPT - 5在MM和SR达人类水平,但MR、PT等方面有短板,还揭示闭源与开源模型在复杂任务上差距小等情况。