「靠谱」共找到 722 篇相关文章
最新风口Harness,李开复、陆奇已重金入场
养虾人面临Token费钱、长程任务不靠谱问题,行业浮现Harness群体多智能体解决方案。OpenAI、Anthropic等顶尖玩家发现需更高约束系统。明日新程获陆奇、李开复投资,李笛团队将推新产品,检验群体智能能否走向C端。
文心X1.1三大能力狂飙,海内外实测还挺惊艳!
9日WAVE SUMMIT深度学习开发者2025大会上,文心大模型X1.1发布,事实性、指令遵循、智能体能力显著提升,多项测试表现佳。它能做到知识一致,精准遵循指令,智能体解决问题出色,代码、数学、多模态能力也有进化,得益于迭代式混合强化学习训练框架。
为什么我不再折腾RAG了
作者曾靠RAG内容获流量,但如今不再关注。一是技术有局限,传统RAG切断知识联系,GraphRAG虽好却未普及;二是RAG能用易、好用难,搭建调试麻烦。作者改用大型工具,还做知识提炼。
AI公司创始人现跑路迪拜!80%收入烧广告、假账骗投资人,微软都被坑:硅谷的第一个AI大泡沫出现了!
AI独角兽公司Builder.ai估值15亿美元,现破产清算。创始人Sachin Dev Duggal跑路迪拜,公司花80%收入宣传,还用假账骗投资。此前就被指无AI能力,靠人工开发。当下虚假AI盛行,多家相关公司涉欺诈。
OpenAI杀疯了!内部神秘模型首次斩获信息学奥赛IOI 2025金牌,碾压98%人类选手
OpenAI研究员官宣其内部研发的AI推理系统在2025年国际信息学奥林匹克竞赛获金牌,超越98%人类选手。该系统在模拟人类环境下靠推理解题,用通用模型,一年间成绩大逆转,近期在多赛事表现出色。
颠覆医学!AI帮助无精男喜当爹,800万扫描找出3个生命火种
全球著名媒体CNN消息,一对饱受18年不孕不育折磨的夫妇,在哥伦比亚大学生育中心用STAR方法,靠AI在精液样本中找到3个精子助妻子受孕。STAR由该中心团队耗时5年研发,为患者提供新选择。
差点被Ilya摁掉,胎死腹中!ChatGPT爆红内幕首次公开
本文深度揭秘ChatGPT爆红内幕,从产品发布、命名内幕到团队文化等方面展开。还提及OpenAI内部对发布的争议,以及ChatGPT发布方式的转变,同时指出依赖用户反馈改进模型存在的问题和OpenAI看重的人才特质。
伯克利斯坦福联手造出「科研预言家」:77%准确率押注研究想法前景
伯克利和斯坦福团队让GPT - 4.1变身「科研预言家」,从顶会提取想法对比案例训练,不借助实验验证,靠推理押注。其在公开题库测试、人类专家团战等测试中表现出色,还能预测AI新点子。
模型一个没换,正确率翻了近三倍,这个项目有点东西啊!
GitHub开源项目AutoResearch用同一模型答题,其EvoMap蜂群模式使正确率近三倍于单Agent和常见Sub - Agent模式。它是多Agent评审系统,靠蜂群机制让AI自动科研,还有诸多防幻觉等特点,能用于多场景优化。
谷歌风雨飘摇,市值蒸发数千亿美元!Gemini Spark能救场吗?
近期谷歌接连流失核心人才,资本市场反应强烈,市值蒸发数千亿美元。同时产品节奏不佳,Gemini 3.5 Pro疑跳票。在此背景下,谷歌推出Gemini Spark,它能跨应用完成任务,但定价遭质疑,谷歌能否靠它破局存疑。