「数据任务」共找到 4111 篇相关文章
苹果把OpenAI窃密细节全部暴露!但草台班子拼音都搞错了…
苹果与OpenAI窃密大战更新,苹果提交初步禁令申请及相关材料,指控OpenAI员工多次蓄意窃密。OpenAI回怼,称苹果虚构协商叙事,其指控无据,还质疑苹果权限管理。此前马斯克也曾起诉OpenAI。
100%开源!吴恩达做了个个人桌面Agent
AI教育大佬吴恩达推出开源项目OpenWorker,这是个个人桌面Agent,能跨工具干活。它主打开放、本地优先、隐私保护和模型无关,目前可在Mac运行,Windows版本待完善。
Karpathy刚进Anthropic,转头又投了它
AI初创公司Engram成立8个月,估值达6亿美金,获9800万美元融资。它聚焦AI记忆,用Cartridges技术降内存、提速度,将推理和记忆层拆开,团队成员背景强大,押注AI范式新转向。
小模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源
微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。
OmniWork:面向创作者的 Agent OS
文章介绍了面向创作者的 Agent OS OmniWork,它的 Agent 围绕专业方向定制,Expert 和 Skill 可自行创建,能多 Agent 协作。通过实例展示其从热点捕捉到生成 BP、文章创作等功能,还介绍了底层逻辑,适合创作人群。
有人只用API就猜出了GPT、Claude、Gemini的参数量?社区吵翻了
研究人员李博杰在arXiv发布论文,提出“不可压缩知识探针”评测框架,仅通过黑盒API调用逆向估算LLM参数规模,给出GPT-5.5等模型参数量估算,引发社区广泛讨论与争议。
穿越100年前打造的AI,不知道二战和互联网,却从几个例子学会了Python
前OpenAI研究成员等打造出130亿参数的时代语言模型talkie,只用1930年前英文词元训练。它不知二战等现代信息,能从例子学Python,风格似20世纪绅士,研究团队将扩大其规模。
腾讯大模型动作慢了吗?姚顺雨带着Hy3 preview杀进第一梯队
国内大模型发展迅速,腾讯此前动作较慢。姚顺雨加入后推动变革,混元团队重建推出Hy3 preview,有295B总参数和快慢思考融合架构,开源且性能优,在多方面表现出色,成本下降。
超越Claude Mythos和GPT-5.5!斯坦福Agent验证框架拿下SOTA,Transformer作者转发
斯坦福、伯克利与英伟达联手打造LLM-as-a-Verifier验证框架,该方法是通用验证机制,可与任意Agent Harness和模型结合。研究表明扩展验证阶段计算量,能提升Agent整体性能,在多基准测试中超越Claude Mythos和GPT - 5.5。
蚂蚁技术研究院副院长吕乐当选美国医学与生物工程院(AIMBE)Fellow
美国医学与生物工程院(AIMBE)公布2026届Fellow入选名单,蚂蚁集团技术研究院副院长吕乐博士当选。该机构Fellow评选是领域最高荣誉之一,仅授予全球前2%顶尖人才。吕乐在医疗AI贡献突出。