非编码任务」共找到 2804 篇相关文章

开源动态7

AI 还在装失忆?1 万 Star 开源 EverOS 有点东西,把 Agent 记忆塞进 Markdown

EverOS 是 EverMind - AI 开源的项目,有 10325 Star。它给 AI Agent 等提供 local - first 长期记忆运行时,把记忆源头放 Markdown 里,以 SQLite 和 LanceDB 管理和检索。介绍了其优势、链路、适用场景等。

小华同学ai
推荐文章8

模型不是企业的护城河,那什么才是?

文章指出企业AI进入深水区后,真正的竞争是将AI变成企业自己的智能引擎。衔远科技创始人周伯文提出泛化基础上的深度专业化是企业竞争力来源。衔远发布EnterpriseClawBench,揭示企业需私有化评估和可持续进化能力。

量子位
推荐文章7

读博最后一年转方向,拿到OpenAI offer:我的面试之路充满「意外」

布朗大学博士生Yong Zheng - Xin自宣下月加入OpenAI做AI安全研究。他博士最后一年转方向,分享求职经历,总结6个意外洞察,如求职重要的可能仅一两篇论文、面试形式多样等。

机器之心
7

Anthropic顶级Claude模型被逆向开源,这几个模块借鉴了DeepSeek

22岁开发者逆向开源Anthropic的Claude Mythos Preview模型架构,名为OpenMythos。其核心模块借鉴DeepSeek,采用带混合专家路由机制的循环Transformer,有独特设计和稳定机制,重新框定扩展性争论。

PaperAgent
产品应用8

Claude Code 推出 /Ultraplan,超级计划模型

Claude Code 推出 `/ultraplan` 功能,在写代码前提供可视化方案,可编辑、审批。还发布了 Claude for Word 集成微软 Office 套件。Anthropic 迭代快或因内部使用更强的 Mythos 模型。

AGI Hunt
算法论文8

CVPR 2026|AI开始会拍电影了:一分钟十镜头,全程不崩剧情

多镜头视频生成要求模型处理不同镜头间稳定信息和变化信息,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,建立跨镜头记忆机制,设计关键模块,实验表现好,为视频生成打开新可能。

机器之心
开源动态7

走出 MMLU 的高分幻觉:AI Agent 的「斯坦利时刻」与职场生存法则

文章指出多模态大模型在基准测试分数高,在实际业务流程却像‘职场巨婴’。研究团队构建Trainee - Bench测试顶尖模型,结果显示模型离‘独立上岗’远,凸显提升Agent自主学习性的重要性。

AI科技评论
推荐文章8

“每给 Claude Code 提一个请求,我就点上一根烟,放松下”

OpenFGA 核心维护者 Siddhant Khare 写博客吐槽使用 AI 编程的‘疲惫感’,指出 AI 带来职业疲惫却被行业回避,还分析了原因,如任务量膨胀、角色转变等,并给出应对建议,引发工程师共鸣。

InfoQ
算法论文7

最新研究!大模型“角色扮演”无效了?

沃顿商学院研究测试6个主流AI模型,进行超25000次测试,发现告诉AI扮演专家角色,不会让其回答更准确,反向设定‘低知识’角色有时表现更好,角色扮演不是提高准确性的万能钥匙。

AI工程化
算法论文8

GPT-5都救不了的AI幻觉,原来问题不在模型,在“考卷”

OpenAI研究指出AI产生幻觉的根本原因是评估和激励机制有问题。现有训练和评估流程奖励‘猜测’,导致模型易产生幻觉。研究还给出解决方案,要更新‘考试规则’,让模型适当表达不确定。

AIGC开放社区