「内部工具开发」共找到 3383 篇相关文章
南科大教授余沛源创业做AI+材料:真正难的不是生成,而是验证
南科大教授余沛源创业成立三向纪元,构建可验证材料模型。他认为AI+材料研发难在验证,当下是产业化窗口期,中国有优势,初创企业与大厂各有优劣,公司有独特技术与商业模式。
Anthropic求锤得锤!Mythos 2被曝雪藏,Mythos 3正秘密研发
SemiAnalysis内部播客爆料,Anthropic新模型Mythos 2训练完成却被雪藏,正用其生成数据研发Mythos 3。Anthropic曾呼吁监管,如今自食其果。此外,OpenAI的Astra也因安全问题暂停部分活动。
长程任务飙升98%,斯坦福Skill原生LLM来了
普林斯顿、CMU、斯坦福、牛津等提出Skill-Native大模型,提出Skill Entropy度量技能切换难度,搭建Skill²-Bench评测,还将熵用作训练信号提出Skill-Entropy RL,提升多模型准确率,且技能熵可复用。
突发,Claude首破黎曼猜想新纪录!
Anthropic让内部研究版Claude证明「黎曼猜想」失败,但它将符合猜想的黎曼Zeta函数零点比例下限从41.6%提升到67.2%。此成果意义重大,标志AI进入开放数学研究。
OpenAI新模型让数学家集体破防?一场关于数学未来的精神危机
OpenAI下一代主要模型Astra内部版本在多数学领域给出十项新研究结果,让数学界震动。数学家看法不一,有人惊叹,有人迷茫,还有文章指出这或引发数学学科意义的精神危机。
王炸!模型越接越乱,2.9 万 Star OmniRoute 把 290+ 个 AI 供应商压成一个入口
现在接入AI工具麻烦,换模型要改配置,额度、接口等也有问题。OmniRoute是开源AI Gateway,将多家模型供应商统一到一个入口,支持290+ providers等,可解决接入混乱问题。
刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段
DeepSeek在官方API文档给出thinking mode和tool call结合样例,把模型中间思考过程成Agent系统需管理部分。关键字段`reasoning_content`从调试信息成协议流程一部分,影响状态管理、多模型适配等。
翁荔最新博文深度拆解Scaling Laws:AI行业最信赖的公式,没有那么可靠
6月24日,前OpenAI安全研究副总裁翁荔在博客发表长文,对缩放定律进行系统梳理,指出该理论在实际拟合和外推过程有易被忽视的陷阱,还讨论了数据有限时定律是否成立等问题。
马斯克悄悄改了战场:Grok Build 0.2.60 剑指 Agent Runtime
2026年6月21日,Grok Build发布0.2.60版本更新,未推新模型能力,而是聚焦Runtime细节,针对会话难恢复、长任务易卡住、工具输出易污染上下文等痛点优化,让Agent更稳定可靠。
Claude Code 修了几个小 bug,却揭开了 Agent 落地的大麻烦
Anthropic给Claude Code发的更新,看似是修小bug,实则指向AI编程产品正从“模型会不会写代码”转向“Agent能否稳定完成任务”,暴露了工具状态、权限边界等执行问题。