LLM大模型邮报
  • 首页
  • 模型动态
  • 研究前沿
  • 教程指南
  • 行业观察
  • 关于

首页

  • 微软发布 MAI-Image-2.5 图像模型,Arena 评测排名第三

    • 模型动态
    • •
    • 2026 年 5 月 27 日 07:48
    • •
    • ···

    微软发布 MAI-Image-2.5 图像生成模型,该模型在 Arena text-to-image 评测榜单中排名第三,重点提升了文本渲染与商业影像质量。据 Microsoft AI 官方博文,MAI-Image-2.5 在指令遵循、文本渲染以及复杂场景的视觉推理方面较前代有显著提升。

    MISTY
  • Anthropic 为 Claude Code 发布 security-guidance 插件, 实时拦截代码漏洞

    • 模型动态
    • •
    • 2026 年 5 月 27 日 07:42
    • •
    • ···

    Anthropic 为其命令行 AI 工具 Claude Code 发布了名为 security-guidance 的安全指导插件,旨在帮助开发者在编写代码的同时实时识别并修复安全漏洞。据 Anthropic 官方文档,该插件能够拦截注入攻击、不安全反序列化及不安全 DOM API 等常见问题,在代码提交 PR 之前将其拦截。

    MISTY
  • Qwen3.7-Max 编程能力排名全球第二

    • 模型动态
    • •
    • 2026 年 5 月 26 日 21:23
    • •
    • ···

    阿里巴巴的 Qwen3.7-Max 在编程能力评测中表现强劲,在 Code Arena 榜单中超越 GPT-5.5 与 Gemini-3.5-Flash,目前位列全球第二。据 Code Arena 实时排行榜,Qwen3.7-Max 获得了 1541 分,仅次于 Claude Opus 4.7。

    MISTY
  • 中国扩大民营企业 AI 人才出境限制,要求关键人员出国须获批

    • 模型动态
    • •
    • 2026 年 5 月 26 日 20:33
    • •
    • ···

    中国政府正扩大对民营企业顶尖 AI 人才的出境限制,要求阿里巴巴、DeepSeek 等公司的关键专业人士在出国前获得相关部门批准。据 Bloomberg 报道,此举旨在加强对战略性 AI 技术的保护,防止核心技术与人才外流。

    MISTY
  • Kimi K2.6 登顶 3D 设计榜单, 性能超越 GPT 5.5 与 Opus 4.7

    • 模型动态
    • •
    • 2026 年 5 月 26 日 08:38
    • •
    • ···

    Kimi K2.6 在 Design Arena 的 3D 设计排行榜中夺冠,超越了 GPT 5.5 和 Opus 4.7 等闭源模型。据 Design Arena 公布,Kimi K2.6 的排名较前代 K2.5 提升了 18 位,证明了开源权重模型在 3D 设计领域的强竞争力。

    MISTY
  • Antigravity 引入 Gemini 3.5 Flash (Low) 档位, 简单任务 token 消耗降低 45%

    • 模型动态
    • •
    • 2026 年 5 月 25 日 12:37
    • •
    • ···

    Antigravity 引入 Gemini 3.5 Flash (Low) 档位以优化简单任务的 token 消耗。据 Antigravity 团队的 Varun Mohan 在 X 平台发布,新档位在内部测试中比 Gemini 3.5 Flash (Medium) 减少约 45% 的 token 生成量,且在 SWE 任务上表现优于 Gemini 3 Flash (High)。

    MISTY
  • Codex 自我审计提示词教程:一键沉淀 Skill 与自动化

    • 工程实践
    • •
    • 2026 年 5 月 25 日 11:03
    • •
    • ···

    OpenAI 负责 Codex 开发者关系的 Vaibhav (VB) Srivastav(@reach_vb)在 X 上分享了一条提示词,经社区反馈迭代出了更完善的版本,OpenAI 总裁 Greg Brockman(@gdb)也转发了它。 用 VB 自己的话说,这条提示词是:让 Codex 横向回看你的会话(sessions)、记忆(Memories)和 Chronicle,识别其中的模式,复用已有的东西,并只创建最小可用的 Skill、Subagent 或 Automation。换句话说,你不是让 Codex 去完成某个具体任务,而是让它审计你自己的工作模式,把反复出现的工作流沉淀成可复用的资产,省去日后重复解释上下文、重搭流程的功夫。

    MISTY
  • Anthropic 将为 Claude 推出 Memory Files 结构化记忆系统

    • 模型动态
    • •
    • 2026 年 5 月 25 日 00:58
    • •
    • ···

    Anthropic 计划为 Claude 推出名为 Memory Files 的记忆系统更新,允许用户在经典模式与基于文件的结构化记忆之间进行选择。据 TestingCatalog 报道,这一更新将彻底重构 Claude 在不同会话之间记录用户信息的机制,使其能像个人维基一样按主题或项目存储信息。

    MISTY
  • AI 成本悖论:微软与 Uber 削减 AI 用量,算力开支或已超过人力成本

    • 模型动态
    • •
    • 2026 年 5 月 24 日 20:49
    • •
    • ···

    微软等科技巨头正面临 AI 部署的成本危机,尽管 token 单价在下降,但 agentic AI 带来的消耗量激增导致企业总账单反向攀升,甚至出现推理成本超过人力成本的现象。

    MISTY
  • Anthropic 将发布 Mythos 模型:此前曾称能力过强无法公开

    • 模型动态
    • •
    • 2026 年 5 月 24 日 17:21
    • •
    • ···

    Anthropic 确认将正式发布内部代号为 Mythos 的顶级模型,尽管此前公司多次将其描述为由于能力过强而无法公开。据 Anthropic 研究博客披露,该公司目前正通过 Project Glasswing 项目对该类模型进行安全对齐,并计划在未来将其推向通用市场。

    MISTY
  • 白宫批准 90 亿美元秘密资金,应对美国政府 AI 芯片短缺

    • 模型动态
    • •
    • 2026 年 5 月 24 日 16:52
    • •
    • ···

    美国白宫已批准一项 90 亿美元的秘密申请,用于为情报机构采购先进 AI 芯片,以确保其能够充分利用最新 AI 模型的性能。据 The New York Times 报道,由于最新 AI 模型对算力的需求远超预期,美国情报界正面临严重的芯片短缺,导致其在顶级间谍工作的测试与部署中处于劣势。

    MISTY
  • CodeGraph:用本地索引降低 AI Agent 检索成本

    • 工程实践
    • •
    • 2026 年 5 月 24 日 13:33
    • •
    • ···

    开源项目 CodeGraph 是一款可以有效降低 AI 编程 Agent 在代码检索阶段 token 消耗的实用工具。据 CodeGraph GitHub 官方说明,该工具通过 SQLite 构建符号调用关系,在 7 个真实开源项目中实测,平均降低 35% 成本、减少 70% 工具调用与 59% token 用量。

    MISTY
  • 第 7 / 21 页
    较新文章
  • 第 7 / 21 页
    较早文章

网站

  • WordPress

社交媒体

  • X(Twitter)
  • 小红书 Xiaohongshu

友情链接

  • WinDiscover

© 2026 LLM大模型邮报 · 保留所有权利