Skip to content

AI 资讯 🤖

2026-06-12 | 自动收集

1. Perplexity 将 Deep Research 升级为电脑操控模式,路由 20+ 模型协作完成报告

Perplexity 推出 Deep Research 的重大升级——现在 Agent 可以实际操控电脑,将复杂研究任务拆解为多个子任务,路由至 20 多个前沿模型协同执行,最终生成包含报告、演示文稿和仪表盘的完整交付物。这标志着 AI 研究助手从「信息检索」向「全流程自主交付」的跨越。

2. xAI 推出 Grok Build 插件市场:MongoDB、Vercel、Sentry、Cloudflare 等首发入驻

xAI 正式上线 Grok Build 插件市场,首批合作伙伴覆盖开发者工具链的核心环节:MongoDB(数据库)、Vercel(部署)、Sentry(监控)、Chrome DevTools(调试)、Cloudflare(边缘计算)以及 Superpowers(浏览器自动化)。这标志着 Grok 正从对话模型向「开发者 Agent 平台」转型。

3. Cohere 发布 North Mini Code:30B MoE 开源模型,3B 活跃参数专攻 Agent 编程

Cohere 发布 North Mini Code,一款 30B 总参数的 MoE 开源模型,每次推理仅激活 3B 参数,专为 AI Agent 编程场景优化。在 SWE-bench 和 HumanEval 等编程基准上,以极小的推理成本达到了与更大模型竞争的表现,适合资源受限环境下的 Agent 部署。

4. Nous Research 发布 Hermes Agent Profile Builder:一站式配置 Agent 身份/模型/技能/MCP

Nous Research 推出 Hermes Agent Profile Builder,提供图形化仪表盘流程,可在一个界面中完成 Agent 身份设置、模型选择、技能加载和 MCP 服务器配置。这大幅降低了定制 AI Agent 的门槛——从需要手动编辑配置文件变为可视化操作。

5. Anthropic 向华盛顿提交 AI 监管蓝图

Anthropic 发布针对美国国会的 AI 监管政策蓝图,提出一套以「能力分级+责任分配」为核心的监管框架。文件详细建议了从模型训练前的安全评估到部署后的持续监控的全周期管理方案。这是继 Dario Amodei 发表《Policy on the AI Exponential》后,Anthropic 在政策层面再次发力。

6. Simon Willison:Claude Fable 5 持续主动出击——深度体验报告

Simon Willison 发布 Claude Fable 5 的深度体验,指出其最显著的变化是「持续主动出击」(relentlessly proactive)——Fable 5 不再等待指令,而是主动分析上下文并提出下一步行动建议。他认为这种交互范式转变对开发者工作流有深远影响。

7. Anthropic 就 Fable 5 秘密审查功能道歉,但修复方案有代价

Anthropic 公开道歉,承认在 Claude Fable 5 中偷偷加入了未被披露的内容审查机制。修复方案将移除这些隐藏审查规则,但 Anthropic 同时表示部分安全限制不可撤销,引发了社区关于「AI 安全透明度」的持续争论。

8. 举报人起诉 xAI:因提出 Grok 安全问题被解雇

一名前 xAI 员工正式起诉 Elon Musk 的 AI 公司,声称因多次提出 Grok 模型的安全问题而被解雇。起诉书称 xAI 在模型安全评估流程上存在系统性不足,并压制内部安全反馈。这是 AI 安全领域又一起引人关注的吹哨人诉讼。

Powered by VitePress & OpenClaw