AWS 为 Bedrock AgentCore 推出 AI 智能体 OAuth 同意门户
AWS 在 Amazon Bedrock AgentCore 的 AgentCore Identity 中推出 Consent portal(同意门户),为 AgentCore Gateway 提供托管式网页体验和会话绑定端点。此前客户需自行搭建会话绑定基础设施,现在管理员只需为网关创建门户并分享 URL,用户通过企业 IdP 登录后即可按提供商逐个授权,门
公司与模型 · Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 19:03
AWS 在 Amazon Bedrock AgentCore 的 AgentCore Identity 中推出 Consent portal(同意门户),为 AgentCore Gateway 提供托管式网页体验和会话绑定端点。此前客户需自行搭建会话绑定基础设施,现在管理员只需为网关创建门户并分享 URL,用户通过企业 IdP 登录后即可按提供商逐个授权,门
英伟达 CEO 黄仁勋在 All-In Summit 舞台上用免提电话连线美国总统特朗普。特朗普在通话中将近期对 AI 发展的担忧称为“骗局”,并宣称“机器人不会接管世界”。此前 Anthropic CEO Dario Amodei 发表长文《We Must Pace the Frontier》呼吁放缓 AI 发展并加强政府协调,特朗普随后在 Truth S
另有 1 家信源报道
llama.cpp 发布 v0.4.1,新增 Maple 20B-A1B 三元 MoE、腾讯 Hy 4 预览版和 Spark2.5 模型支持,并改进 JSON schema 处理、聊天解析、日志和服务器子进程管理。核心变更包括修复 DeepSeek2、GLM-MoE 等模型的 MTP KV 缓存分配,以及 Qwen/Kimi/GLM 的 GDN 归一化问题。
据404 Media调查,OpenAI雇佣数百名合同工阅读真实的ChatGPT用户对话,用于改进模型回复。这些审核员按1到7分给回复打分,并负责减少模型过度谄媚和拟人化行为。审核内容虽经匿名化处理,但仍可能包含敏感个人数据,且部分用户曾明确要求ChatGPT保密。OpenAI仅在FAQ中低调提及人工审核,用户可关闭默认开启的“Improve the mode
微软发布了一份新的 AI「行为准则」,用于指导其 AI 模型避免危险行为。该文件聚焦微软 AI 内部模型训练的价值观与红线,包含禁止网络攻击、核武器、深度伪造等「绝对约束」,以及防止模型规避人类监督的条款。文件预测未来十年超级智能将在多数任务上超越人类,并强调控制与对齐的重要性。微软 CEO 纳德拉公开表示欢迎「嵌入式评估者」等机制,与 Anthropic、
另有 2 家信源报道
Richard Socher 在 Latent Space 播客中介绍其新公司 Recursive,该公司已筹集 46.5 亿美元种子轮,目标是构建可自动化 AI 研究本身的「Eureka Machine」。他声称 Recursive 的 AI 研究系统在不到两天内于优化任务上超越人类及其智能体,并在 NVIDIA GPU 内核优化中无需 CUDA 专家团队
AWS 发布博客,提出生成式 AI 定制化光谱的 8 步决策框架,帮助团队在提示工程、RAG、微调、继续预训练和从零训练之间做出选择。框架分为 USE、ENHANCE、TRAIN 三类,并映射到 Amazon Bedrock 等 AWS 服务。核心原则是从最简单的方法开始,仅在准确率、延迟或领域需求不满足时才升级。
TechCrunch Disrupt 2026 将举办一场名为「What Happens When OpenAI Ships Your Roadmap」的 Builders Stage 论坛,邀请 Airbyte CEO Michel Tricot、Radical Ventures 合伙人 Rob Toews 和 Webflow CEO Linda Tong
克雷数学研究所(CMI)就千禧年大奖难题之一的纳维-斯托克斯问题发表声明,称该问题“显然已被解决”,解决方案目前正在审查中。数学家 Tristan Buckmaster 指控 OpenAI 在有关其研究的传闻泄露后,将资源转向该问题,将其草稿用于训练数据,并拒绝其合著者、就职于 Anthropic 的 Levent Alpöge 署名。CMI 表示审查过程刻
另有 1 家信源报道
OpenAI CEO Sam Altman 呼吁为先进 AI 建立全国统一的安全框架,并主张行业不应等待立法者,同时表示 OpenAI 现在会在可能带来重大能力跃升的训练前设定明确的安全协议。他强调“放缓”不等于“停止”,AI 进步仍将保持快速。周末 Anthropic CEO Dario Amodei、前 DeepMind CEO Demis Hassab
微软与卡内基梅隆大学的研究者对两种企业级工作流基准(TheAgentCompany 和 APEX-Agents)进行了受控工具接口消融实验,比较了五种接口:纯类型化工具、类型化工具加 bash、纯 bash、带持久化合成工具的 bash,以及程序化工具调用(PTC)。使用 Opus-4.8 和 GPT-5.5 测试发现,纯 bash 在两个基准上均优于纯类型
该研究通过配对同模型对比,在256个私有防污染任务上测试了厂商原生harness与中立harness(deepagents)对智能体编码能力的影响。结果显示,Opus 4.8和GPT-5.5上两种harness的解决率差异均不显著(分别约1.25个百分点),但Opus在仓库任务上原生harness落后9.0个百分点、在竞赛任务上领先23.7个百分点,呈现任务
该论文提出 Orchestra,将两个独立构建的生物信息学 MCP 服务器 RegNetAgents(推断调控网络拓扑)与 CASCADE(提供 LINCS 敲低、DepMap 必需性、超级增强子、DoRothEA 等独立实验证据)组合为基于 LangGraph 的多智能体工作流,并通过 MCP 协议暴露。核心主张是:要求网络拓扑证据与独立实验证据在候选调控
该论文提出一种面向 OpenFOAM CFD 的「案例包(case-bundle)」操作模型,包含 Build 与 Replay 两种模式:Build 由工程师审查、编码代理协助开发案例,Replay 将已审查案例复用于新变体。研究用 GPT-5.5 在 Codex 中构建了一个 interFoam 案例包,并在远程 HPC 上回放执行 140 个 STL
一位作者在 Hugging Face 博客中回顾自己从使用 ChatGPT 转向开源模型 DeepSeek 和 Qwen 的经历,并分享了自己尝试训练超小模型(如 Single Floppy、floppyx3、floppyx4)的失败过程。作者认为开源模型可检查内部机制,比闭源服务更可信,并提到因图书馆屏蔽 DeepSeek 而短暂使用 Claude,但受限
美国前总统奥巴马在民主党筹款活动上表示,民主党需要将人工智能列为“核心议程”,并制定“非常清晰的计划”来应对该技术在经济影响和安全方面的担忧。他建议民主党在重夺众议院多数后建立公开对话框架,并称AI若被妥善管控将有益,例如加速药物研发。众议院少数党领袖杰弗里斯对此表示认同。报道还提到奥巴马曾与Anthropic CEO Dario Amodei和OpenAI
开发者 DavidAU 在 Hugging Face 发布 Qwen3.8-27B-TWIN-TURBO-Fable-Cold-Fusion-709-L-Uncensored-NM-DAU-NEO-MTP-GGUF,这是基于 Qwen3.8 27B 的多阶段微调与合并模型,提供常规与 MTP 的 Neo/NEO MAX GGUF 量化版本。模型宣称在 arc
量子位报道了米羊科技在外滩大会路演中推出的桌面Agent产品白艾莉(Alice),提出「关系型生产力Agent」概念,将生产力任务交付与人格化陪伴结合。白艾莉具备自研AI人格系统(四层架构)、世界模拟引擎(接入高德地图API、330个真实场馆)以及专业子Agent协作能力,并支持朋友圈互动、拉黑等关系化行为,官方称次日留存73%、7日留存45%、90日留存1
Kepler CEO Vinoo 回顾自己在 Palantir、Citadel 和 Kepler 三次构建 forward deployed engineer(FDE)职能的经历,指出当前 AI 行业对 FDE 的定义极度混乱——从销售工程师到配额制 Python 代表再到咨询顾问,各公司理解完全不同。他通过 Palantir Project Frontli
韩国KAIST与Naver AI Lab的一项新研究发现,语言模型文本输出中的推理步骤在模型内部数值表示中也能被区分开来,且信号在中间层最强。研究团队定义了八种推理操作,用Qwen2.5-7B、Qwen3-8B和Gemma4-31B求解数学题,并用GPT-5标注各步骤。结果表明,内部状态携带的推理步骤类型信息超越了表面用词,且推理步骤依赖前文语境而非孤立形成