Quarkus LangChain4j 1.13.0 发布:新增 Guardrails 页面与工具调用支持
Quarkus LangChain4j 发布了 1.13.0 版本,该版本升级了 LangChain4j 依赖至 1.19.0,并引入了多项新功能,包括在 Dev UI 中新增 Guardrails 页面、支持在 AI 服务方法上使用 @Skills 注解、为 GPULlama3 添加工具调用支持,以及修复了多个问题。此外,还改进了文档结构,将 Agenti
公司与模型 · Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 08:14
Quarkus LangChain4j 发布了 1.13.0 版本,该版本升级了 LangChain4j 依赖至 1.19.0,并引入了多项新功能,包括在 Dev UI 中新增 Guardrails 页面、支持在 AI 服务方法上使用 @Skills 注解、为 GPULlama3 添加工具调用支持,以及修复了多个问题。此外,还改进了文档结构,将 Agenti
llama.cpp 发布了 v0.1.2 版本,主要更新包括同步 ggml 子模块、升级 ggml 版本至 0.20.2、修复 xcframework 构建问题、优化 CUDA 性能(MMVQ nwarps=8)、改进 UI 和文档(如 MCP stdio 服务器说明)、增强 mtmd 图像处理(使用 SHA256 哈希)等。该版本还提供了 nightly
英伟达联合阿波罗、贝莱德等六家华尔街机构,计划建立算力融资平台,动员超5000亿美元第三方资本,以解决客户购买GPU的资金瓶颈。该计划旨在将GPU销售转化为可融资的长期项目,但面临租金和残值风险,且需检验下一代芯片上市后旧GPU的偿债能力。
豆包发布产品更新,在“工作任务”模式下推出“豆包虚拟桌面”功能,可操作Windows电脑。该功能基于通用GUI能力,无需MCP、API、插件和CLI即可看懂界面并完成操作,支持跨软件任务,且不抢占用户鼠标键盘。用户需下载最新Windows豆包电脑版并完成授权初始化。
清华团队创立的清昴智能专注于AI自进化Infra,通过AI优化AI技术提升国产算力效率,将复杂算子开发周期从两周压缩至约1小时,模型适配周期从一个月降至1天至1周。公司已适配数十款国产芯片,并基于此打造日均万亿级Token工厂,提供Token售卖和平台输出两种商业模式。
OPPO软件工程事业部总裁唐凯在支付宝AI生态合作伙伴大会上指出,当前Agent发展的结构性矛盾是模型能力已超过产业链的组织能力,尽管开发To C Agent产品不难,但形成商业闭环仍面临服务和生态孤岛问题。OPPO与支付宝合作构建AHA协议,实现端侧可信互联,已打通近200个常用功能,覆盖18个数字民生服务场景,为支付宝带来数百万日活增量。
DeepSeek 于 8 月 17 日上调 V4 Pro API 价格,其中缓存命中价格在高峰时段涨幅高达 11 倍,从 0.025 元/百万 Token 涨至 0.3 元/百万 Token。涨价原因是长上下文需求激增导致后端缓存颠簸,存储、IO 和调度成本上升。文章分析了 DeepSeek 的 KV 压缩和冷热分层技术,并对比了 Anthropic 和 O
SpaceXAI推出了Grok Bot,这是一个由持久化AI代理组成的系统,运行在专用云计算机上,能够与网站、应用、收件箱等工具交互,执行多步骤任务并在需要审批时返回给用户。与专注于编码的代理不同,Grok Bot旨在处理跨业务应用的更广泛工作流,支持并行运行多个代理、代理间通信以及通过共享线程交换上下文。该系统源自内部原型,用于销售、营销、运营和软件开发等
据404 Media报道,亚马逊正在购买大量稀有书籍,通过切断书脊并扫描的方式用于AI模型训练。一个追踪设备显示,一本稀有书籍最终被送往拉斯维加斯的亚马逊设施VGT3。亚马逊回应称,购买书籍是为了改善客户使用的产品和服务。由于互联网文本已被大量使用,稀有书籍成为新的训练数据来源,且2022年前出版的书籍不含AI生成内容,可避免模型崩溃风险。
另有 2 家信源报道
AI 芯片初创公司 Groq 宣布获得 3.5 亿美元融资,由 Disruptive 领投,Nvidia 计划参投,估值 35 亿美元,较去年 9 月的 69 亿美元有所下降。Groq 正从 AI 芯片制造商转型为提供 Nvidia GPU 和 AI 基础设施服务的 neocloud 公司,计划到 2027 年将数据中心容量从 54 兆瓦扩展到 200 兆瓦
404 Media 通过在一批约1000本稀有书籍中放置苹果 AirTag 进行追踪,发现这批书最终被送往亚马逊位于拉斯维加斯的 LAS8 设施 VGT3 区域,该区域被证实会破坏性扫描大量书籍,用于 AI 训练。此前已有猜测称匿名买家大量购书是为了 AI 训练数据,此次追踪提供了直接证据。
另有 2 家信源报道
Import AI 第469期介绍了三个AI研究进展:DiG-bench基准测试通过70个游戏评估AI在未知环境中的发现能力,结果显示Opus 5和Fable 5表现最佳但远未达到人类水平;Paradigm Research发布了一个模拟递归自我改进的浏览器游戏;AI初创公司Inherent发布了论文,介绍其构建的AI科学家模型Faraday,用于监督前沿模
雷峰网报道了WorkBuddy升级其“资料库”功能,使普通用户能用自然语言生成、编辑和发布HTML页面,并支持CSV数据联动和多人协作。作者通过制作书影音世界地图和处理长播客文本两个案例,展示了HTML作为AI办公新载体的潜力,并探讨了知识沉淀与持续使用的重要性。文章还引用了“HTML is the new Markdown”的观点,指出机器需要结构、人需要
美团技术团队发表了一篇关于Agent评测的科普文章,系统介绍了评测的定义、体系建立方法以及长程Agent框架带来的评测变化。文章基于图灵Agent评测团队两年的实践经验,提出了“观测+评测=持续迭代”的研发公式,并分享了人人对齐、人机对齐等核心方法论。文章还讨论了长程Agent时代评测范式的变化,以及Skill评测等新趋势。
Jendrik Jordening 在演讲中讨论了如何用 LLM 构建选择系统,源于采购自动化任务。他指出了 LLM 在决策中的问题,如上下文窗口限制、难以集成现有基础设施、易受提示注入攻击等。他还分享了使用 LLM 生成演示文稿的经验,并提出了规则 0:移除随机性,通过设置温度为 0 和禁用思考预算来确保输出稳定。
YC 开源了企业级 Agent 管理工具 QM,上线三天获得 3.9k GitHub Star 并登顶 Hacker News。QM 通过作用域隔离、持久化沙箱、模型无关架构和三级安全策略,解决企业场景中 Agent 的数据隔离、权限治理和环境一致性问题。其核心设计是让 Agent 代表具体员工并使用公司分配的凭证,而非赋予独立超级权限,从而支持审计和责任追
菲尔兹奖得主Timothy Gowers指出,近期AI在数学领域的重大突破多通过寻找反例实现,如OpenAI模型解决Erdős单位距离问题、Claude协助发现雅可比猜想反例等。Gowers认为AI擅长在巨大搜索空间中寻找特殊对象,但缺乏人类数学家的直觉判断力,并预测AI将快速进步。
阿里云官方AI博客介绍了智能客服从传统NLP机器人到RAG增强,再到AI原生智能体的演进过程,并重点阐述了如何构建“评估-诊断-优化”三位一体的运营Agent平台,利用大模型自动评测客服对话效果,实现BadCase发现准确率85%以上,根因归类和优化建议生成准确率80%以上,显著降低人工运营成本。
据英国《金融时报》报道,OpenAI 于上月底解散了其预备团队,该团队负责评估模型风险并制定缓解措施。相关职责被拆分至生物、网络等特定领域并并入现有团队。这是 OpenAI 在筹备 IPO 过程中对其安全团队的最新调整,此前已有多个安全相关高管离职,引发外界对其忽视安全的批评。
peculiar-ragdoll 发布了 Nail-Qwen3.6-35B-A3B-GGUF,这是基于 Qwen3.6-35B-A3B 的 4-bit 量化模型,采用改进的聊天模板和强制系统提示,旨在减少过度思考、工具调用失败和冗长输出。在基准测试中,Nail 在响应速度和多轮对话质量上优于 Qwen3.6-27b 及其微调版本,但在长上下文任务中,其密集版