Grok 4.7 现已在 Amazon Bedrock 上可用
xAI 的 Grok 4.7 现已在 Amazon Bedrock 上线,作为前沿模型,专为编码、长时间运行的智能体和知识工作设计。该模型具有 500K token 的上下文窗口和四个可配置的推理难度级别。可通过 Responses、Chat Completions 和 Converse API 访问。
NEWS
按官方发布、研究进展和社区信号分层查看。这里只保留标题、短摘要、时间和原文链接,不转载全文,也不把社区讨论当官方事实。
xAI 的 Grok 4.7 现已在 Amazon Bedrock 上线,作为前沿模型,专为编码、长时间运行的智能体和知识工作设计。该模型具有 500K token 的上下文窗口和四个可配置的推理难度级别。可通过 Responses、Chat Completions 和 Converse API 访问。
Claude Sonnet 5.5 New Sonnet model from Anthropic today. They say it "runs 30%+ faster, and costs up to 30% less for most work" - it's priced the same as Sonnet 5 but appears to beat it on every benchmark, and should be cheaper to run as well. Here are some pelicans riding bicycles . Sonnet 5.5 suffered from the same bug as Opus 5.5 : the "max" thinking effo
微软亚洲研究院 – 新加坡迎来了首个周年庆,已为前沿 AI 研究奠定了坚实基础。该实验室深化了与亚太地区政府、学术界和产业界的合作,专注于通过合作伙伴关系和人才培养将研究转化为实际影响。
OpenAI 就涉及澳大利亚政府网站的事件道歉,并概述了加强澳大利亚网络防御的更强保障措施。公司承诺加强安全措施和支持以防止未来再次发生。
Mistral AI 宣布在德国慕尼黑开设新的研究中心,专注于 Physics AI 和 Industrial AI 研究。该中心将与德国工业界合作,推进这些专业领域中的应用 AI,强化 Mistral 在欧洲的业务布局。
Hugging Face 发布 Holo4,一个旨在赋能通用计算机使用智能体的系统。该项目使 AI 系统能够与计算机界面交互并控制计算机界面以完成多样化任务。关于架构、功能和可用性的详细信息可在 Hugging Face 平台上获取。
本文研究了联邦优化中求解随机变分不等式(VI)的收敛率问题。作者指出现有收敛率与联邦凸优化中最先进界之间存在显著差距,并提出了改进的算法方法。该研究为非合作博弈环境下的联邦学习方法提供了理论进展。
METR开发并部署了一个基础实时按动作监控系统,以增强AI智能体评估期间的安全性。该监控受OpenAI、Anthropic和英国AISI近期事件的启发,能够检测可能导致现实世界危害的动作。该系统旨在可靠地标记评估运行期间潜在的危险智能体行为。
NarrateAI 通过五种关键技术为 Amazon Bedrock 提供生产就绪的 LLM 质量保证:自适应管道编排、跨账户多模型故障转移、实时流式评估、组合评估和数据准确性验证。这些方法在保持实时响应流式传输能力的同时实现了约 99% 的数值准确性。
Google DeepMind推出了带有Live Avatar功能的Gemini 3.8 Live。此次发布为Gemini 3.8带来了交互式头像功能,实现了更具动态性和视觉吸引力的AI交互。此更新代表了Google DeepMind在多模态AI技术方面的最新进展。
NVIDIA已加入一个全球研究组织联盟,致力于应用开源科学方法进行大流行防范。该倡议旨在确保当下一次大流行出现时,研究人员能够比应对COVID-19时更快做出反应。COVID-19受益于数十年的冠状病毒先前研究,使疫苗研发创下了纪录。
HEMA 是一家拥有百年历史的荷兰零售商,构建了 HAL——一个基于 Amazon Bedrock AgentCore 的内部 AI 助手,使用 Model Context Protocol (MCP) 将受治理的知识直接交付到团队已使用的工具中,从而消除门户跳转。该架构在客户端无需 AWS 凭证,安全性以 Microsoft Entra ID 为基础进行身份验证和访问控制。