
DeepSeek-V4.1-Flash 发布,文本与 Agent 性能全面提升、兼具原生多模态视觉理解能力...
这条新闻已抓取入库,中文摘要正在生成中。你可以先打开原文查看完整内容。
今日版 / 2026年9月27日星期日
limbo数据更新时间
9月27日 01:01
启用来源
17
抓取状态
真实抓取
Front Page / Intelligence Edition
聚合开源模型、算力芯片、研究论文、公司动态与政策监管,用科技报纸的方式快速阅读全球 AI 前沿。
编辑台状态
当前显示 100 条抓取新闻,头版按新鲜度、AI 摘要状态和热度自动排序。
24小时
1
48小时
1
已摘要
43
57 条新闻正在等待中文摘要。

这条新闻已抓取入库,中文摘要正在生成中。你可以先打开原文查看完整内容。

阿里巴巴的Qwen团队发布Qwen 3.8模型,采用Apache 2.0开源许可。该模型为270亿参数稠密模型,在编码和办公任务上优于更大的Qwen 3.7 Plus,原生支持262,000个token的上下文。

谷歌在推出3.6 Flash仅三周后,发布了Gemini 3.7 Flash。新模型据称是谷歌最强大的编程和AI代理模型,其基准测试显示,性能优于Claude Sonnet 5和GPT-5.6 Terra,而价格仅为它们的一半。
open / models
追踪开放权重、社区生态和模型许可变化。

阿里巴巴的Qwen团队发布Qwen 3.8模型,采用Apache 2.0开源许可。该模型为270亿参数稠密模型,在编码和办公任务上优于更大的Qwen 3.7 Plus,原生支持262,000个token的上下文。
智谱AI发布GLM-5.1模型,采用MIT开源协议,并已在api.z.ai和BigModel.cn等开发者平台上线。该模型专注于长周期任务处理,旨在提升AI在复杂场景下的应用能力。
Qwen团队发布Qwen-Image-Edit,基于20B参数的Qwen-Image模型,将文本渲染能力扩展到图像编辑任务,支持精确文本编辑。该模型同时利用Qwen2.5-VL进行视觉语义控制,VAE编码器进行视觉外观控制,实现语义和外观编辑。
compute / chips
覆盖 GPU、AI 加速器、云算力和推理成本。

OpenAI于12月发布GPT-5.2,号称最强大的专业知识工作模型系列,并在2月推出首个自主编码模型GPT-5.3 Codex。这些模型均在NVIDIA Hopper和GB200 NVL72系统上训练和部署。

这条新闻已抓取入库,中文摘要正在生成中。你可以先打开原文查看完整内容。
top / stories
当天最值得先读的大模型进展。
global / briefs
来自不同国家与地区的短讯聚合。

阿里巴巴为其新AI模型Qwen 3.8发布宣传视频,展示AI工作而人享受爱好,与OpenAI和Anthropic的失业警告形成对比。但本质上仍是营销。

Anthropic 的 Claude Cowork 桌面应用新增功能,允许用户录制完成任务时的屏幕操作并添加语音解说,Claude 可将整个过程转化为可复用的技能。

谷歌将NotebookLM更名为Gemini笔记本,并更深度整合到其生态系统中。新功能为每个笔记本配备专属云端计算机,可编写和运行代码,初期面向AI Ultra和Workspace用户。同时,谷歌搜索开始支持应用连接。
research
论文、基准、架构和多模态能力更新。

谷歌在推出3.6 Flash仅三周后,发布了Gemini 3.7 Flash。新模型据称是谷歌最强大的编程和AI代理模型,其基准测试显示,性能优于Claude Sonnet 5和GPT-5.6 Terra,而价格仅为它们的一半。

用户常向大语言模型表达信念,但表达方式(如预设、证据标记、语气等)会影响模型是否采纳上下文。研究引入分类法,系统评估17种语言表达类型对模型遵循上下文或坚持先验知识的影响,发现更大模型和指令模型更不遵循上下文。

Kimi推出开源多模态模型K3,拥有2.8万亿参数和百万token上下文。在自家基准测试中,K3接近Claude Fable 5和GPT 5.6 Sol,超越Opus 4.8和GLM 5.2,但价格显著高于前代。完整权重计划于7月27日前发布。
companies
模型公司、云厂商和 AI 应用公司的商业动向。

这条新闻已抓取入库,中文摘要正在生成中。你可以先打开原文查看完整内容。

Anthropic 于 2026 年 6 月 30 日推出 Claude Sonnet 5,该模型在编码、智能体及大规模专业工作方面均达到前沿性能,旨在提升工作效率与自动化水平。

Google 宣布 Gemini API 中的托管代理(Managed Agents)新增后台任务、远程 MCP 等能力,帮助开发者构建更可靠的生产级代理。
policy
安全评估、监管规则和国际治理框架。

这条新闻已抓取入库,中文摘要正在生成中。你可以先打开原文查看完整内容。
这条新闻已抓取入库,中文摘要正在生成中。你可以先打开原文查看完整内容。