拾贝 信息博客抓取信息、AI 整理、人工审核发布的个人博客。

Posts

内容文章

内容由抓取与生成产出,经过审核后在此呈现。当前筛选:科技。

清除
2026/9/4科技

多模态模型扩大了统一处理范围,但尚无一张可比的“性能总榜”

Kimi K3、Cosmos 3 和 Omni 等技术报告与论文展示的变化,并非同一指标上的直接胜负,而是模型开始在更统一的架构中处理更多类型的信息:从文本和图像延伸到视频、音频、动作、三维几何或隐藏表征。公开材料支持这种架构范围的扩展;但它们使用的任务、指标和评测体系不同,尚不足以证明一场经由统一基准确认的整体性能跃迁。

2026/9/4科技

2026年企业AI Agent:从Copilot到自主工作流的关键瓶颈

2026年8月,四家自动化厂商——Nintex、Resolve、UiPath和Orkes——在两周内相继发布或更新了面向AI Agent的编排平台。来源:Nintex 来源:Resolve 来源:UiPath 来源:Orkes 这并非巧合。它们共同回应了一个正在发生的事实:企业AI正从“辅助式Copilot”转向“自主工作流”,但大多数公司卡在了中间地带,既无法让Copilot独立行动,也无法让自动化脚本应对复杂变动的业务。

2026/9/4科技

AI写代码已成默认,但收益几乎都流向资深工程师

2026年8月,《科学》杂志刊出一项引发讨论的研究:初级开发者是生成式AI编程工具使用最多的人群,但他们并未因此受益;真正借助工具提升生产力和创新产出的,是资深开发者。Daniotti等人训练了一个机器学习分类器,识别美国、中国、法国、德国、印度和俄罗斯六个国家软件开发者中由AI生成的代码,据此得出上述结论。

2026/9/4科技

推理能效提升,不等于训练成本已被改写

AI 芯片的“成本突破”常把两笔账混在一起:训练一个模型的投入,以及让已训练模型持续提供服务的开支。前者涉及长周期集群计算、数据准备、工程和基础设施;后者更直接受响应延迟、能效和单次服务成本影响。推理芯片的能效指标改善,不能据此推出前沿模型训练的总成本已按相同幅度下降。

2026/9/4科技

“AI 胜过医生”证明了什么:临床推理基准领先,不等于可以替代诊疗

一项发表于《科学》的研究称,大语言模型在五项高难度临床病例推理实验中,表现超过了由数百名医生构成的基线;研究还在一家大型三级学术医疗中心的急诊科,对随机选取患者比较了人类专家与 AI 给出的第二意见。研究作者的结论是,模型已超过多数临床推理基准,并因此需要开展紧迫的前瞻性试验。

2026/9/4科技

欧盟AI法案落地进行时:微软、OpenAI与开源社区的实际应对

2025年2月,欧盟《人工智能法案》第一批条款生效,全球首部全面的人工智能监管法规进入实施阶段。这部法案对AI系统采用基于风险的分类监管,通用人工智能模型(GPAI)负有透明度、安全与信息安全等义务,已明确禁止八类“不可接受风险”的AI用途。面对这一框架,科技公司如何将监管要求转化为具体行动?从微软、OpenAI到Hugging Face,不同角色的企业给出了不同的应对路径。